Performance
性能:持续采样 17.6 万次/秒,四档同版实测¶
30 MHz 实验档连续采集 180 秒,记录超过 3,157 万个样本,持续约 17.6 万次/秒。 四个连续变量每秒整组更新约 3.36 万次,连续 RAM 读取超过 1,061 KiB/s。
| 采集内容 | 4 MHz | 10 MHz | 20 MHz(实验) | 30 MHz(实验) |
|---|---|---|---|---|
| 单个 RAM 变量,4 B | 62,375.187 次/秒 | 123,476.345 次/秒 | 175,243.506 次/秒 | 176,087.050 次/秒 |
| 4 个连续变量,共 16 B | 10,221.122 组/秒 | 20,289.789 组/秒 | 28,750.679 组/秒 | 33,554.448 组/秒 |
| 连续 RAM,每块 4 KiB | 275.210 KiB/s | 580.807 KiB/s | 876.052 KiB/s | 1,061.498 KiB/s |
| 连续 Flash,每块 4 KiB | 277.877 KiB/s | 584.585 KiB/s | 883.061 KiB/s | 1,072.489 KiB/s |
以上全部来自同一版 r10 固件。单变量四档分别采集 30、30、90、180 秒;连续四变量各 15 秒,RAM 块各 20 秒,Flash 块各 15 秒。四个变量一次完整读取 16 B 才计一组,4 KiB 数据收齐才计一块。20 个场景的数据校验、CRC、时间戳和新增 SWD 错误检查均通过。
逻辑分析仪测得四档读数据时钟约 3.946、9.974、19.957、29.941 MHz。20/30 MHz 仍是本块开发板的实验采样入口,尚不代表 Keil、GUI 配置和在线/脱机下载入口均已开放并验证。
持续更新的速度,比批内峰值更有参考价值¶
表中速率包含组帧、调度和排队造成的批间空隙。30 MHz 的批内读取约 31 万次/秒,实际持续采样约 17.6 万次/秒;我们把后者放进主表,便于判断长时间观察变量的表现。主机稳态接收约 17.57 万次/秒,与时间戳统计接近。
优化重点是缩短两批数据之间的等待。在此前 r9 的同版对照中,专用组帧配合每批 64 条,让持续速率从约 14 万提升到约 17.5 万次/秒。增加到 128 条仅再提高约 1.7%,却出现更多队列暂满,因此 r10 选择 64 条。后续将继续拆分组帧、复制和传输等待的耗时,验证优化收益。
本轮高档仍记录到可恢复的队列暂满,不能把数据检查通过理解为完全没有等待。时钟校准、统计口径与历史记录