4 小时窗口 · 96 个数据点 · 覆盖率 100.0%
- glm-5.3-flash 是最强的模型,平均吞吐量为 108.11 词元/秒(峰值 165.75 词元/秒),而 nemotron-3-ultra 最弱,平均仅 1.53 词元/秒,在整个时间窗口内从未超过 2.56 词元/秒。
- deepseek-v4-pro 表现出最具运营意义的波动性,变异系数为 55.0%,在 11.68 至 92.28 词元/秒之间摆动,并呈现 32.3% 的下行趋势,最终收于 14.95 词元/秒;相比之下,deepseek-v4-flash 上升了 67.3%,达到 83.64 词元/秒的峰值。
- 不存在数据缺失的限制:全部 8 个模型均拥有 12 个预期样本中的 12 个、96 个有效数据点,并且在四小时窗口内覆盖率达到 100.0%。