XII.0.14 版本 · 有边界的测量证据

40 次尝试 / 20 个匹配对 / 主张保持受限

STOLZ A.I. v0.14.0

修正后的 Codex CLI 测量流程保留了每一次公开或合成尝试。每对的必需结果与验证状态一致;每个独立队列的 STOLZ 路径都使用了更多可比 token。

规范产物
包含 197 个文件的 npm 包
保留尝试
40 · 无重试或排除
匹配对
20 · 结果与验证一致
固定运行环境
Node.js 22.22.2

§ 1baseline − STOLZ

结果一致,差值为负。

差值 = baseline 输入与输出 token − STOLZ 输入与输出 token。负值表示 STOLZ 路径使用了更多可比 token。

Sol 队列与 Astra 对照分开报告,不发布跨模型汇总。

  1. 01

    Sol/xhigh · 读取与导航

    −208,689 个可比 token

  2. 02

    Sol/xhigh · 构建与检查失效

    −207,733 个可比 token

  3. 03

    Sol/xhigh · 多步骤场景

    −214,706 个可比 token

  4. 04

    Astra/medium · 独立对照

    −208,111 个可比 token

§ 2evidence / boundary

公开证据能够支持的结论。

全部 40 次尝试均为公开或合成数据,且没有重试或排除。每对的结果与验证一致。精确的 197 文件归档在 Windows 与 Linux 上通过生命周期冒烟测试。

01

v1.0 仍未启用

在出现具名试点负责人和 28 天真实证据之前,状态保持为 `followup_gap`。

02

主张保持受限

提供商总 token、cache-write、compaction、service tier、价格、成本、账户限制、普遍效率、节省、速度和跨模型兼容性均不可用或不作声明。