# 更正与范围说明

## 工具归属更正

Kimi Code 的 R01 结果由 Kimi Code 实际执行。历史目录名和说明误写为 `zcode`，经评测者确认后，原始结果目录已更正到 `kimi-code/输出/kimi-code/`。报告正文未做内容改写；网站公开副本只修正工具路径、脱敏评测机绝对路径，并保留原始文件 SHA-256。

## 统一模型

评测者确认本批次登记的七个 Agent 均使用 Kimi K3。Agent 产品构建版本、推理/上下文参数、权限与沙箱等设置没有完整留档，公开数据不推断这些字段。

## 榜单范围

本网站只列入冻结批次清单中的七个工具。逐题验收要点已作为 `评分依据/` 独立附录公开；它们不在“样本-v1.0”可执行目录中。页面所示 95.6 等数字是先前人工阶段分，公开计算方式和原值见[评分记录与版本](评分记录与版本.md)。当前 `评测者资料/计分表.csv` 没有逐题独立分数，正式分数待逐题验收及盲评后再发布。报告里 Agent 自述的 PASS 不作为独立验收结论。

MiniMax Code 的 R01 报告记载 12 道题在单个批量会话内执行，而冻结规程要求每题独立会话（T12 两轮除外）。因此本网站把该批次标为会话规程偏差；历史 84.0 和当时第 7 位只作原值记录，不代表严格可比位次。若要纳入严格排名，应按统一规程重跑。其他工具的会话隔离也应以可审计记录为依据，不能只凭报告文字推定。

公开包为 v1.0。题目和解答公开后会降低后续复测的盲测性；未来对照应使用新版本或保留题，并保留每版基准和分数。
