项目时间线
从 2026 年 3 月底到 8 月,不到五个月,一个仓库从"Rust 移植"长成"有账本、有验证、有政策"的标本。读完本页约 9 分钟。
Rust 移植里程碑:9 条 lane 全部合并 main
对账文档 PARITY.md 记录:292 commits、48,599 行 Rust、2,568 行测试、3 位作者、9 crates。9 条 lane(Bash 校验、CI 修复、文件工具边界、TaskRegistry、任务接线、Team+Cron、MCP 生命周期、LSP 客户端、权限强制)全部落地,40 个工具 spec 成型(PARITY.md「Tool Surface」)。
"Ralph" 迭代 1–4:US-001 ~ US-016
progress.txt 显示一个名为 Ralph 的 agent 按迭代实施用户故事:启动失败证据分类、事件 schema 与排序、任务包类型化、自主编码策略引擎、kimi 模型兼容修复、criterion 基准……每次迭代都附"VERIFICATION STATUS: build/test/clippy/fmt 全 PASSED"。
ROADMAP #200:交互式 MCP/工具权限提示
日志原话:"Selected next actionable backlog item because no active task was in progress."——没有活跃任务时,agent 自动从待办里挑下一个。这是"自主排期"的痕迹。
OmX ultragoal:G001–G013 十三个目标,多 worker 团队(G013 = ROADMAP pinpoints #693–#695)
.omx/ultragoal/goals.json 记录目标级联执行:每个 goal 由 worker-1..4 + leader 组成的小队完成,带 evidence 与验证命令;CC2 看板生成 732 个条目(127 个 ROADMAP 标题、542 个动作全覆盖)。质量门与发布就绪报告(g012)成型。
当前状态:机器生成的知识库
AGENTS.md 由工具自动生成并提交:11 crates、55 工具、120+ slash 命令、工程约定与反模式清单。仓库继续作为"标本"被维护。
Ralph 迭代里的用户故事(选)
progress.txt 记录的用户故事可以按主题归组,每一组都对应一类"agent 自主工程"的真实问题:
| 主题 | 用户故事 |
|---|---|
| 启动可靠性 | US-001 启动失败证据分类(6 变体 + 8 字段证据包);US-012 信任解析器 + 白名单自动信任 |
| 事件系统 | US-002 规范事件 schema;US-013 事件排序与终态调和(8 测试);US-014 事件来源/环境标注(7 测试);US-015/016 重复终态事件抑制 |
| 任务与策略 | US-005 类型化任务包(scope/worktree 字段);US-006 自主编码策略引擎(18 单测 + 6 集成测试) |
| 分支与恢复 | US-003 陈旧分支检测(Fresh/Stale/Diverged + 4 种策略);US-004 恢复配方 + 尝试账本(7 场景) |
| 生态兼容 | US-007 插件/MCP 生命周期成熟度;US-008~010 kimi 模型兼容修复 + 单测 + 文档 |
| 性能 | US-011 criterion 基准:请求构建 10 消息 ~16µs、100 消息 ~209µs、工具结果扁平化 ~17ns–11.7µs |
注意这些故事的共同点:没有一个是"炫技功能",全是可靠性、兼容性、可观测性的"基础设施"——这正是 agent 自主迭代时被自动选中的工作类型。
对账快照 · 9 条 lanePARITY.md▶
迭代日志 · Iteration 1 原文progress.txt▶
思考题
Q1 · 在这条时间线里,挑出 3 个你认为必须由人决定的里程碑,和 3 个可以交给 agent 的。依据是什么?
提示:涉及方向、承诺、外部关系的大概率要人;纯执行、可验证的可以交给 agent。
Q2 · 4 月 27 日那条日志显示 agent 会"自动挑选下一个任务"。你认为这种自主排期是好事还是风险?边界在哪?
提示:自主性 vs 目标漂移;如果它挑的都是简单任务呢?