术语表
术语表
短定义。带数字的条目都标了出处文件——这些数字不是从别处抄来的,是对着当前源码核过的,你也可以自己去核。
1. 规约相关
- 访谈(Interview)
- 把你的想法里还没做的决定找出来、逐条问你的环节。→ 第 5 章
- 模糊度分数(Ambiguity Score)
- 需求里还剩多少没说清,取值 0 到 1,越接近 0 越清楚。阈值 0.2。高于阈值会挡住 Seed 生成,绕过它的办法是显式传入
force(bigbang/seed_generator.py的域层闸只认force)。→ 第 5 章 - Seed(规约)
- 装着目标、约束、验收标准、数据结构的 YAML 工作规约。运行时照着它写,评估照着它判。七个顶层字段见
core/seed.py。→ 第 6 章 - 验收标准(Acceptance Criteria)
- 判断做完了的标准清单,每条都要能在屏幕上看到或被测试验证。其中的验证命令和期望输出是可选字段——没有定义它们的标准是合法存在的。→ 第 6 章
- 本体(Ontology)
- 这次工作处理的数据的结构:字段名和类型。YAML 键是
ontology_schema。→ 第 6 章 - A 级(Grade A)
- auto 模式的执行闸。等级分 A / B / C,只有等级为 A 且没有 blocker 时才放行(
auto/grading.py:may_run = grade == SeedGrade.A and not blockers)。被挡下来时会以grade_gate的名义标记 blocked。
2. 执行相关
- Core
- 负责访谈、Seed、执行管理和评估的 Ouroboros 引擎。
- 运行时(runtime)
- 真正动文件和代码的 AI 编码工具,比如 Claude Code、Codex CLI。目前有 13 个接入指南。→ 第 1 章
- MCP
- 运行时用来调用 Ouroboros Core 功能的协议。→ 第 4 章
- Double Diamond
- 执行的四个阶段:Discover → Define → Design → Deliver。存在的理由是不让实现在理解之前开始。→ 第 7 章
- lineage / generation
- 同一份工作的 Seed 修订链叫 lineage;其中一次「新 Seed + 一次运行」叫一代。世代阶段:
wondering→reflecting→seeding→executing→evaluating。→ 第 9 章
3. 评估相关
- Mechanical / Semantic / Consensus
- 评估的三层。覆盖率默认阈值 0.7(
evaluation/languages.py);语义层要求分数 ≥ 0.8(evaluation/models.py);合议要 2/3 多数、至少 3 个模型(evaluation/consensus.py)。三层齐跑只在直接评估这条路径上成立,演化循环里只跑 Semantic 一层。→ 第 8 章 - Drift
- 结果离原本 Seed 意图的偏离程度,0 到 1。超过 0.3 会触发合议(
evaluation/trigger.py)。低不代表功能对,只代表方向没岔。 - 独立性标签
independent/same_vendor/unavailable/unverified。按 vendor 家族判定,所以单一 vendor 环境下这个机制空转——那时标签会写same_vendor,不会假装独立(evaluation/reviewer_independence.py)。- 收敛(Convergence)
- 四选一,命中任意一条就停:最近两代本体相似度 ≥ 0.95、停滞(相似度连续 3 代不动)、反复反馈、30 代预算耗尽。至少要跑满 2 代才开始看前三条(
evolution/convergence.py)。0.95 不是必要条件。 - 回归(Regression)
- 上一代通过、这一代却挂掉的验收标准(
evolution/regression.py)。这个检测器的存在本身说明:「冻结」是把力气集中到没通过的标准上,不是保证已通过的不会再挂。
这一页的每个数字都注了出处文件。如果你核出来对不上,那多半是版本变了——请到 GitHub Issues 说一声,我们改这里。A 级那条我自己先写错过一次:只翻了 auto/interview_driver.py 没找到,就下了「没有这个闸」的结论,实际实现在 auto/grading.py。「在哪里没找到」和「不存在」是两回事。
