context-infra 检查与复盘infra.guiming.net · 全内容自包含呈现 · 生成于 2026-07-21 16:28 UTC

workflow_solid_decision_review

Z3 全文↑ Z2 条目

道-方法 · 道层 skill 全文

← 返回道层 skill 索引 · 返回方法论区

本页是 <code>rules/skills/drafts/workflow_solid_decision_review.md</code> 的逐字投影(仅隐私清洗,零改写)。

时点提示:本页是仓内文件 rules/skills/drafts/workflow_solid_decision_review.md 的逐字投影(仅做隐私清洗:仓库根绝对路径→相对路径、家目录→~/;除此零改写)。若源文件后续有修订,以仓内真源为准。

草案 Workflow:Solid Decision 审查

状态

Draft skill。来源需求:adhoc_jobs/workflow_controller_loop_evolution_20260505/loop_update_management_20260523_20260524/SKILL_REQUIREMENT_PROMPTS.md

当某个 decision、design、claim、Phase transition、closure、promotion、scheduler stop 或 Final Report 状态取决于证据是否足够强时使用。

这个 draft 还不是正式晋升的 Workflow skill。workflow_controller_loop 仍可通过 task card 的 protocol_visibility 路由 reviewer / Controller decision-gate Unit 读取它。

目的

本 skill 判断从现有证据中可以诚实声明什么。它防止 Loop、Skill、测试和报告决策把 self-evaluation、文件完整性、cold-read judge 或一个 positive case 当成 broad behavior 的证明。

它不执行任务、不设计测试套件,也不替代文件产生检查。它接收 bounded evidence bundle,并返回允许的 claim ceiling 和 next reaction。

必需输入

可用的 review packet 包含:

如果 packet 缺少 user requirement anchors、evidence paths 或 read-compliance status,该 decision 不能是 solid

证据等级

使用最弱的相关 evidence class 作为 claim ceiling。

等级含义典型允许声明
solid相关真实或 fresh 条件下的直接行为证据,已独立检查、基于 source;若声明很宽,还需要反例、mutation 或交叉验证 guard。其他门禁均通过时,可支持宽泛声明、收束、晋级或停止调度。
bounded证据直接且可用,但范围较窄,例如一个 bounded 真实案例、一个 feature 路径或声明过边界的 fixture。只支持有界完成或阶段完成。
partial存在有用证据,但覆盖、独立性、读取合规或真实条件保真度不完整。继续、修复或明确写成 partial report。
observational证据来自历史笔记、审查者文本、静态检查,或没有实际运行目标行为的冷读模拟。只支持假设、设计学习或分流。
weak证据是自评、文件存在、artifact 丰富度、用一个正例支撑宽泛声明、泄漏 oracle、只有 summary 的证明或无 source 断言。不支持晋级,不支持宽泛收束,需要修复。

invalid_or_leaked 不是证据等级;它是 oracle 泄漏、禁读、fixture 被改写或状态冲突导致证据不可安全使用时的裁决。

四域词表对照(跨域判定时用哪套词表看哪个域)

本 skill 的证据五级(solid / bounded / partial / observational / weak)是证据强度词表,专管「从现有证据能诚实声明到多强」。它不是唯一的判定词表——跨域判定时会撞见另外几套语义相邻但域不同的受控词表。用错域就等于用错量尺:证据强度不能替 claim 生命周期、也不能替史实 verdict。这里只登指针(枚举值不复制,去各真源看),说明每套管哪个域:

词表(真源指针)管哪个域与本 skill 证据五级的关系
证据五级 solid/bounded/partial/observational/weak(本 skill §证据等级即真源)证据强度:从现有证据能诚实声明的上限(claim ceiling)本表;下述各表判定时都可能需要它定级
claim 四态 built/wired/effective/steady(rules/TERMS_REGISTRY.md §1 → context_infra_migration_20260709/GLOSSARY.md r012 + METHODOLOGY_AMENDMENT_R012.md:94单元/资产生命周期:建成→接线→真实效果→跨 run 稳态正交轴:一个资产可以 wired 但支撑它「已生效」的证据只到 partial。判 effective/steadysolid/bounded 级行为证据,不能拿 built-not-wired 的存在性冒充
判断 Agent 四值 worked/worked_partially/did_not_work/cannot_judge(rules/TERMS_REGISTRY.md §1 → rules/DETERMINISTIC_SEMANTIC_LAYERS.md §5)判断 Agent 输出值域:某次运行「有没有奏效」是本 skill 的下游消费者之一:判断 Agent 给 worked/… 时,其证据仍受本表 ceiling 约束(worked 但证据 observational = 只支持假设,不支持 broad closure)
史实 verdict 5 态 contradicted/misframed/partly_supported/unsubstantiated/corroborated(rules/TERMS_REGISTRY.md §1 → chinese_internet_pseudohistory_research_20260716/…claim_ledger.tsv verdict 列 + tools/claim_ledger_check.py史实/事实主张真伪方向:一条主张与证据是相符还是相悖不同轴——verdict 是「主张对不对」,证据五级是「支撑这个 verdict 的证据有多强」。二者成对用(如 contradicted × high = 高置信地判其错),别把 verdict 当证据强度
confidence 三档 high/medium/low(rules/TERMS_REGISTRY.md §1 → 同 verdict 的 claim_ledger.tsv confidence 列)对上面某个 verdict 的置信度与本 skill 证据五级语义相近但不是同一套:confidence 是史实 program 的置信标度,证据五级是本 skill 的 claim-ceiling 标度;跨引时显式声明用的是哪套,不混用

用法:判「资产是否 landed / 生效」→ 主看 claim 四态,证据五级定其状态声明的强度;判「某次运行奏效否」→ 判断 Agent 四值 + 本表 ceiling;判「某史实/事实主张真伪」→ 史实 verdict 5 态 × confidence 三档,本 skill 只在有人要给「这个 verdict 的证据够不够强」定级时介入。全部真源存在性登记见 rules/TERMS_REGISTRY.md §1(跨域术语指针在 §3),铸新判定词表前先查该簿防撞名。

硬门禁

输出 Schema

把这个 section 写入 effect review、Decision Packet、closure review,或专门的 evidence/reviews/solid_decision_<id>.md

solid_decision_review:
  target_decision:
  target_claim:
  user_requirement_ids: []
  phase_position:
    task_phase_plan_id:
    controller_phase_id:
    user_requirement_phase_id:
    agent_unit_phase_id:
  required_read_paths: []
  read_compliance_verdict: pass | partial | fail | not_applicable
  missing_required_reads: []
  evidence_map:
    - evidence_path:
      labels: [D, I, W]   # Decision / Implementation / Workflow evidence, when useful
      supports:
      limitations:
  weakest_evidence_class: solid | bounded | partial | observational | weak
  invalid_or_leaked: true | false
  synthesis_over_peers: true | false             # 是否对多个 peer 输出做综合判断
  synthesis_independently_verifiable: true | false | not_applicable
  anti_conformity_guards: []                     # 仅 unverifiable 综合需要: verifiable_evidence_given | de_authority | dissent_preserved | provider_isolated
  claim_ceiling:
  decision_stability: solid_for_claim | bounded_for_scope | partial_continue | observational_only | weak_repair_required | invalid_or_oracle_leaked
  next_reaction: repair | continue_execution | continue_test | branch | advance | await_user | block | close
  why_this_reaction:
  repair_or_continuation_tasks: []
  forbidden_claims: []

Loop 集成契约

workflow_controller_loop 中,如果 review result 会影响 phase advance、closure、await_userblock、promotion、scheduler stop、broad claim wording 或 Final Report status,本 skill 必须介入。

通常顺序是:

  1. read-compliance review 检查 Unit 是否读取了 required phase files,并避开 forbidden paths。
  2. artifact review 检查 promised outputs。
  3. effectiveness review 检查 task effect。
  4. solid decision review 设置 evidence class、claim ceiling 和 allowed next reaction。
  5. next-step planner 把结果转成下一 Unit contract。

低风险小 Unit 可以把这些内容作为一个 round review 文件的多个 section。Protocol-gated、closure-sensitive 或 multi-agent Unit 应把 read-compliance 和 solid-decision section 写得足够明确,确保另一个 agent 能消费。


← 返回道层 skill 索引 · 返回方法论区