复杂任务/竞赛方法论母版
方法论道层 · Career/竞赛方法论
复杂任务/竞赛方法论母版
viewtype=双泳道流程图 · 答:复杂任务母版与竞赛特化如何分层 · 不答:具体赛题评分
通用母版 + 竞赛特化两层
真源路径:career/methodology/METHODOLOGY_COMPLEX_TASK_COMPETITION_v1.md · 图型:流程图(双泳道) · 域:Career/竞赛方法论
真源正文
报告元数据(frontmatter)
schema_version: fa-3
slot: methodology
doc: complex-task-and-competition-methodology
program: job_search_program_20260716
version: unversioned-draft(未打 SOP tag;本仓库用 ZeroVer X.Y 两级+git tag,无 v1.0.0 式 semver 记法,见 workflow_version_evolution.md §7)
requirement_anchor: ../requirement_records/JS-20.md(针对竞赛与复杂任务建立完整方法论:赛题完整拆解 + 版本迭代 + 模块化实现;参考 Design Philosophy Distillation 与 harness 任务状态哲学;成果统一到网站可视化)
author: r006 P4 成文(Opus 写作级;大纲=Opus 合成,六张力=Fable 终裁 DECISIONS_R006 §D-2)
created_at: 2026-07-18
status: bounded(未经完整竞赛周期 dogfood;证据档位取最弱一节,见末节 claim ceiling)
promotion_trigger: # 照抄 D-2 T-6 修改版 A 终裁——满足任一即可评估晋升进 contexts/methodology/
- 出现第二个真实消费者:非本 program session 的真实引用(不是推测需求)
- 或 dogfood ≥2 个竞赛周期(完整跑过发现→报名→迭代→提交→复盘)
- 晋升前置:先与既有道 skill 去重(避免第四平行存量),再走 contexts/methodology/
consumption_boundary: 本方法论回答「一个复杂任务/一场竞赛怎么从发现推进到复盘」。它管拆解节奏、决策路由、gate 划分、资产沉淀;它不管具体赛事的评分细则(留各赛 TASK_CARD)、不管家长展示怎么讲(归网站展示层 D-3)、不管编码规范(归 ~/.claude/rules/)。谁读、何时读见下方消费时刻表。
supersedes: 无(首版);本文件是 competitions/METHODOLOGY_INITIAL_20260716.md 的泛化母版,INITIAL 维持其历史状态不动复杂任务 / 竞赛方法论 v1
组织约定(D-2 T-6 终裁:整份留 program,内部分层保留切缝):本文件用两种标题前缀区分层次——
- 【通用母版】 = 脱离竞赛语境仍成立的复杂任务方法论(§2 决策路由 / §5 拆解迭代 / §6 编排 / §8 防自欺 / §9 资产沉淀 + §0/§1)。晋升进 contexts/methodology/ 时搬这些节。
- 【竞赛特化】 = 带竞赛/赛题专有语义的节(§3 信息战 / §4 本地评测 / §5.1 提交工程 / §7 竞赛 gate / 附录 A)。晋升后留 program。
诚实前置(成文 agent 复核 INITIAL 原文后保留的两条关键更正,供引用者不被旧摘要误导):
1. 所谓「三支柱」不是三条,是五条承重墙(INITIAL §②:通用-A 信息战 / 通用-B 本地评测闭环 / 通用-C 迭代节奏与提交工程 / 通用-D 评审者视角叙事 / 通用-E 止损判据)。「三支柱」只是前三条内核,D 和 E 同样承重。下游引用「三支柱」处一律读作「五承重墙(含三支柱内核)」。
2. 五承重墙全是诊断驱动的战术纪律(评分函数逆向、本地 oracle、Day-1 提交、评分表逐项对照、机械止损线),不是价值观陈述——与 §1 七元原则(价值观层)分属两层,不可互相替代。
消费时刻表(先读这张——harness 北极星「进」段要求:方法论必须声明何时被谁读)
| 时刻 | 谁 | 读哪节 | 一句话 |
|---|---|---|---|
| 竞赛/复杂任务开工时 | 主 agent | §3 信息战 + §7 Gate 1 | 动手前先把评分函数逆向、往届方案扒到代码级,并过 Gate 1 报名前评估。 |
| 每个 gate 边界时刻 | 主 agent + 有 Kill 权者 | §7 对应 Gate 判据(Tier1-4) | 用四层判据(准备度/must-meet/定量/排序)做 Go/Kill/Hold,Kill 权集中 Gate 1-3。 |
| 每日窗口排程时 | 主 agent(协调者) | §5 拆合迭代 + §6.3 T-3 层 | 注意力黄金窗(23-01/09-12,01:00 硬收工)作外层容器,当周约束赛优先占;OODA cadence 排窗口内。 |
| 每个决策时刻 | 做决策的 agent | §2 路由×授权正交表 | 先按 RPD 四条件判快道/分析链(怎么想),再独立按三档判谁拍板;不可逆动作一票升档。 |
| 收尾 / 复盘时 | 主 agent | §9 资产沉淀 + §10 Handoff | 隐性经验经 SECI 促进为 memory/methodology/skill;断点用自包含 HANDOFF 凭档续跑。 |
§0 · 【通用母版】元数据与消费边
职责:一句话说清版本 / claim ceiling / 谁在什么时刻读 / 不管什么。
- §0.1 头部必带 claim ceiling(本文 status=bounded)+ requirement_anchor + 消费边一句话。判据:方法论自身成熟度取最弱一节而非平均 [decision_quality §b-1 CM.01/CM.03「DQ 链最弱环决定整体质量」];消费边写「谁读、何时读」而非泛泛「用于……」[how_to_solve_it §b-4 CM.43「论证若从不使用定义则不完整」]。本文消费时刻表即此要求的落实。
- §0.2 与 METHODOLOGY_INITIAL 的关系:本方法论是 INITIAL 的泛化母版(剥离 AFAC/魔搭具体赛事,抽跨领域骨架),具体赛事留各自 TASK_CARD。挂接 [
competitions/METHODOLOGY_INITIAL_20260716.md] + INITIAL 状态机 INITIAL→REVIEWED→COMMITTED(与 §7 gate 命名绑定,见 §7.3)。 - §0.3 可视化检查设计原则(§0 承接 D-2「可视化检查=真空白」裁定,元判据雏形):网站组件优先做揭示状态/决策的(决策台/双线轨迹/生命周期泳道/资产流转),让完全不懂背景的人(家长/面试官)也看懂「现在在做什么、做到哪」[
bestpractice_final_report「不懂背景也能看懂」];纯装饰图表不做。组件清单见附录 B。残差:可视化检查方法论本身尚未成体系,网站页列 r007 残差(见末节)。 - 可视化钩子:方法论版本时间线(V-1,见附录 B)。
§1 · 【通用母版】价值观骨架(最高层,指针引用七元原则)
职责:给整套方法论一个价值观地基,回答「为什么这么做事」,摘要 + 竞赛映射,不复制原文。
- §1.1 七元原则摘要 [
adhoc_jobs/design_philosophy_distillation_20260716/synthesis/HARNESS_DESIGN_PHILOSOPHY.md第1章]。竞赛映射:MP2 判定权外移=本地评测不能自评(§4 通用-B);MP6 完成=真实消费=能提交能跑通才算数(§5.1 Day-1 提交);MP7 人只给方向=三档授权(§2)。 - §1.2 价值观层 vs 战术层分界:七元原则是价值观层(持久,跨任务不变),五承重墙是战术层(诊断驱动,每赛重写),两者不可互相替代 [good_strategy §d「durable orientation 与 per-competition time-bound plan 应显式区分不作 substitute」;该结论独立于其对三支柱内容的错误推测而成立]。
- 防伪 F-(内联):七元原则里 MP1 信任条件公理标为「生成根」,属该 campaign 的 bounded claim(12 题裁决包未回填前不升 v1.x)。本方法论引用 MP1 时只作价值观指针,不得当已定论的校准目标。
- 可视化钩子:价值观-战术映射图(V-2)。
§2 · 【通用母版】决策路由 × 授权:两个正交维度
职责:回答「一个决策怎么想(路由)+ 谁拍板(授权)+ 怎么判断做得好(质量闸)」。
[r006 终裁 · T-2 正交化重述]:路由与授权是两个正交维度,不是同一个门。大纲原倾向把「RPD 快道→档A」当耦合映射;D-2 采纳 GLM 逻辑澄清推翻之——快想不豁免慢批。
- §2.1 路由维度(怎么想)——RPD 四条件全中→快道(模式匹配 + mental simulation);否则→分析链(DQ 六要素 / PrOACT)。四条件 [rpd_time_pressure §a-3 CM.10]:①时间压力高 ②情境经验深 ③条件动态 ④目标欠定。需要 justification / 多方价值冲突 / 要真最优 / 情境可计算→分析链。
- §2.2 授权维度(谁拍板)——独立按三档判据判 [
rules/DECISION_BOUNDARIES.md三档 + §4 授权包折叠] + [competitions/DECISIONS.md§0 实战案例]:档A 自决(可推导+可逆+不冲突,log-only)/ 档B 推荐默认 / 档C 必须问人。 - §2.3 唯一耦合硬规则(硬编码):不可逆动作一票升档。[r006 终裁 · T-2] Kimi/DeepSeek 一致:时间压力下 case-by-case 会被合理化绕过,故硬编码不留裁量。一个「识别过 20 次的 bug 修法」RPD 很快(§2.1 判快道),但若改生产配置=不可逆→§2.2 授权维度直接升档C,快道不豁免。
- 防伪 F-8(内联):RPD「优于其他策略」是 blanket claim,诚实版是「RPD 特定地优于逐一对比」(Limitation 1:没对比 rule-based/delegation/wait-and-gather)。域够新(<20 次有清晰反馈的历史)正是 RPD 信心最不该给处——是边界条件非脚注 [rpd_time_pressure §c]。
- §2.4 三档的理论锚(跨书三方独立收敛,作交叉验证非新增):[decision_quality §a-7「Quick→intuition / Significant→DQ Appraisal / Strategic→DDP,与档A/B/C 同构」] + [rpd_time_pressure §b-1「RPD 四边界显式复用档A/B/C 词表不另造第五套框架」] + [decision_ops_trio §e「WRAP tripwire 本身是一条 auto-decide 规则;缺 tripwire 的决策落必须问人档」]。三方独立落同一形状=强交叉验证,非 ad hoc。
- §2.5 决策质量闸(给决策记录加可机械检查字段):[decision_quality §b-1「decisions.json 加 dq_six[] 六要素 0-100 + dq_weakest_link」] + [§b-2「judged_at 与 outcome_recorded_at 分离,reasoning 在结果已知后被改=hindsight bias 报警,纯 timestamp/diff 检查」] + [§b-3「alternatives compete not people:commit 前须 ≥2 个真正不同候选,非稻草人 decoy」] + [rpd_time_pressure §b-2「premortem 作档B/档C commit 前强制 5 分钟步骤,premortem_note 字段」] + [§b-3「de minimus 早警:累计 ≥3 个被逐条解释掉的异常本身是信号」]。
- 防伪 F-2(内联):DQ 的「50pp illusion-of-DQ gap」「1000:1 benefit-cost」是厂商自证数字(proprietary simulation,do-not-extract 明令禁作可移植基准)。不得作 decisions.json gate 的校准目标;方向性 claim(illusion 存在、结构性 bias 胜过培训)保留,数字不保留;「dq_six 全 100」只证「无已知弱环被忽略」不证「决策好」[decision_quality §c]。
- 防伪 F-6(内联):premortem(假设已失败再解释)源蒸馏 🟡(仅 2 个独立上下文),是「最可移植技术」但不得当 🔴 定论升格;写进闸时标其证据档位 [rpd_time_pressure §a-7;decision_ops_trio §c]。
- 挂接注:§2.5 字段与
workflow_solid_decision_review证据五级对齐(§4.2 详展),决策记录 schema 是两者共同承载。 - 可视化钩子:决策台(决策卡 + 三档标签 + dq_weakest_link 高亮,V-3)。
§3 · 【竞赛特化】赛前信息战(通用-A)
职责:动手前把「评分函数 + 往届方案」吃穿,回答「怎么不蒙眼射箭」。
- §3.1 承重墙原文指针 + 四步动作(逐字冻结 / 评分函数逆向 / 往届 TOP 扒代码级 / 情报台账化)[
METHODOLOGY_INITIAL§②通用-A,引用不复制]。 - §3.2 拆解操作化(把「理解问题」做成 phase 转换前的 checklist gate):[how_to_solve_it §b-1 CM.16「理解问题阶段先分离 unknown/data/condition 三元,各写一行才允许进 planning,防 diving into details before understanding」] + [§b-4 CM.43/CM.44「Pascal 规则:把提交规格里每个术语替换成其定义关系,核实定义事实真的出现在管线里——提交失败多为定义未满足非逻辑错」]。
- §3.3 情报的显著性判读(读含糊评分函数 / 对手信号):[ooda_tempo §b-3 MS_05「显著性优先五步:先框决定性问题(如『这评分函数奖励 label-probing 还是真能力』)→ 分离决定性信号与背景 → 三向输出(利我/利敌/太不稳不 commit)」,对口 DECISIONS §5——注意该条已按断言等级制重写:它是「未核对手信号的处理范例」(provisional 级待核假设),不是 known finding;引用它时按 §3.3 本条款的纪律读,勿当事实(2026-07-19 FM7 案例后更正)] + [decision_ops_trio §b-2「Decisive 找先解者:抽象问题上行到可用类比再迁移机制,非照抄表面」]。
- 挂接现有工具:[杠杆-1
workflow_requirement_intake/todo intakeR1 sha256 冻结 +workflow_recall_first_locate宽召回 +workflow_i2p_filter_compress≥2 非受支配候选](引用 INITIAL §④,不复制)。 - 防伪 F-1(内联):how_to_solve_it 四阶段模型 + Inventor's Paradox「更一般的问题可能更易解」有 unfalsifiable qualifier(「provided it's based on vision not pretension」=事后给失败贴 pretension 标签,不可证伪)。四阶段模型只 scope 到良结构问题(清晰 metric/格式/oracle)——赛题拆解正好符合;不得原样搬到开放式研究/设计任务。用泛化动作时须预写「什么算作泛化让任务更难」的证伪条件,不能只事后引成功案例 [how_to_solve_it §c,A_07/A_17/A_11/A_18 均 high_risk]。
- 可视化钩子:情报台账 + 评分函数逆向「子目标×边际夺分成本」热力(V-4)。
§4 · 【竞赛特化】本地验证闭环先行(通用-B)
职责:没有可信 local validation 不堆方案,回答「怎么判断真做完/真涨分」。
- §4.1 承重墙原文指针 + 动作清单(复刻官方评测器 / 可信验证划分 / 接 eval harness / 分数轨迹)[
METHODOLOGY_INITIAL§②通用-B] + [§④杠杆-2tools/eval_harness/]。 - §4.2 证据五级验收 [
rules/skills/drafts/workflow_solid_decision_review.md证据五级 solid/bounded/partial/observational/weak 取最弱为 claim ceiling + 硬门禁「单一 positive case 不能支持 broad closure」],对口 DECISIONS §5「A 榜榜面信号未核实前不构成能力结论」(07-19 按断言等级制改述)。 - §4.3 每次迭代当「carry out + look back」而非新 planning:[how_to_solve_it §b-2 CM.02/CM.27/A_03「每次 local-eval 跑完做四步 looking-back(查结果/查论证/能否换法导出/推广到什么);查论证时先挑最弱点,非线性重查」——把「分数涨没涨」从裸 pass/fail 变结构化诊断]。
- §4.4 瓶颈治理(约束识别 + 激活≠利用):[goal_shapeup §a-1/a-2「约束靠三角测量(队列/缓冲/expediter)非信念找;非瓶颈资源最大化=maximum stupidity」] + [good_strategy §b-5「跨竞赛共享基础设施(模型额度/agent-hours/工具成熟度)先做 chain-link 瓶颈检查,三赛同卡一个约束=改单赛计划零收益」]。
- 可视化钩子:本地分 vs 公榜分双线轨迹 + 证据五级色阶(V-5)。
§5 · 【通用母版】任务拆解与版本迭代(+ §5.1 提交工程为【竞赛特化】)
职责:回答「一个复杂任务怎么拆、每版投多少、什么时候转向」。这是 JS-20「赛题完整拆解 + 版本迭代 + 模块化实现」的正面回应节。
- §5.1【竞赛特化】 迭代节奏与提交工程原文指针 [
METHODOLOGY_INITIAL§②通用-C:Day-1 打通提交 / 多 baseline 并行 / 集成收尾 / 最后一周锁提交工程 / AB 榜策略]。 - §5.2 拆解-重组作迭代间的 auxiliary-problem 生成器:[how_to_solve_it §b-3 CM.15/A_14「approach 停滞时用三个形式重组动作(固定目标 metric 变方法 / 固定方法变问题 / 都变)机械生成下一个 auxiliary problem,不靠灵感」] + [seci_assets §b-5「模块化是 umbrella broad 非 SOP rigid」]。
- 防伪 F-1(内联,续 §3):用 §5.2 三重组动作时须预先写明「什么算作泛化让任务更难」的证伪条件(Inventor's Paradox 的普适 claim 不可证伪),不能只事后引成功案例。
- §5.3 拆合双向判据(拆到底后须在更高层重新绑一致性边界)[
contexts/methodology/se_module_split_merge_history_20260703_manual.md「拆与合同一判据两面(高内聚低耦合),判据是变化/知识非执行顺序」],改写映射到任务语境(判据从「变化的设计决策」→「任务的独立决策点」)。 - §5.4 appetite 固定时间盒(版本投入量决策):[goal_shapeup §c-1「v1→v2→v3 appetite:先给固定时间盒再塞功能,塞不下砍功能非延期;用『是否服务当前赛季真实约束』作砍的判据」]。
- 防伪 F-3(内联):Shape Up 全套(appetite/circuit-breaker/betting-table/hill-chart/scope-hammer)是 public-knowledge,未经 library 蒸馏。引用时必须与 The Goal(gate-passed 高置信)区别对待,标「未核实背景常识」档位;[r006 终裁 · T-4] 只作点缀档位,不为它专门蒸馏(权威来源挂已有件=波次串行 + 止损判据,circuit breaker 只是利落名字)[goal_shapeup §0/§b/§c]。
- §5.5 circuit breaker(版本喊停判据):[goal_shapeup §c-4「周期到点强制停,未完成不自动续期须重新下注;继续打磨的理由若只是沉没成本→触发 circuit breaker」,public-knowledge 见 F-3] + [§a-5 The Goal「POOGI 五步含 return step,约束一变旧规则须重新核对」(gate-passed 高置信)]。
- §5.6 proximate objective(目标随不确定性上升而缩短):[good_strategy §b-4 CM.6「不确定性上升时把远大目标转成近距可行目标,如 AFAC 不是『赢』而是『不破 D5 合规下 A 榜提 N 分』;未启动赛的 proximate objective 是『产一个可提交最小版』非『产获奖版』」]。
- §5.7【竞赛特化】 版本号 SOP 挂接(不新造)[
rules/skills/workflow_version_evolution.md:X/Y 判定「下游是否必须跟着改」+ reason 三段 + 后补流程]。[r006 终裁 · T-4 Scope 三确认] 版本号 SOP 不是空白(已覆盖打不打版本号/X 还是 Y/reason 三段);竞赛真正缺的是「生命周期 gate」(§7 补),与版本号 SOP 互补不重叠(版本号管「对外承诺变化打什么标」,gate 管「竞赛推进的决策闸」)。 - 可视化钩子:版本迭代卡(v1/v2/v3 状态 + appetite 时间盒 + circuit breaker 触发标记)+ hill chart(figuring-out vs executing,public-knowledge,V-6)。
§6 · 【通用母版】并发编排与子 agent 调度
职责:回答「多任务并行怎么排、子 agent 怎么派、信息收集怎么不漏」。
- §6.1 角色分工硬边界 + 不空等调度 [
competitions/_infra/ORCHESTRATOR.md三角色边界 + 卡住切下一个] + [contexts/methodology/orchestrator_prompt_patterns_20260417_manual.md何时用编排(≥5 独立维度 / 需先调研再设计 / 有自然分工)]。 - §6.2 信息收集正交拆分(locate/read)[
contexts/methodology/locate_read_two_phase_info_collection_20260530_manual.mdlocate(召回为唯一硬指标)与 read 两阶段分离]。 - §6.3【外内层调和 = T-3 终裁层】 注意力窗口与 OODA cadence 分属两个问题,两层不冲突:
- [r006 终裁 · T-3] 注意力窗口=外层容器(黄金窗 23:00-01:00 + 09:00-12:00,01:00 硬收工不可被「快通关」突破,生理约束);OODA/约束识别=窗口内调度(当周约束赛优先占黄金窗,非约束赛只用碎片)。
- OODA cadence 本体 [ooda_tempo §b-1 MS_01「per-competition OODA cadence 表:榜分/规则变化/对手行为各定 cadence,任一 stall 进 5 步诊断;『查更勤』不自证正当,只在制造真 mismatch 才增 tempo」] + [§b-6 MS_06「posture-triggered 而非 calendar-triggered」]——排进窗口内,不因「某赛快通关」突破 01:00 边界。
- §6.4 跨赛移动的耦合记分(不按期望分排序)[ooda_tempo §b-7 MS_03「coupling-effects scorecard:比较跨赛移动时算 moral/mental/physical 三维净耦合效应,拒绝 gross 大但净耦合伤己 ≥ 伤敌的移动」——『敌』重释为对用户有限时间/注意力的竞争性索取]。
- 挂接现有工具:[杠杆-3
workflow_parallel_subagents+session_dispatch+多 provider 免费额度;杠杆-5 phase runtime + controller loop 断点恢复](引用 INITIAL §④)。 - 防伪 F-4(内联):OODA 全套是战争/对抗词汇的跨域外推,distillation 把 9/15 公理标 unjustified universality。只对有真实反应对手的部分用(对手随榜动、组织者中途改规则);对『你自己的 deadline 摩擦』是自对抗宽松应用不得当真敌人;纯合规/格式子任务无对手,不进 OODA 透镜;tempo 条款只带「增 tempo」的另一半即『制造真 mismatch 才算』的拒绝判据,不能只带「查更勤」[ooda_tempo §c,AX_07/08/09/11/12/14/21/23/28]。
- 可视化钩子:OODA 节拍表(三行 cadence + stall 状态灯)+ 波次甘特(V-7)。
§7 · 【竞赛特化】竞赛生命周期 Gate(stage-gate,与 phase 控制回路对齐)
职责:回答「一个竞赛从发现到复盘经过哪些决策闸、每闸谁有 Kill 权」。填 stage_gate『INITIAL→REVIEWED→COMMITTED 需中间细分』的缺口。
[r006 终裁 · T-1 合一]:Stage-Gate 与 phase 控制回路逻辑合一、物理分层——Gate 语义经既有 gate_pass:<gate_id>:<arg> 谓词槽挂 phase 边界(谓词槽 + gate 注册白名单已存在,零 schema 改动,同时消解「耦死」顾虑),不新建第二套调度器。
- §7.1 5-gate 生命周期 [stage_gate §b B1]:Gate 0 赛事发现(非正式)→ Gate 1 报名前评估 → Gate 2 = INITIAL 材料成型 → Gate 3 = REVIEWED 中期 → Gate 4 = COMMITTED 提交前 → Gate 5 复盘(非正式);Kill 权集中 Gate 1-3,Gate 4 只检查不否决。
- §7.2 Gate 判据四层分离 [stage_gate §a-2]:Tier1 准备度 checklist(Pass/Fail) → Tier2 must-meet 否决(任一 No 即 Kill) → Tier3 定量门槛(仅信息可靠时) → Tier4 排序评分(跨项目优先级不用于否决) + [§b B2「竞赛中期分数比书中 NPV 更可机械化,可更早启用 Tier3」]。
- §7.3 与 INITIAL 状态机对齐(不建两套)[stage_gate §b B3]:材料状态 INITIAL→REVIEWED→COMMITTED 与 gate 命名绑定(Gate 2 输出=进 REVIEWED,Gate 4 输出=进 COMMITTED);[r006 终裁 · T-1] Recycle=不推进不回滚(保单调性),降级永远通过「不推进」实现非「回退」。
- §7.4 与 phase 控制回路对齐 [stage_gate §d「Stage 内执行/Gate 边界放行 与 phase 内执行/phase 边界停顿 完全同构;
pause_at_boundary就是 Gate 的实现形态之一」] [skillworkflow_phase_skill_trace_runtime+ 三级运行形态]。gatekeeper 训练/政治压力这类人际治理只在某 Gate 判据标「需问人」时才启用。 - 防伪 F-5(内联):AX_34(早期严标准摧毁创新)与 AX_15(无牙 Gate 变直达列车)均 🔴 high_risk,表面矛盾实为互补(早松晚紧)。落地须保留「早松晚紧」非对称结构:不得因「想从头严格」在 Gate 1 要 Gate 3 级证据(如报名前预判胜率),也不得因「早期该宽松」把宽松带到 Gate 4(晚期否决权必须保留)[stage_gate §b B5]。
- 可视化钩子:竞赛生命周期泳道(5 gate 状态 + 每 gate 授权档标签 + 淘汰率漏斗)(V-8)。
§8 · 【通用母版】防自欺与反表演式勤奋
职责:回答「怎么不本地分虚高、不从众、不遇难偷偷简化」。
- §8.1 三正交杠杆 [
contexts/methodology/anti_performative_diligence_methodology_20260530_manual.md定义期关 proxy-goal 缺口 / 判级期独立不可作弊观测 / 约束复杂度非线性拓扑]。 - §8.2 从众防御序 [
contexts/methodology/subagent_conformity_reproduction_and_defense_20260530.md防御序=可验证>多采样>选抗从众模型;不可验证综合最高只到 bounded]。 - §8.3 de minimus 与 create-destroy 作对抗步骤:[rpd_time_pressure §c「de minimus 是专家首要失败模式非新手问题(Vincennes 案)」] + [good_strategy §b-7「create-destroy:硬 deadline 前至少一次主动攻击当前方案最弱假设,用攻击生成下一步;临近 AFAC 硬门要 bound 成出决策非开放再分析」] + [decision_ops_trio §a/b「premortem:假设已失败再解释为何,prospective hindsight 比前瞻更具体」]。
- 挂接现有工具:[杠杆-4 独立 agent 扮评委 forbidden-read 自辩 +
workflow_recursive_agent_review+anti_conformity+ 判定权外移到第二独立 agent(独立 verifier 拦 96.4%)](引用 INITIAL §④)。 - 防伪 F-6(内联,续 §2.5):premortem 源蒸馏 🟡(仅 2 个独立上下文),是「最可移植技术」但不得当 🔴 定论;写进 gate 时标其证据档位。
- 可视化钩子:反模式清单(AP-1..9)状态灯 + 独立评审记分牌(V-9)。
§9 · 【通用母版】资产沉淀(session→册→方法论→skill)
职责:回答「一次任务的隐性经验怎么变成可复用资产,资产怎么长成方法论,方法论怎么变回默认行为」。这是让方法论自身可迭代的机制节。
- §9.1 SECI 四转换映射到资产管线 [seci_assets §a-1/a-2「Socialization/Combination/Articulation/Internalization;Articulation+Internalization 是承重转换(需 personal commitment),只循环左边两字母=SECI 半对失败模式」]。
- §9.2 册的字段 schema 强制 Articulation:[seci_assets §b-1「失败模式字段不是可选元数据,是 Articulation 测试:讲不出误用会怎样=没真外化,还停在『它成功过一次』的 Combination 阶段」] + [§b-2「task close 用 metaphor-first 而非 form-first 提示:先问『像什么/什么感觉』再问『可复用规则』」] + [§b-3「AI 起草候选条目 + 交回用户一行确认/编辑,那个确认步骤才是 personal commitment 被行使处」]。
- §9.3【三存量分工 = T-5 终裁层】 不建第四平行存量:
- [r006 终裁 · T-5 方向 A + 落地形态]:memory=Articulation/Combination 层、methodology docs=umbrella 层、skills=Internalization 层;册的职责是跨这三个已有存量 triage-and-promote,非第四平行存量(否则=CM.04 系统级失败,不真扩展知识库)[seci_assets §d]。
- 落地形态(极薄):新经验先以
status: provisional徽章进 memory frontmatter(+失败模式字段),索引行不加状态 token(保护 MEMORY.md 召回 hook 的信噪比);失败模式字段填齐后去徽章(Articulation 完成);毕业=机械计数触发(≥3 条相关 provisional)+ 判断式晋升(混合式,回应 Goodhart 与分诊瓶颈)。不新增派发跳数、不违反「单一真源」。 - 防伪 F-7(内联):SECI「new knowledge born in chaos」被 do-not-extract 明令禁作字面操作准则——须转成「有界的 productive ambiguity 且配合 synthesis 结构」,不得留无结构 capture 仪式;vision/order 阈值与 redundancy-as-virtue 两条在源蒸馏被 🔴→🟡 降级,作方向性启发不作跨域定律;redundancy 若册暴露给团队消费,「容忍重复」≠「容忍不受控访问」[seci_assets §c,BOOK_OVERVIEW §5 do-not-extract + tier_history 降级]。
- 可视化钩子:资产册三存量流转图(册→memory→methodology→skill,V-10)。
§10 · 【通用母版】断点恢复与 Handoff
职责:回答「跨 session/换天/撞额度墙怎么凭档续跑不丢进度」。
- §10.1 无人干预续跑入口 + 冷启动步骤 [
competitions/PROGRAM_HANDOFF.md冷启动四步 + 无人干预工作队列 + 各竞赛精确状态] + [_infra/RUN_STATE.mdlive 台账]。 - §10.2 Handoff 自包含纪律 + 断点恢复 [记忆
feedback_handoff_self_contained自包含可运行/只说 phase 到哪/需求指过去] + [杠杆-5 每完成一步 append state,断点恢复跨额度墙 15/15]。 - §10.3 委派用 Commander's Intent 七面结构 [rpd_time_pressure §b-6「委派子 agent 默认七面(purpose/objective/plan/rationale/key-decisions/antigoals/constraints)按接收方经验×情境稳定性×目标清晰度三变量校准:经验高只给高层目标;情境流动时故意省 antigoals(可能变成错误绑定);目标欠定时把细节放 key-decision-points」]。
- §10.4【与 D-3 状态不丢失机制对接】 未完成任务的唯一汇聚点=todo 系统;
todo.py export是网站唯一数据出口 [DECISIONS_R006 §D-3]。收尾纪律一行:口头指令未即时执行必须todo add或显式拒绝(写进 ORCHESTRATOR/HANDOFF 纪律节)。诚实边界:v1 对口头指令的捕获率是部分保障(Stop-hook 级机械扫描 transcript 是后续硬化残差)。 - 可视化钩子:竞赛状态快照卡(每赛 = phase/gate + 下一步 + 授权档,V-11,可与 V-8 合并)。
附录 A · 【竞赛特化】待用户裁决的张力清单指针
职责:把与 12 题裁决包相关、竞赛场景高度相关但尚未用户拍板的点,指过去不复制。
- 挂接:[
adhoc_jobs/design_philosophy_distillation_20260716/synthesis/USER_ADJUDICATION_QUESTIONS.mdQ2 审查密度上限 / Q9 域等权 vs 重要性分级 / Q10 断线续跑默认路径 / Q12 守护者能否自己动手] + [competitions/DECISIONS.md§4 D8/D9]。方法论引用其推荐答案时须标「待裁决,暂用推荐答案」,不假装已定论。
附录 B · 可视化钩子汇总(供 D-3 网站页设计与 P4 消费)
JS-20 明确要求「成果网站可视化」。这些是钩子清单,不是网站设计定稿。元判据:优先做「揭示状态/决策」的组件,让完全不懂背景的人也能看懂现在在做什么、做到哪;纯装饰图表不做。
| 编号 | 组件 | 挂哪节 | 数据源 | 交互目的 |
|---|---|---|---|---|
| V-1 | 方法论版本时间线 | §0 | version SOP tag / VERSION_LOG | 一眼看演进到哪版、claim ceiling 多少 |
| V-2 | 价值观-战术映射图(七元原则→五承重墙) | §1 | HARNESS_DESIGN_PHILOSOPHY + INITIAL §② | 让家长/面试官看懂价值观怎么落成动作 |
| V-3 | 决策台 | §2 | DECISIONS.md + decisions.json(dq_six/weakest_link) | 决策卡 + 三档标签 + 最弱环高亮 |
| V-4 | 情报台账 + 评分函数逆向热力 | §3 | research/EXTRACTION_LOG + 评分函数拆解 | 子目标×边际夺分成本,洼地一眼可见 |
| V-5 | 本地分 vs 公榜分双线轨迹 | §4 | eval harness 分数轨迹 + 公榜提交 | 两线背离=过拟合警报;证据五级色阶 |
| V-6 | 版本迭代卡 + hill chart | §5 | 各赛 v1/v2/v3 + appetite | 状态 + 时间盒 + circuit breaker 触发 |
| V-7 | OODA 节拍表 + 波次甘特 | §6 | RUN_STATE + 波次表(INITIAL §⑤) | 三行 cadence + stall 灯 + 波次时间轴 |
| V-8 | 竞赛生命周期泳道 | §7 | 各赛 gate 状态 + 授权档 | 5 gate + 授权档 + 淘汰率漏斗 |
| V-9 | 反模式状态灯 + 独立评审记分牌 | §8 | AP-1..9 检查 + 独立 review | 九反模式各一灯 + 评委逐维打分 |
| V-10 | 资产册三存量流转图 | §9 | memory/methodology/skill triage | 册→memory→methodology→skill 毕业流 |
| V-11 | 竞赛状态快照卡(可与 V-8 合并) | §10 | PROGRAM_HANDOFF + RUN_STATE | 每赛 phase/gate + 下一步 + 授权档 |
附录 C · 防伪约束汇总表(元规则:任一进正文必内联,见各节;此处仅供审计)
| 编号 | 条款 | 风险类型 | 内联位置 | 引用时必带约束 |
|---|---|---|---|---|
| F-1 | Inventor's Paradox + 四阶段模型普适 claim | unfalsifiable qualifier + ill-structured 外推 | §3 / §5.2 | 预写「什么算泛化让任务更难」证伪条件;只 scope 良结构问题 |
| F-2 | DQ「50pp gap」「1000:1」数字 | 厂商自证(do-not-extract) | §2.5 | 不作 gate 校准目标;方向保留数字不保留 |
| F-3 | Shape Up 全套 | public-knowledge 未蒸馏 | §5.4 | 与 The Goal 区别对待;点缀档位不专门蒸馏 |
| F-4 | OODA 战争词汇跨域外推 | unjustified universality(9/15) | §6.4 | 只对真实反应对手用;自 deadline 摩擦非敌人 |
| F-5 | AX_34 vs AX_15 | 均 🔴,表面矛盾 | §7 | 保留「早松晚紧」非对称结构 |
| F-6 | premortem | 源蒸馏 🟡(2 上下文) | §2.5 / §8.3 | 不当 🔴 定论;标证据档位 |
| F-7 | SECI「born in chaos」+ vision/order + redundancy | do-not-extract + 🔴→🟡 降级 | §9.3 | 转「有界 productive ambiguity + synthesis」;作启发不作定律 |
| F-8 | RPD「优于其他策略」blanket claim | Limitation 1 未对比其他策略 | §2.3 | 诚实版「特定优于逐一对比」;<20 次历史是边界非脚注 |
末节 · Residuals 与 Claim Ceiling
Claim ceiling = bounded(取最弱一节,§0.1 判据)。诚实列全未达成/未验证部分:
- 未经完整竞赛周期 dogfood:本方法论从 9 本书条款 + 已有件合成,尚未跑过一个完整「发现→报名→迭代→提交→复盘」周期。晋升进 contexts/methodology/ 的触发条件(frontmatter promotion_trigger)之一正是 dogfood ≥2 个竞赛周期。当前状态=纸面成型,实战校准待波次 1(AFAC)之后据实回填。
- T-5 provisional 徽章机制未实装:§9.3 的 memory frontmatter
status: provisional+ 机械计数(≥3)促进,是终裁的落地形态设计,尚未写进 todo/memory 工具链——是设计不是实现。 - 可视化网站页 = r007 残差:附录 B 的 V-1~V-11 是钩子清单,网站页本身未建;D-2 已明示可视化检查方法论列 r007 残差。V-3 决策台需 decisions.json 有 dq_six 字段(§2.5 设计),该字段亦未落库。
- 暗账检测/口头指令捕获是部分保障(承 §10.4 + D-3 Q4):口头指令的机械捕获(Stop-hook 级 transcript 扫描)是后续硬化残差,v1 只有「收尾纪律一行 + 看板暗账区可见」两薄层,捕获率非满。
- 五赛评分细则未逐一覆盖:INITIAL §① 覆盖度诚实注记仍成立——AFAC 赛题四/魔搭 289/讯飞 NL2Wf/硅碳 254/Kaggle security 各自官方最新评分细则本轮未逐一抓取,赛型适配层的评分结构是从同系列一手方案迁移推导,报名后必须以各赛官方原文覆盖。
- Shape Up 永久停点缀档位(T-4 终裁):§5.4/§5.5 的 appetite/circuit-breaker 是 public-knowledge,不为竞赛方法论专门蒸馏;若未来要 load-bearing 须先跑
workflow_library_distillation。 - 迁移待发(承 D-1):本文件随 program 整体平移 career/ 待发(AFAC A 榜提交决策落地 + 无活跃竞赛 worker 时执行),届时内部绝对路径引用需同步更新。
provenance:career/methodology/METHODOLOGY_COMPLEX_TASK_COMPETITION_v1.md data/methodology_dao.mjs