.claude/skills/。1. 沿用上一届:虚拟大学活动中心上一届办的是 MetaArena「创业/创意大赛」,用仓库真实 521 份顶尖 AI 人才档案组建了 12 支命名战队。本届原样保留其中 10 支(TEAM-01~10,纯真实人才)。
2. 新增 5 支「真实 × 虚拟」混编队(TEAM-11~15):每队 = 2–3 名真实人才档案(Yann LeCun / Aravind Srinivas / Jensen Huang / Scott Wu / Sarah Guo 等,作模拟参赛化身)+ 2–3 名 A129 虚拟公司在册 agent(Isaac·首席提问官 / Verity·独立证据审计官 / Magnus·总调度官 / Aria·AI与方法研究部 等)。真实档案供前沿直觉,虚拟 agent 供 A129 沉淀的反表演纪律。
3. 共 15 队,每队产出 1 个 skill 提案(共 15 个,各不重复,均为"放大 Claude 底层能力"而非某业务)。
4. 独立盲评:真起 2 名互不通气的独立 AI 评审 agent(全新上下文),对隐去队名的 15 份提案各自 5 维打分。执行≠评审(反自评表演)。
5. Top 5 真造:按评审汇总排名取前 5,写成可用 skill 文件。
| 队 | 队名 | 类型 | 提案 skill |
|---|---|---|---|
| T01 | Frontier Forge | 旧·真实 | 需求镜像 intent-mirror ⭐🥇 |
| T02 | Signal Forge | 旧·真实 | 工具调用规划器 tool-plan-optimizer |
| T03 | Alpha Harbor | 旧·真实 | 决策日志 decision-journal |
| T04 | Blackbox Breakers | 旧·真实 | 立场互换红队 steelman-swap ⭐ |
| T05 | Product Alchemists | 旧·真实 | 数字体检 number-sanity |
| T06 | Agent Foundry | 旧·真实 | 事前验尸 failure-premortem |
| T07 | Growth Comets(Musk顾问) | 旧·真实 | 约束松弛器 constraint-relaxer |
| T08 | Deep Research Syndicate | 旧·真实 | 跨域类比桥 analogy-bridge |
| T09 | Velvet UX Lab | 旧·真实 | 抽象阶梯 abstraction-ladder |
| T10 | Titan Ops | 旧·真实 | 来源接地守卫 source-grounding-guard ⭐ |
| T11 | 认知免疫队 | 新·混编 | 隐藏假设审计 assumption-audit ⭐🥉 |
| T12 | 校准工坊 | 新·混编 | 置信度账本 confidence-ledger |
| T13 | 迁移桥队 | 新·混编 | 三方对抗小组 devils-panel |
| T14 | 自洽哨兵 | 新·混编 | 交付前自洽扫描 self-consistency-sweep |
| T15 | 火力调度队 | 新·混编 | 火力档位路由 effort-router ⭐🥇 |
(⭐=冠军组已真造;完整花名册见 runs/.../teams.md,15 份提案详情见 runs/.../proposals.md)
| 排名 | skill | 汇总分/200 | 队 |
|---|---|---|---|
| 🥇1 并列 | intent-mirror 需求镜像 | 173 | T01(旧) |
| 🥇1 并列 | effort-router 火力档位路由 | 173 | T15 火力调度队(新混编) |
| 🥉3 | assumption-audit 隐藏假设审计 | 170 | T11 认知免疫队(新混编) |
| 4 | steelman-swap 立场互换红队 | 168 | T04(旧) |
| 5 | source-grounding-guard 来源接地守卫 | 167 | T10(旧) |
| skill | 放大 Claude 的哪项特殊能力 | 一句话机制 | 文件 |
|---|---|---|---|
| assumption-audit 隐藏假设审计 | 元认知/反自欺 | 交付承重结论前翻出它脚下的隐藏假设,标{已知/推断/猜测},揪出"一旦为假就翻盘"的承重猜测去验证 | .claude/skills/assumption-audit/SKILL.md |
| steelman-swap 立场互换红队 | 自我批判/反谄媚 | 得结论后强制为相反结论写最强论证(同证据标准)再调和:推翻/加限定/确认 | .claude/skills/steelman-swap/SKILL.md |
| intent-mirror 需求镜像 | 指令跟随/意图对齐 | 动手前把请求编译成规格+暴露我替你拍板的歧义,让你 3 秒纠偏,防做错东西白干 | .claude/skills/intent-mirror/SKILL.md |
| effort-router 火力档位路由 | 资源自适应 | 开头判难度×可逆×影响,路由到 L0直答/L1轻核/L2完整/L3火力全开,说明理由可改档 | .claude/skills/effort-router/SKILL.md |
| source-grounding-guard 来源接地守卫 | 抗幻觉 | 交付前逐句给承重事实贴{工具核实/仅凭记忆/未获取},记忆的降级、未知不编 | .claude/skills/source-grounding-guard/SKILL.md |
这 5 个共同点:全是可移植、通用、放大模型底层能力的元技能(反自欺 / 反谄媚 / 意图对齐 / 力气自适应 / 抗幻觉),不绑任何业务,任何 Claude 会话都能自动触发。它们正好互补,覆盖了 Claude 最贵的 5 类失误:结论坐在猜测上、附和用户、做错东西、力气配错、把记忆当核实。
reports/MetaArena/runs/claude-能力增强-创新skills大赛-15队/teams.md.../proposals.md.../judge-pack.md.claude/skills/{assumption-audit,steelman-swap,intent-mirror,effort-router,source-grounding-guard}/SKILL.mdreports/2026-07-13_第二届虚拟大学活动中心-Claude能力增强创新Skills大赛-15队.md