2026 AI 先锋未来人才大赛 · 命题方 安克创新(Anker) · 演示品类 = eufy 智能家居/安防
本仓库只包含评委可复现运行的代码与必要文档(v1.2 六阶段后端 + 方法论 + 真实语料)。
- 命题:为安克设计并演示一套"AI 原生"的产品设计与定义工作流。
- 我们的答案叫 ANCHOR(Anker 德语本义"锚")。案例夹具 = eufy Video Doorbell E340,美国市场。
- 对外定位 = PM 协作工作台:只做信息收集与初筛,把散落的用户信号筛成带证据、带反证、带分歧的机会清单——最终决策完全归人。
- 旗帜句:「品类可以不存在,job 一定存在。」 拍板、实地调研、用户深读三件事永远在人手里。
- 为什么这个切口成立:安克已有规模化 VOC / AI 读评论能力(table stakes),真正的公开空白在信号到决策之间——带治理结构的机会定义、概念裁决、判断记分。ANCHOR 钉的就是这一段。
范围与准入 → 证据与洞察 → 真假需求 → 市场与竞争机会 → 概念与现实校验 → 定义与决策交付
底层为 S0–S12 执行节点 / I1–I5 洞察流 / G0–G3 人工 Gate,本 README 不展开,详情见 ANCHOR-v1.2-dev-handoff/ 规格包。
环境要求:Python ≥ 3.11(开发环境 3.13.9)。
# 1. 安装依赖
cd anchor_backend
pip install -r requirements.txt
# 2. 跑六阶段流水线(默认路径,不需要任何 API key)
python demo.py runrun 会依次完成:六阶段流水线 → 落到 anchor_backend/anchor.db(SQLite 权威存储)→ 生成开奖报告 + 断网快照 + 投影载荷。跑完后你会在终端看到六阶段状态、三链结果、定义图节点/边数等,并在仓库根看到产物目录 05-过程档案/(报告 + 快照)。
实测端到端样例:32 事件 / 5 类事件 / 阶段终态
{1:complete, 2:complete, 3:hold, 4:complete, 5:complete, 6:hold}/ 投影载荷行数 6/7/29 / 快照校验 PASS(17 项 check)。 其中 S3 / S6 的hold是治理设计的正常终态(闸门待人裁决),不是 bug。
python demo.py check # 体检:Python 版本 / 依赖 / fixture yaml / 语料 CSV / 跑非 slow 单测
python demo.py replay <dir> # 校验并打印已生成的断网快照(断网演示路径)
python demo.py clean # 删除本次产物文件(anchor.db / 报告 / 快照)cd anchor_backend
python -m pytest tests -q # 全量基线(实测 208 passed / 3 deselected / 0 failed)
demo.py check内置一条 ≤180s 的子进程超时跑非 slow 单测;如需全量请直接用上面的命令。
python demo.py run --live 走 M3-M5 真做路径(用真实 LLM API key,读环境变量 DEEPSEEK_API_KEY / KIMI_API_KEY / GLM_API_KEY);--mock 走同一路径但用 MockProvider,不需 key。默认(不带任何开关)的 run 仅用字面量夹具,零外部依赖即可复现。
- 证据分级:E3 = AI 凭空生成(假设级)/ E2 = AI+私有真实语料(线索级)/ E1 = 真实世界信号(证据级)。文档每条关键论断后缀
[E1]/[E2]/[E3],E3 不得直接支撑放行决策。 - 写者≠检查者:生成方案的 AI 不评审自己的方案;判官输出只触发有界返工(≤3 轮),放行 = 人的三条件合取。
- 多样性工程:任何多角色/多方案环节须有真实多样性来源(异构模型 / 真实语料切片 / 对抗立场),防"一个大脑的腹语术"。
- 语料只存原文、不摘要,AI 不得生成语料顶替;
- 被淘汰的概念和分歧档案不删除,是过程档案的核心展品;
- 判据与阈值预注册:进化开始前冻结,改动 = 新版本 + 台账留痕。
本演示不声称 structure_verified / golden_fixture_verified / 任何 E340 真实产品结论;只声称六阶段结构行为已实现且可追溯。
rights = Unknown→evidence_eligible = False:本次夹具是 eufy 公开社区语料,数据权利状态未授权,不构成对真实产品的结论;owner = demo_human_owner是显式 stand-in(替身),非真实人签署;degraded标注与阶段状态同屏,做不到了如实标,不假装做到了;- 技术栈(Python + SQLite + 飞书投影)由产品负责人指定,非"经技术选型验证后选定"。
anchor-workflow/
├─ README.md ← 你在这里
├─ .gitignore
│
├─ anchor_backend/ ← ★ v1.2 后端实现(可运行)
│ ├─ demo.py 演示入口:run / check / replay / clean
│ ├─ requirements.txt
│ ├─ pytest.ini / conftest.py
│ ├─ anchor/ 聚合 / 事件存储 / 六阶段流水线 / 飞书投影与视图层 / LLM gateway
│ ├─ tests/ 23 个测试文件,208 测全过
│ ├─ x4_acceptance.py 渲染纪律机器可核验收(11/11)
│ ├─ ping_llm.py LLM 端点连通自检
│ └─ contracts/ 投影契约 schema(飞书三表列级契约源)
│
├─ ANCHOR-v1.2-dev-handoff/ ← ★ 规格包(14 份,规格唯一来源)
│ ├─ README.md 规格包入口
│ ├─ 00..13-*.md 产品/工作流架构/数据契约/UI/demo/验收/技术选型门/开放项/来源追溯
│ ├─ fixtures/ e340-fixture.yaml(演示用案例夹具)+ voc-import-template.csv
│ ├─ diagrams/ Mermaid 流程图
│ └─ manifests/
│
├─ 01-方法论/ ← ANCHOR 方法论本体(思想来源)
│ ├─ 安克命题分析与方法论设计.md 主设计文档(认知论地基 + 对比论证)
│ ├─ 判据法典-公理分册v1.md 15 条产品公理 + Eval 映射
│ ├─ ANCHOR-执行手册.md 角色契约 / 模板 / 降级表
│ └─ 补充材料/ 研究笔记 A(合成用户科学证据)/ B(认知论对比)/ C(阳萌方法论一手材料)
│
└─ 语料采集/
├─ ANCHOR-语料库.csv 317 条真实 VOC 原文(不摘要,全量字段)— demo.py run 的输入
└─ 语料库-阅读指南.md 语料按主题组织、代表性引文、使用纪律
| 记号 | 含义 |
|---|---|
| E1 / E2 / E3 | 证据分级。E1 = 真实世界信号(证据级)/E2 = AI + 私有真实语料(线索级)/E3 = AI 凭空生成(假设级) |
| GF-01 / 02 / 03 | v1.2 三条 Golden Fixture 链:GF-01 成功链 / GF-02 方案诉求阻断 / GF-03 证据不足 |
| LIVE / CACHED / REPLAY / SIMULATED | 四种运行模式,UI 三重区分(色彩+文本+图标);SIMULATED 永久 evidence_eligible = false |
| 闸① / 闸② / G0–G3 | 人裁决关口:G0 准入 / G1 真假需求 / G2A 机会选择 / G2B 概念锚定 / G3 最终决策 |
| 判官 / 盲评 | 独立评审 AI 只输出质疑不给总分;看不到"谁生成的"(结构约束) |
| owner = demo_human_owner | 显式 stand-in(替身),非真实人签署 |
| degraded / Unknown / not_verified | 降级标注 / 未定值 / 未验证。做不到就如实标,不假装做到了 |
| Brier | 判断记分方法:把判断写成带概率的可验证预测,到期算分 |
本提交为评委可复现运行的最小子集,仅含运行所需的代码、案例夹具、真实语料与方法论。其余内部过程档案(路演彩排、执行记录、被淘汰概念、分歧台账等)作为赛事"过程档案"交付物另行提交,不在本仓库范围内。
想理解方法论为什么这么设计 → 01-方法论/安克命题分析与方法论设计.md。
想接手 v1.2 开发 → ANCHOR-v1.2-dev-handoff/README.md(约 60 分钟通读)。
想感受现状 → cd anchor_backend && python demo.py run。看得见的现状比任何文档都可靠。