v0.20.3 align antigravity agent layering

This commit is contained in:
Deep Research System
2026-05-07 13:12:28 +08:00
parent e991b26af9
commit 4ab502df91
9 changed files with 130 additions and 46 deletions
+4 -40
View File
@@ -18,17 +18,6 @@
- Skills 以 `.agents/skills` 为 canonical registryadapter skill 目录由 `uv run python scripts/dr.py skills sync` 同步。
- 默认工作链路为中文主写作;英文只保留在检索关键词、原文摘录、source title、DOI/URL 与来源笔记中。
### 1.2 Antigravity native 例外
Antigravity 可作为 native Deep Research 执行器使用,而不是只做 Python core 外壳。此时:
- Antigravity 使用 `.agents/rules``.agents/skills``.agents/workflows` 执行研究,主要消耗 Antigravity 模型配额。
- Gemini 3 Flash 只做流程管理;Phase 0-1 与 Phase 4 优先用 OpusPhase 2 用 Gemini 3.1 Pro LowPhase 3 用 Gemini 3.1 Pro High。
- Python core 只做脚手架、资料抽取、确定性校验、引用和 PDF/DOCX 渲染;不得默认运行会触发 ZenMux/API 模型调用的 `run``research --execute-packets``research --assemble-chapters`
- 仍必须遵守本文的信源、证据、反方证据、字数和输出卫生规则。
---
## 2. 研究方法论(所有 agent 必须遵循)
### 2.1 麦肯锡核心原则
@@ -46,19 +35,6 @@ Antigravity 可作为 native Deep Research 执行器使用,而不是只做 Pyt
- **反方证据优先**:每个 chapter 的研究必须主动搜索证伪性论点,不能只找支持证据
- **数据可追溯**:所有数字、百分比、日期必须有来源 ID(如 `[src_042]`
### 2.2.1 反幻觉与检索回执
Gemini / Antigravity / Gemini CLI 在研究任务中必须默认按"高幻觉风险模型"处理。所有 agent 必须遵守:
- **没有工具回执,不得声称已搜索**:只有在本轮或当前 phase 明确执行过 `search` CLI、`scripts/search.py`、browser、MCP、curl 或同等检索工具,并保存 query / tool / timestamp / URL / title,才能写"已检索/已确认"。
- **没有来源记录,不得写事实结论**:任何事实、数字、日期、公司管线、监管状态、临床结果、市场规模、专利状态必须能在 `sources.jsonl` 或 phase source ledger 中找到对应 `source_id`
- **不得把模型记忆当证据**:模型内置知识只能生成检索关键词或假设,不能作为正文证据。
- **不得伪造不可访问来源**:若无法打开 PDF、网页、注册页或公告原文,必须标注"未能访问原文,仅作为发现线索",不得提取具体数据。
- **不得用二手摘要冒充原文**:搜索结果 snippet、AI summary、媒体转述只能作为发现入口;核心证据必须回到原文、官方记录、论文、专利或披露文件。
- **必须保留检索轨迹**:每个 phase 至少写入 `phaseX/search_log.md``phaseX/search_log.jsonl`,记录关键词、工具、时间、命中源、筛除原因和下一步。
- **必须显式承认不确定性**:找不到证据时写"未找到足够证据",不得用模糊语气填补。
- **自检问题**:每完成一段含事实的文字,问:"这句话的来源 ID 是什么?原文在哪里?我真的打开/检索过它吗?"
### 2.3 字数配额(硬要求)
| 报告类型 | 最小字数 | 建议章节数 |
@@ -89,7 +65,6 @@ Gemini / Antigravity / Gemini CLI 在研究任务中必须默认按"高幻觉风
- **产出**`phase1/material_brief.md` + `phase1/framework.md` + `phase1/research_brief.md/json`
- **暂停点**:用户确认材料解读、研究方法、任务切分、检索策略和章节框架
- **硬规则**clarification 不只是问范围;必须固化报告用途、基调、成功标准、任务拆分、每个任务轴的 prompt/skills/search route,让低成本 worker 也能独立执行
- **反幻觉产物**:必须生成 `phase1/search_log.md`,并在 `research_brief.json` 中记录所有已确认来源与待验证假设。未检索的判断只能标为 hypothesis。
### Phase 2:深度研究
- **驱动命令**`uv run python scripts/dr.py research <slug> --workers 6`
@@ -97,14 +72,12 @@ Gemini / Antigravity / Gemini CLI 在研究任务中必须默认按"高幻觉风
- **产出**`phase2/task_cards.json` + `packets/*.json` + `sources.jsonl` + `chapter_briefs/*.json` + `compressed_findings/*.json` + `drafts/chXX.md`
- **不暂停**:全自动跑完
- **防碎片化规则**:并发 worker 只写 evidence packet`--build-briefs` 必须先收束为 chapter brief 和 compressed finding;章节正文必须从 compressed finding 写,不得把 packet 按顺序拼贴成报告
- **反幻觉产物**:每个 packet 必须包含 `search_receipts``sources``counter_evidence``unsupported_claims`;没有 `search_receipts` 的 packet 不能进入 chapter brief。
### Phase 3:总编审校
- **驱动命令**`uv run python scripts/dr.py review <slug>``/dr-review` 只是薄封装)
- **主导入口**Python core deterministic reviewdr-chief-editor/Gemini 可作为后续深度审校增强
- **产出**`projects/<slug>/phase3/critique.md`
- **暂停点**:用户决策(修正 / 回炉 phase2 / 整体重来)
- **反幻觉产物**`critique.md` 必须抽查至少 10 条核心事实,逐条给出 source_id、原文状态和是否需要回炉。
### Phase 4:成稿
- **驱动命令**`uv run python scripts/dr.py finalize <slug>`
@@ -112,7 +85,6 @@ Gemini / Antigravity / Gemini CLI 在研究任务中必须默认按"高幻觉风
- **默认链路**final_zh.md → glossary/check(optional) → polish(optional) → citation_check → build_report
- **兼容链路**:仅显式 `--legacy-translate` 时使用 final_en.md → translate → polish
- **产出**`phase4/final_zh.md` + `phase4/final_zh_polished.md`(可选)+ `phase4/*.pdf` + `phase4/*.docx`
- **反幻觉产物**:终稿不得引入 Phase 2/3 中不存在的新事实;如需新增事实,必须先追加 sources 与 search_log,再写入正文。
---
@@ -209,18 +181,18 @@ uv run python scripts/dr.py methods list
| Codex | `AGENTS.md` + `$CODEX_HOME` adapter(由 `scripts/deploy_adapters.py codex` 部署) | `uv run python scripts/dr.py ...``codex exec "$(uv run python scripts/dr.py prompt dr-run '<topic>')"` |
| Claude Code | `.claude/skills/*/SKILL.md` | `/dr-run <slug-or-topic>` |
| Gemini CLI | `GEMINI.md` + `.gemini/commands/dr/*.toml` | `/dr:run <slug-or-topic>` |
| Antigravity | `.agents/rules` + `.agents/skills` + `.agents/workflows` | Gemini Flash 管流程,按 phase 切 Opus/GeminiPython core 只做辅助 |
| Antigravity | `.agents/agents.md` + `.agents/rules` + `.agents/skills` + `.agents/workflows` | 角色定义在 agents,强约束在 rules,技能在 skills,流程在 workflows |
跨平台硬规则:
- 除 Antigravity native 模式外,平台只做 surface adapter,不承载核心调度。
- Antigravity 的角色定义放在 `.agents/agents.md`;不要把角色、技能和流程继续堆进本文件。
- 不在平台 prompt 中手工并发写章节。
- 不把平台 subagent 当默认并发机制。
- 真实并发由 `scripts/runtime/workers.py` 的 worker pool 执行。
- 真实模型选择由 `configs/models.yaml``scripts/runtime/roles.py` 执行。
- 信息检索默认走 `scripts/search.py` / `SearchClient` / `search-gateway` skill;不得把 Tavily MCP、browser MCP 或平台 web search 作为默认路径,除非用户明确授权。
- 搜索路由必须按任务类型选择:`evidence`=Exa highlights 受控证据发现,`fda/scholar/patents/news`=专用信源路径,`general`=宽泛发现和兜底;Tavily Research 只能作为阶段性 scan/enrichment/rework 输入,不能直接替代 evidence packet 或章节正文。
- Antigravity native 可使用 `paperfoot/search-cli``search` 命令作为统一检索前台;但所有结果仍必须写入 search_log、sources.jsonl,并按 Tier/source-quality 评分。
---
@@ -237,7 +209,6 @@ uv run python scripts/dr.py methods list
- API 密钥**只存** `secrets.env`(已入 gitignore),禁止硬编码到任何 agent/skill/command
- 字体文件(~140MB)不入 git,通过 `download-fonts.sh` 获取
- `bash` 权限默认 `ask`,仅允许 `python *` / `pandoc *` / `ls *` / `cat *` / `curl *` 自动执行
- Antigravity 项目范围内可给予较高权限,但只应写当前 workspace;跨 workspace、全局设置、删除文件、git reset/clean、密钥读取和外部网络批量下载仍需用户明确批准。
---
@@ -253,14 +224,7 @@ uv run python scripts/dr.py methods list
6. `--assemble-chapters` 后存在 `phase2/drafts/chXX.md` 和必要时的 `phase2/chapter_errors/*.json`
7. `scripts/v020_regression.py` 输出 `v0.20 regression PASS`
Antigravity native 模式的验锚点是研究产物与检索回执:
1. `.agents/rules/deep-research-antigravity.md` 被启用或明确 at mention。
2. Phase 0-1 存在 `phase1/search_log.md``phase1/research_brief.md/json``phase1/unsupported_claims.md`
3. Phase 2 存在 `phase2/search_log.jsonl``phase2/packets/*.json``phase2/sources.jsonl``phase2/chapter_briefs/*.json``phase2/drafts/chXX.md`
4. 每个 packet 包含 `search_receipts``sources``counter_evidence``unsupported_claims`
5. Phase 3 `critique.md` 包含至少 10 条核心事实 source audit。
6. Phase 4 存在 `final_fact_check.md`,且终稿未引入无来源新事实。
Antigravity native 模式的验锚点`.agents/workflows/deep-research-native.md` 定义。
---
@@ -272,7 +236,7 @@ Antigravity native 模式的验证锚点是研究产物与检索回执:
2. ❌ 在缺乏 2 个独立信源时仍给出绝对化结论
3. ❌ 使用"据报道""有专家认为"等未指明来源的表述
4. ❌ 编造或虚构数据、URL、DOI
5. ❌ 声称"已搜索/已验证/官网显示"但没有工具回执和 search_log
5. ❌ 声称"已搜索/已验证/官网显示"但没有工具回执和检索记录
6. ❌ 用搜索摘要、AI summary、snippet 冒充原文证据
7. ❌ 写空洞的套话("随着科技的发展""在大数据时代"
8. ❌ 忽略反方观点,只收集支持证据