v0.20.3 align antigravity agent layering
This commit is contained in:
@@ -18,17 +18,6 @@
|
||||
- Skills 以 `.agents/skills` 为 canonical registry;adapter skill 目录由 `uv run python scripts/dr.py skills sync` 同步。
|
||||
- 默认工作链路为中文主写作;英文只保留在检索关键词、原文摘录、source title、DOI/URL 与来源笔记中。
|
||||
|
||||
### 1.2 Antigravity native 例外
|
||||
|
||||
Antigravity 可作为 native Deep Research 执行器使用,而不是只做 Python core 外壳。此时:
|
||||
|
||||
- Antigravity 使用 `.agents/rules`、`.agents/skills`、`.agents/workflows` 执行研究,主要消耗 Antigravity 模型配额。
|
||||
- Gemini 3 Flash 只做流程管理;Phase 0-1 与 Phase 4 优先用 Opus;Phase 2 用 Gemini 3.1 Pro Low;Phase 3 用 Gemini 3.1 Pro High。
|
||||
- Python core 只做脚手架、资料抽取、确定性校验、引用和 PDF/DOCX 渲染;不得默认运行会触发 ZenMux/API 模型调用的 `run`、`research --execute-packets`、`research --assemble-chapters`。
|
||||
- 仍必须遵守本文的信源、证据、反方证据、字数和输出卫生规则。
|
||||
|
||||
---
|
||||
|
||||
## 2. 研究方法论(所有 agent 必须遵循)
|
||||
|
||||
### 2.1 麦肯锡核心原则
|
||||
@@ -46,19 +35,6 @@ Antigravity 可作为 native Deep Research 执行器使用,而不是只做 Pyt
|
||||
- **反方证据优先**:每个 chapter 的研究必须主动搜索证伪性论点,不能只找支持证据
|
||||
- **数据可追溯**:所有数字、百分比、日期必须有来源 ID(如 `[src_042]`)
|
||||
|
||||
### 2.2.1 反幻觉与检索回执
|
||||
|
||||
Gemini / Antigravity / Gemini CLI 在研究任务中必须默认按"高幻觉风险模型"处理。所有 agent 必须遵守:
|
||||
|
||||
- **没有工具回执,不得声称已搜索**:只有在本轮或当前 phase 明确执行过 `search` CLI、`scripts/search.py`、browser、MCP、curl 或同等检索工具,并保存 query / tool / timestamp / URL / title,才能写"已检索/已确认"。
|
||||
- **没有来源记录,不得写事实结论**:任何事实、数字、日期、公司管线、监管状态、临床结果、市场规模、专利状态必须能在 `sources.jsonl` 或 phase source ledger 中找到对应 `source_id`。
|
||||
- **不得把模型记忆当证据**:模型内置知识只能生成检索关键词或假设,不能作为正文证据。
|
||||
- **不得伪造不可访问来源**:若无法打开 PDF、网页、注册页或公告原文,必须标注"未能访问原文,仅作为发现线索",不得提取具体数据。
|
||||
- **不得用二手摘要冒充原文**:搜索结果 snippet、AI summary、媒体转述只能作为发现入口;核心证据必须回到原文、官方记录、论文、专利或披露文件。
|
||||
- **必须保留检索轨迹**:每个 phase 至少写入 `phaseX/search_log.md` 或 `phaseX/search_log.jsonl`,记录关键词、工具、时间、命中源、筛除原因和下一步。
|
||||
- **必须显式承认不确定性**:找不到证据时写"未找到足够证据",不得用模糊语气填补。
|
||||
- **自检问题**:每完成一段含事实的文字,问:"这句话的来源 ID 是什么?原文在哪里?我真的打开/检索过它吗?"
|
||||
|
||||
### 2.3 字数配额(硬要求)
|
||||
|
||||
| 报告类型 | 最小字数 | 建议章节数 |
|
||||
@@ -89,7 +65,6 @@ Gemini / Antigravity / Gemini CLI 在研究任务中必须默认按"高幻觉风
|
||||
- **产出**:`phase1/material_brief.md` + `phase1/framework.md` + `phase1/research_brief.md/json`
|
||||
- **暂停点**:用户确认材料解读、研究方法、任务切分、检索策略和章节框架
|
||||
- **硬规则**:clarification 不只是问范围;必须固化报告用途、基调、成功标准、任务拆分、每个任务轴的 prompt/skills/search route,让低成本 worker 也能独立执行
|
||||
- **反幻觉产物**:必须生成 `phase1/search_log.md`,并在 `research_brief.json` 中记录所有已确认来源与待验证假设。未检索的判断只能标为 hypothesis。
|
||||
|
||||
### Phase 2:深度研究
|
||||
- **驱动命令**:`uv run python scripts/dr.py research <slug> --workers 6`
|
||||
@@ -97,14 +72,12 @@ Gemini / Antigravity / Gemini CLI 在研究任务中必须默认按"高幻觉风
|
||||
- **产出**:`phase2/task_cards.json` + `packets/*.json` + `sources.jsonl` + `chapter_briefs/*.json` + `compressed_findings/*.json` + `drafts/chXX.md`
|
||||
- **不暂停**:全自动跑完
|
||||
- **防碎片化规则**:并发 worker 只写 evidence packet;`--build-briefs` 必须先收束为 chapter brief 和 compressed finding;章节正文必须从 compressed finding 写,不得把 packet 按顺序拼贴成报告
|
||||
- **反幻觉产物**:每个 packet 必须包含 `search_receipts`、`sources`、`counter_evidence`、`unsupported_claims`;没有 `search_receipts` 的 packet 不能进入 chapter brief。
|
||||
|
||||
### Phase 3:总编审校
|
||||
- **驱动命令**:`uv run python scripts/dr.py review <slug>`(`/dr-review` 只是薄封装)
|
||||
- **主导入口**:Python core deterministic review;dr-chief-editor/Gemini 可作为后续深度审校增强
|
||||
- **产出**:`projects/<slug>/phase3/critique.md`
|
||||
- **暂停点**:用户决策(修正 / 回炉 phase2 / 整体重来)
|
||||
- **反幻觉产物**:`critique.md` 必须抽查至少 10 条核心事实,逐条给出 source_id、原文状态和是否需要回炉。
|
||||
|
||||
### Phase 4:成稿
|
||||
- **驱动命令**:`uv run python scripts/dr.py finalize <slug>`
|
||||
@@ -112,7 +85,6 @@ Gemini / Antigravity / Gemini CLI 在研究任务中必须默认按"高幻觉风
|
||||
- **默认链路**:final_zh.md → glossary/check(optional) → polish(optional) → citation_check → build_report
|
||||
- **兼容链路**:仅显式 `--legacy-translate` 时使用 final_en.md → translate → polish
|
||||
- **产出**:`phase4/final_zh.md` + `phase4/final_zh_polished.md`(可选)+ `phase4/*.pdf` + `phase4/*.docx`
|
||||
- **反幻觉产物**:终稿不得引入 Phase 2/3 中不存在的新事实;如需新增事实,必须先追加 sources 与 search_log,再写入正文。
|
||||
|
||||
---
|
||||
|
||||
@@ -209,18 +181,18 @@ uv run python scripts/dr.py methods list
|
||||
| Codex | `AGENTS.md` + `$CODEX_HOME` adapter(由 `scripts/deploy_adapters.py codex` 部署) | `uv run python scripts/dr.py ...` 或 `codex exec "$(uv run python scripts/dr.py prompt dr-run '<topic>')"` |
|
||||
| Claude Code | `.claude/skills/*/SKILL.md` | `/dr-run <slug-or-topic>` |
|
||||
| Gemini CLI | `GEMINI.md` + `.gemini/commands/dr/*.toml` | `/dr:run <slug-or-topic>` |
|
||||
| Antigravity | `.agents/rules` + `.agents/skills` + `.agents/workflows` | Gemini Flash 管流程,按 phase 切 Opus/Gemini,Python core 只做辅助 |
|
||||
| Antigravity | `.agents/agents.md` + `.agents/rules` + `.agents/skills` + `.agents/workflows` | 角色定义在 agents,强约束在 rules,技能在 skills,流程在 workflows |
|
||||
|
||||
跨平台硬规则:
|
||||
|
||||
- 除 Antigravity native 模式外,平台只做 surface adapter,不承载核心调度。
|
||||
- Antigravity 的角色定义放在 `.agents/agents.md`;不要把角色、技能和流程继续堆进本文件。
|
||||
- 不在平台 prompt 中手工并发写章节。
|
||||
- 不把平台 subagent 当默认并发机制。
|
||||
- 真实并发由 `scripts/runtime/workers.py` 的 worker pool 执行。
|
||||
- 真实模型选择由 `configs/models.yaml` 和 `scripts/runtime/roles.py` 执行。
|
||||
- 信息检索默认走 `scripts/search.py` / `SearchClient` / `search-gateway` skill;不得把 Tavily MCP、browser MCP 或平台 web search 作为默认路径,除非用户明确授权。
|
||||
- 搜索路由必须按任务类型选择:`evidence`=Exa highlights 受控证据发现,`fda/scholar/patents/news`=专用信源路径,`general`=宽泛发现和兜底;Tavily Research 只能作为阶段性 scan/enrichment/rework 输入,不能直接替代 evidence packet 或章节正文。
|
||||
- Antigravity native 可使用 `paperfoot/search-cli` 的 `search` 命令作为统一检索前台;但所有结果仍必须写入 search_log、sources.jsonl,并按 Tier/source-quality 评分。
|
||||
|
||||
---
|
||||
|
||||
@@ -237,7 +209,6 @@ uv run python scripts/dr.py methods list
|
||||
- API 密钥**只存** `secrets.env`(已入 gitignore),禁止硬编码到任何 agent/skill/command
|
||||
- 字体文件(~140MB)不入 git,通过 `download-fonts.sh` 获取
|
||||
- `bash` 权限默认 `ask`,仅允许 `python *` / `pandoc *` / `ls *` / `cat *` / `curl *` 自动执行
|
||||
- Antigravity 项目范围内可给予较高权限,但只应写当前 workspace;跨 workspace、全局设置、删除文件、git reset/clean、密钥读取和外部网络批量下载仍需用户明确批准。
|
||||
|
||||
---
|
||||
|
||||
@@ -253,14 +224,7 @@ uv run python scripts/dr.py methods list
|
||||
6. `--assemble-chapters` 后存在 `phase2/drafts/chXX.md` 和必要时的 `phase2/chapter_errors/*.json`。
|
||||
7. `scripts/v020_regression.py` 输出 `v0.20 regression PASS`。
|
||||
|
||||
Antigravity native 模式的验证锚点是研究产物与检索回执:
|
||||
|
||||
1. `.agents/rules/deep-research-antigravity.md` 被启用或明确 at mention。
|
||||
2. Phase 0-1 存在 `phase1/search_log.md`、`phase1/research_brief.md/json`、`phase1/unsupported_claims.md`。
|
||||
3. Phase 2 存在 `phase2/search_log.jsonl`、`phase2/packets/*.json`、`phase2/sources.jsonl`、`phase2/chapter_briefs/*.json`、`phase2/drafts/chXX.md`。
|
||||
4. 每个 packet 包含 `search_receipts`、`sources`、`counter_evidence`、`unsupported_claims`。
|
||||
5. Phase 3 `critique.md` 包含至少 10 条核心事实 source audit。
|
||||
6. Phase 4 存在 `final_fact_check.md`,且终稿未引入无来源新事实。
|
||||
Antigravity native 模式的验收锚点由 `.agents/workflows/deep-research-native.md` 定义。
|
||||
|
||||
---
|
||||
|
||||
@@ -272,7 +236,7 @@ Antigravity native 模式的验证锚点是研究产物与检索回执:
|
||||
2. ❌ 在缺乏 2 个独立信源时仍给出绝对化结论
|
||||
3. ❌ 使用"据报道""有专家认为"等未指明来源的表述
|
||||
4. ❌ 编造或虚构数据、URL、DOI
|
||||
5. ❌ 声称"已搜索/已验证/官网显示"但没有工具回执和 search_log
|
||||
5. ❌ 声称"已搜索/已验证/官网显示"但没有工具回执和检索记录
|
||||
6. ❌ 用搜索摘要、AI summary、snippet 冒充原文证据
|
||||
7. ❌ 写空洞的套话("随着科技的发展""在大数据时代")
|
||||
8. ❌ 忽略反方观点,只收集支持证据
|
||||
|
||||
Reference in New Issue
Block a user