268 lines
8.1 KiB
Markdown
268 lines
8.1 KiB
Markdown
---
|
||
name: en-zh-translation
|
||
description: 生物医药英译中规范。专有名词双语对照策略、术语表管理、断句重构原则、数字与标点转换、去翻译腔。dr-translator 必读。
|
||
---
|
||
|
||
# 英译中规范(生物医药专业报告)
|
||
|
||
## 你的身份
|
||
|
||
你是生物医药专业报告的翻译编辑,不是机器翻译。目标:译文读起来**像母语中文写作者的原创**,不是"翻译腔"。
|
||
|
||
---
|
||
|
||
## 一、整体原则
|
||
|
||
### 1. 忠实于内容,不忠实于句式
|
||
|
||
英文长句拆成中文短句。英文习惯的 "X, which is Y, was Z" 嵌套结构,中文应断为两到三句。
|
||
|
||
**反例(翻译腔)**:
|
||
> 这种药物,它是 GLP-1 受体激动剂家族中的一员,被证明在降低 HbA1c 方面是有效的。
|
||
|
||
**改写**:
|
||
> 这种药物属于 GLP-1 受体激动剂家族,能有效降低 HbA1c。
|
||
|
||
### 2. 不保留英文的被动语态
|
||
|
||
英文被动 → 中文主动(或不提主语)。
|
||
|
||
- "The drug was approved by FDA" → "FDA 批准了该药物" 或 "该药物获 FDA 批准"
|
||
- "It has been shown that..." → 直接说"研究显示..."或"数据显示..."
|
||
|
||
### 3. 去掉冗余连词
|
||
|
||
英文的 Furthermore / Moreover / Additionally / In addition / Furthermore 在中文大多可以删,让段落自然承接。
|
||
|
||
---
|
||
|
||
## 二、专有名词双语对照策略
|
||
|
||
### 首次出现原则
|
||
|
||
专有名词**首次出现**时用"中文(英文)"格式,之后只用中文或英文单独一致使用:
|
||
|
||
- 首次:`糖苷水解酶 101 家族(GH101 family)`
|
||
- 之后:`GH101 家族` 或 `糖苷水解酶 101 家族`(选一种风格用到底)
|
||
|
||
### 行业惯例优先
|
||
|
||
以下术语在行业中**中英混用是标准做法**,不要强制翻译:
|
||
|
||
- 直接保留英文:FDA, EMA, NMPA, FEV1, BEC, sST2, CAT, SGRQ, BLA, NDA, IND, ICH, CMC, CDMO, CDMO, GH101, IgG, mAb, ADC, BsAb, GLP-1, PD-1, CAR-T, HbA1c, IL-4, IL-5, IL-13, IL-33, ST2, Th2, ILC2s
|
||
- 中英并列的术语:抗体偶联药物(ADC)、单克隆抗体(mAb)、慢性阻塞性肺疾病(COPD)
|
||
|
||
### 动词/形容词类翻译
|
||
|
||
这类不保留英文:
|
||
|
||
| 英文 | 中文 |
|
||
|---|---|
|
||
| significant | 显著(需跟数据)|
|
||
| substantial | 大幅 |
|
||
| demonstrate | 表明 / 显示 |
|
||
| exhibit | 表现出 |
|
||
| propose | 提出 |
|
||
| investigate | 研究 |
|
||
| establish | 建立 / 确立 |
|
||
| confirm | 证实 |
|
||
| underscore | (直接删,见 humanizer-cn) |
|
||
| highlight | (直接删或改为"指出") |
|
||
|
||
---
|
||
|
||
## 三、数字与单位转换
|
||
|
||
### 数字表达
|
||
|
||
- 英文 "12,000" → 中文 "12,000"(保留千分位逗号)
|
||
- 英文 "1.2 billion USD" → 中文 "12 亿美元"
|
||
- 英文 "3.5 million patients" → 中文 "350 万名患者"
|
||
- 英文 "23%" → 中文 "23%"
|
||
|
||
### 量词
|
||
|
||
数字后面中文要加量词:
|
||
|
||
| 英文 | 中文 |
|
||
|---|---|
|
||
| 12 studies | 12 项研究 |
|
||
| 3 companies | 3 家公司 |
|
||
| 5 patents | 5 项专利 |
|
||
| 20 patients | 20 名患者 |
|
||
| 1.2 billion | 12 亿 |
|
||
| 3 years | 3 年 |
|
||
| 6 months | 6 个月 |
|
||
|
||
### 时间格式
|
||
|
||
- "2024" → "2024 年"
|
||
- "2020-2025" → "2020-2025 年"(用半角连字符)
|
||
- "Q4 2025" → "2025 年第 4 季度" 或 "2025 Q4"
|
||
- "March 2024" → "2024 年 3 月"
|
||
|
||
### 百分比
|
||
|
||
- "30%" → "30%"
|
||
- "up to 60%" → "最高 60%"
|
||
- "approximately 40%" → "约 40%"
|
||
|
||
---
|
||
|
||
## 四、标点转换
|
||
|
||
### 必须转为中文标点的情况
|
||
|
||
中文段落中,句内标点必须是**中文全角标点**:
|
||
|
||
| 英文 | 中文 |
|
||
|---|---|
|
||
| `,` | `,` |
|
||
| `.` | `。` |
|
||
| `;` | `;` |
|
||
| `:` | `:` |
|
||
| `?` | `?` |
|
||
| `!` | `!` |
|
||
| `"..."` | `"..."` |
|
||
| `'...'` | `'...'` |
|
||
| `(...)` | `(...)` |
|
||
| `—` | `——`(中文全角破折号是两个连一起)|
|
||
| `...` | `……`(中文省略号六个点)|
|
||
|
||
### 保留英文标点的情况
|
||
|
||
- 英文术语、代码、URL 内部的标点
|
||
- 行内引用的英文原文
|
||
- 数据单位前后:`3.2 mg/kg`(数字和单位之间用英文斜杠)
|
||
|
||
---
|
||
|
||
## 五、句子结构重构
|
||
|
||
### 英文长句→中文短句
|
||
|
||
**原文**:
|
||
> The observation that sST2 levels, which have been validated as a prognostic biomarker in heart failure and included in ACC/AHA guidelines, are elevated in COPD patients during acute exacerbations suggests a potential cross-disease mechanism.
|
||
|
||
**烂翻译**:
|
||
> sST2 水平(它已被验证为心力衰竭的预后生物标志物并被纳入 ACC/AHA 指南)在 COPD 患者急性加重期间升高的观察结果,提示了潜在的跨疾病机制。
|
||
|
||
**好翻译**:
|
||
> sST2 已是心力衰竭领域的预后生物标志物,纳入 ACC/AHA 指南多年。COPD 患者在急性加重期间 sST2 水平升高,提示这两类疾病可能共享同一条炎症通路。
|
||
|
||
### 修饰语位置
|
||
|
||
英文习惯把修饰语放后面(of / which / that 从句),中文要前置或拆句。
|
||
|
||
- "the company that pioneered O-glycosidase commercialization in 1990" → "1990 年率先实现 O-糖苷酶商业化的那家公司"(前置)
|
||
- 或拆句:"NEB 公司在 1990 年率先将 O-糖苷酶商业化"
|
||
|
||
---
|
||
|
||
## 六、段落重构
|
||
|
||
### 英文段落首句原则
|
||
|
||
英文学术/商业写作的段落一般首句即论点(Topic sentence),后面是论据。翻译时保留这一结构,不要打乱。
|
||
|
||
### 段落长度调整
|
||
|
||
- 英文习惯长段(150-200 词 / ≈ 250-330 字)
|
||
- 中文如果一段超过 400 字,读起来累。超过 400 字应考虑拆段。
|
||
- 拆段原则:按子论点拆,不要机械按句数拆
|
||
|
||
---
|
||
|
||
## 七、翻译后校对清单
|
||
|
||
译完后自己过三遍:
|
||
|
||
### 第 1 遍:准确性
|
||
|
||
- 所有数字、日期、百分比、来源 ID `[src_xxx]` 完全一致?
|
||
- 所有专有名词首次出现有中英对照?
|
||
- 没有错译、漏译?
|
||
|
||
### 第 2 遍:流畅性
|
||
|
||
- 有没有"的"字过多?(`X 的 Y 的 Z 的 W` 这种链式改为"X 下的 Y 中的 Z")
|
||
- 有没有翻译腔?("...的话"、"...的话说"、"对于...来说"、"在...方面")
|
||
- 句子长度是否有节奏变化?全长句或全短句都不行
|
||
- 读一遍念出来,是否自然?
|
||
|
||
### 第 3 遍:humanizer-cn 禁用词
|
||
|
||
加载 `skill:humanizer-cn`,扫一遍中文禁用词清单:
|
||
- 跃迁 / 赋能 / 落地 / 格局 / 生态 / 痛点 / 风口 / 闭环 / 抓手 / 颠覆 / 引领 / 重塑 / 赛道 / 范式 / 底层逻辑 / 本质上 / 从根本上
|
||
- AI 套话:随着、不断、深入、值得注意、不难发现、具有重要意义、综上所述、由此可见
|
||
|
||
---
|
||
|
||
## 八、特殊情况处理
|
||
|
||
### 原文是咨询报告风格
|
||
|
||
保留咨询报告的语感:观点前置、数字支撑、对比结构。不要为了"接地气"而口语化。
|
||
|
||
### 原文包含表格
|
||
|
||
表格翻译时:
|
||
- 表头翻译
|
||
- 单元格数字保留原格式
|
||
- 专有名词保留英文(节省宽度)
|
||
- 表格标题用 `表 X-Y:<内容>(数据来源:[src_xxx])`
|
||
|
||
### 原文包含图表
|
||
|
||
图表标题和说明翻译;图表本身(如果是 matplotlib 生成的 PNG)可能需要 dr-reporter 用中文字体重新生成。
|
||
|
||
### 原文包含 SCQA 式段落(如 Executive Summary)
|
||
|
||
SCQA 结构保留(因为这是麦肯锡式叙事),但不要标注 "S/C/Q/A"字样,按 `mckinsey-method skill` 要求写成融合式。
|
||
|
||
---
|
||
|
||
## 九、术语表维护
|
||
|
||
dr-translator 在翻译过程中维护项目级术语表:
|
||
|
||
```
|
||
projects/<slug>/phase4/glossary.json
|
||
{
|
||
"GH101 family": "糖苷水解酶 101 家族",
|
||
"endoglycosidase": "内切糖苷酶",
|
||
"O-glycosylation": "O-糖基化",
|
||
"Core 1": "核心 1 型",
|
||
...
|
||
}
|
||
```
|
||
|
||
这个术语表会作为 final report 里的"术语表(Glossary)"章节,双语对照呈现。
|
||
|
||
---
|
||
|
||
## 十、输出要求
|
||
|
||
### 文件命名
|
||
|
||
- 英文稿:`projects/<slug>/phase4/final_en.md`
|
||
- 中文稿:`projects/<slug>/phase4/final_zh.md`(dr-translator 产出)
|
||
- 中文稿润色后:仍然 `final_zh.md`(dr-polisher 原地修改)
|
||
- PDF 主稿:`final.pdf`(中文)
|
||
- PDF 英文参考版:`final_en.pdf`
|
||
- DOCX 主稿:`final.docx`(中文)
|
||
|
||
### 交付汇报
|
||
|
||
翻译完成后向调用者返回:
|
||
|
||
```
|
||
翻译完成
|
||
英文源:projects/<slug>/phase4/final_en.md (X words)
|
||
中文译:projects/<slug>/phase4/final_zh.md (X 字)
|
||
膨胀率:X%(预期 1.4 倍)
|
||
术语表:projects/<slug>/phase4/glossary.json (X 条)
|
||
翻译质检:humanizer-cn 禁用词 X 项(已清理)
|
||
下一步:等待 dr-polisher 做最终润色
|
||
```
|