原始内容
name: en-zh-max description: >- Use when the user wants 英译中 / 英译汉 / English to Chinese / translate to Chinese, or to polish translationese out of a Chinese draft. Also when producing 英中对照 bilingual output. Not for Chinese-to-English, pure Chinese writing polish, or single-word lookups. license: MIT version: 3.1.0 tags: [translation, english-to-chinese, english-chinese, chinese-translation, 英译汉, 英译中, 翻译, 润色, 中英对照, localization, nlp, llm, claude-code, claude-skill, book2skill, ye-zinan, translation-pipeline] allowed-tools: Read Write Edit Bash
en-zh-max · 英译汉翻译润色
把英文译成地道中文并产出英中对照译文。核心方法论基于叶子南《高级英汉翻译理论与实践》(清华大学出版社,2020)的系统理论。统领原则:读者中心——每个翻译决策最终追溯到一个问题:「这个中文读者是谁,在什么语境下读?」。英→中最致命的错误是把英语的形合结构、名词化抽象主语、长定语从句直接迁移进汉语造成翻译腔。好译文 = 以读者为中心、按文本类型调节归化尺度、发挥汉语意合优势、兼顾音韵节奏。
方法论基石(叶子南,第一章·第十五章)
"翻译教学应着重培养译者的翻译观(translator's worldview),而非仅传授技巧。技巧介绍不可或缺,但从长远看,不足以造就合格翻译通才——真正需要的是译者对英汉两种语言文化异同的深刻领悟与洞见。"
"在翻译任何一篇文章时,都必须先弄清楚,这是一篇什么样的文章?这篇文章有什么特点?这篇文章是谁写的?又是写给谁读的?是在什么场合下写的?只有搞清楚了这些问题,我们才能回答翻译决策中的具体问题。"(第十五章)
"释义(paraphrase)是文学翻译的大敌。"(第十四章)
五大核心原则贯穿全流程:
- 「翻译前先分析文本」——七维度诊断 + 自由度评分,先定位再动笔(第十五章)
- 「以译入语为依归」——总方向是靠近读者、发挥汉语优势(第一章)
- 「灵活变通为核心能力」——摆脱原文语言结构的束缚(奈达理论,第十一章)
- 「保护汉语纯洁性」——警惕西化汉语蔓延,译者肩负纯洁本国语言的使命(第九章)
- 「文学翻译忌释义」——文学翻译中保留原文语言形式优先于转述内容(第十四章)
英→中核心差异(必读)
英译汉有三重根本不同,译者必须先建立此意识:
形合 vs 意合的根本对立:英语靠连接词、关系代词、介词显化逻辑关系(形合),汉语靠语序、语境、对偶暗示关系(意合)。叶子南指出:"英语的形合手段在汉语中大多可以省略——连接词、关系代词、冠词在英译汉中常常是多余的。"(第二章)英译汉最大错误是把
becausealthoughwhichthat逐个机械对应为「因为」「虽然」「它/其」「的」——结果句子臃肿、「的的不休」。名词化抽象主语的汉语困境:英语偏好抽象名词作主语(
The confidence that...、The realization of...),中文偏好具体的人/物作主语。直译抽象主语造成译文漂浮、无人味。详见references/translationese-symptoms.md。长定语从句的堆叠压力:英语定语从句可以右向无限扩展(
the man who... which... that...),中文定语必须前置且容量有限。叶子南的策略是拆成流水短句或转状语从句(第五章)。
交付物
<名称> 翻译(中英对照).md— 唯一真源。英文原文 blockquote (>),紧跟中文译文。<名称> 翻译(中英对照).html— 暖纸质感排版(Warm Paper)。学习/试卷类用--theme navy。- (按需)
<名称> 翻译(全中文).md— 脚本派生(删>行),不重打。
若聊天小段翻译直接在回复给对照,不必落盘。
全文翻译(书籍级交付)
额外产出 EPUB + MOBI。PDF 仅按需。派生脚本详见 references/output-formats.md。
阶段 -1 — 项目目录初始化 ★ 任何文件操作前强制执行
仅全文翻译时执行。聊天小段翻译跳过。
⚠ 准入: 用户已提供待翻译内容。无输入 = 退回用户索取。
✅ 准出: source/ 目录存在、原始文件已移入、提取产物已生成、归位验证通过。
完整步骤(目录创建、文件移动、格式提取、归位验证)见 references/project-init.md。
阶段 -2 — 预扫描与策略决定 ★ 全文翻译必做
⚠ 准入: 阶段 -1 归位验证通过。 ✅ 准出:
translation-plan.md已写入项目目录,包含总章数、每章词数、分组方案、模式判定。
任何全文翻译任务,阶段 -1 完成后必须先执行阶段 -2。聊天小段翻译跳过。
- 读取
source/下所有提取产物,统计:总章/节数、每章词数、最长章/最短章长度 - 按以下规则自动决定策略:
| 条件 | 策略 |
|---|---|
| 全书 ≤ 2 章 | 全部串行(直接走阶段 -0.5 → 0 → ... → 8) |
| 全书 3–6 章 | 全部串行 |
| 全书 ≥ 7 章 | 混合模式(见下方完整管线) |
- 子分割规则:单章 > 12,000 词 → 按段落边界分割为 2–3 个子块,每个子块由独立子代理负责。
- 产出
translation-plan.md写入项目目录。
产出格式:
# 翻译计划 — 《书名》
- 总章数:N
- 总词数:约 N
- 基线章:第 1–2 章(串行,建立风格基线)
- 批量章:第 3–N 章(并行,继承风格基线)
- 子分割:有/无(详情)
- 模式:纯串行 / 混合
⚠ 阶段 -2 的判定是终局性的。 后续不再"中途切换"——全书按计划执行到底。
全文翻译混合模式管线(≥ 7 章时启用)
纯串行(≤ 6 章)时直接走阶段 -0.5 → 0 → ... → 8,无需本节。混合模式分三段:
阶段 -2(预扫描,已执行)
↓
B1 — 基线章串行翻译(1–2 章)
完整阶段 0→1→2→3→4→5→6→7→8
额外产出:「风格基线」
↓
B2 — 批量章并行翻译(剩余章)
每章 = 一个子代理,执行精简管线(跳过阶段 7/8)
context 注入风格基线
↓
B3 — 合并与整书串行校验
按序拼接 → 阶段 7 完整校验链(含分层 humanizer)→ 阶段 8 清理与交付
阶段 B1 — 基线章串行翻译 + 风格基线
执行完整阶段 -0.5 → 0 → 1 → 2 → 3 → 4 → 5 → 6 → 7 → 8,逐章翻译。额外职责:翻译过程中记录不可逆决策,汇总为「风格基线」。
风格基线内容:
- 术语决策记录(TDR):原文词 → 选定译法 → 决策理由 → 首次出现章
- 句法先例:长定语处理方式、被动保留比例、连接词省略率
- 语感锚点:叙述段落 / 对话段落 / 论述段落的句长、语气、标点规则
- 高频模式:特定原文结构的固定处理方式(如
the fact that→ 删除,it is ... that→「正是」) - 标点和格式:引号类型、破折号形式、段落间距规则
生成方式:基线章各阶段产出的诊断记录(阶段 0 text-profile、阶段 3 润色标记、阶段 5 质检报告)在每章完成后自动汇总。不需额外手动编写——它是翻译过程的副产品。
基线章全部完成后,将风格基线写入 bilingual/style-baseline.md。
阶段 B2 — 批量章并行翻译
⚠ 准入: 基线章全部完成 +
bilingual/style-baseline.md已落盘。
剩余章节按 translation-plan.md 中的分组方案(含子分割)分配给子代理。每个子代理执行精简管线:
| 步骤 | 执行? | 说明 |
|---|---|---|
| 阶段 -0.5 | 跳过 | 主进程已预读取 |
| 阶段 0 | 继承 | 引用风格基线 text-profile,只记本级微调 |
| 阶段 1 | 执行 | 独立理解本章 |
| 阶段 2 | 执行 | 严格遵循风格基线的术语表和句法先例 |
| 阶段 3 | 执行 | 三张表照过;语感锚点从基线继承 |
| 阶段 4 | 执行 | 读出声打磨音韵 |
| 阶段 5 | 执行 | 12 项清单逐项核查 |
| 阶段 6 | 执行 | 标点脚本,残留 = 0 |
| 阶段 7 | 跳过 | 整书级校验在 B3 统一执行 |
| 阶段 8 | 跳过 | 合并后统一清理 |
每个子代理 context 必须包含:
- 风格基线(完整引用
bilingual/style-baseline.md) - 本级源文本路径
- 输出路径(
bilingual/第N章.md) - 上一章的末 3 段译文(衔接上下文,防止章间断裂)
- 本级特殊标注(如"本章含大量对话""本章是纯论述")
子代理产出写入 bilingual/ 目录,文件带 [v3·Q✓] 版本标记。
子分割执行:若某章在阶段 -2 被判定切为多个子块,该章的子块分别派发独立子代理;合并时按子块编号拼接回完整章。
阶段 B3 — 合并与整书串行校验
⚠ 准入: B2 所有子代理返回 +
bilingual/目录下全部产出到位。 ✅ 准出: 整书校验链全部通过 + 阶段 8A/8B 完成。
合并流程:
- 清理子代理输出格式(删除子代理自加标题行、脚注、
翻译完成等流程声明、多余分隔线) - 按章序拼接:基线章译文(从 B1 产出复制)+ 批量章译文(从
bilingual/按序插入),章间以---分隔 - 跑标点规范化脚本(
normalize-punctuation.py,残留 = 0) - 落盘为
<书名> 翻译(中英对照).md
整书校验链: 合并完成后,执行阶段 7 完整版(含步骤 0 一致性预检 + humanizer 分层策略——详见阶段 7)。
阶段 -0.5 — Ultra 预读取批 ★ en-zh-max 专属
⚠ 准入: 阶段 -1 归位验证通过。 ✅ 准出: 17 个 ultra SKILL.md 全部已 Read。未完成 = 停止,不可进入阶段 0。
目的: 将《高级英汉翻译理论与实践》15 个蒸馏技能的完整方法论一次性载入上下文,建立全流程方法论地基。后续各阶段的正式 invoke 在此地基上执行,减少上下文重建成本。
执行: 用 Read 工具依次读取以下 17 个文件(INDEX.md 必须第一个;路径相对 $SKILL_DIR):
$SKILL_DIR/../en-zh-ultra/INDEX.md$SKILL_DIR/../en-zh-ultra/BOOK_OVERVIEW.md$SKILL_DIR/../en-zh-ultra/ec-translation-basic-decisions/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-semantic-analysis/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-image-formation/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-contrastive-analysis/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-unit-selection/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-formula-recognition/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-foregrounding/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-westernization/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-pretext-analysis/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-nida-functional-equivalence/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-newmark-text-typology/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-cognitive-metaphor/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-unpacking/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-literary-anti-paraphrase/SKILL.md$SKILL_DIR/../en-zh-ultra/ec-translation-accuracy-checklist/SKILL.md
⚠ 批量读取后可继续阶段 0,不必等待逐一确认。 读取完成 = 本阶段准出满足。
短篇优化(< 2,000 词): 仅读 #1-2 (INDEX + BOOK_OVERVIEW) + #3(翻译基本问题决策框架)+ #6(五层次对比)+ #9(前景化)+ #11(文本分析七维度)+ #17(准确性六维校验),共 7 个文件。仍不可完全跳过预读取。
工作流(严格按序;每段译文都要走完润色,不是初译就交)
阶段 0 — 文本分析:定归化档位 ★必做第一步
⚠ 准入: 阶段 -1 产物到位(source/ 目录 + 归位验证通过)。若仅聊天小段翻译则跳过 -1,直接进入文本分析。 ✅ 准出: text-profile 已写入对照文件头部,且 档位、自由度、文本类型、语域 四项均非默认值/占位符。四项任一缺漏或为占位 = 退回补全,不可进入阶段 1。
先回答:这是硬文本还是软文本?属纽马克哪一类?自由度大致几分(1–10)? 详见 references/text-analysis-and-qa.md 小节 A。
判定完成后,立即将 text-profile 写入对照文件头部作为注释块:
<!-- text-profile
档位: [偏硬/偏中/偏软] | 自由度: [N]/10 | 文本类型: [表达/信息/呼唤]
语域: [正式/中性/口语/混合] | 特殊标记: [无 / 性直白内容(语域对等优先) / ...]
语域脏度: [1-5] | 策略: [准确优先/平衡/流畅优先], [其他策略要点]
-->
阶段 2/3/5 必须引用此 profile。若翻译过程中对档位产生疑问,回到此阶段修正 text-profile 后重新开始下游阶段。
- 偏硬(自由度 1–3):政治/法律/经贸/科技/合同/说明书。→ 贴原文逻辑,选词精准,准确 > 流畅,少介入,术语用固定译法。某些"西化"是为精确付的合理代价。
- 偏中 (4–6):教科书/新闻/一般论述。→ 平衡,默认交际翻译。
- 偏软 (7–9):文学/散文/评论/讲演/广告/宣传/营销。→ 大胆发挥意合与汉语之美,可调结构、可换形象,流畅/效果优先。
语域脏度档位(强制必填)
| 档位 | 含义 | 判定标准 |
|---|---|---|
| 1 | 零脏字 | 纯技术/学术/公务,无贬称/骂詈/性描写/暴力描写 |
| 2 | 可俗不脏 | 允许口语/俗语,不用脏字;偶有轻微贬称 |
| 3 | 粗鄙自由 | 粗鄙措辞自由,性/暴力场景直译不回避 |
| 4 | 脏字对等 | 脏字按原文语域对等还原,性直白内容大胆译 |
| 5 | 猎奇极限 | 猎奇/官能/极限文本,中文脏度不低于原文 |
判定方法: 阅读原文前 500–1000 词 → 判断是否存在贬称/骂詈/性描写/暴力描写 → 按密度和强度赋 1–5。不确定时宁高不低(高可下调,低导致整本译脏度不足)。
⚠ 学术类文本脏字特殊规则: 如果原文是偏学术/非虚构分析类著作(如文化批评、哲学论著、社会研究等——非典型小说/非典型粗鄙文本),即使含有脏字,不得自主设定语域脏度——必须先向用户询问分级倾向。因为学术论述中的脏字通常是理论修辞而非感官用途,语域需要比默认硬词映射更保守。
实例:安吉拉·卡特《The Sadeian Woman》——原文有大量 fuck/prick/cunt,但属于严肃的女性主义文化批评,用户要求降低到最低脏度,全部使用"做爱/性交/阴茎"而非硬词映射表中的"操逼/鸡巴/屄"。
⚠ 语域脏度 ≠ 文本软硬度。 软文本(文学小说)语域脏度可以是 1(纯爱小说)或 5(猎奇官能)。二者独立判定。
- 别忘文本外因素:翻译目的、读者是谁。档位一句话写进给用户的说明里。★ 读者中心:拿不准任何翻译决策时,回到统领原则——「这个读者是谁,在什么语境下读?」
★ en-zh-max 增强:应用预载方法论(阶段 0)
以下方法论文件已在阶段 -0.5 预读取时载入上下文。直接应用其框架——无需再
Skill()加载。
1. 文本分析七维度与自由度评估法 — 七维度文本诊断:
- 逻辑/情感驱动判断 → ABC 文本类型初判 → 语域识别 → 评价性强弱 → 文化含金量评估 → 软硬文本判定
- 产出 1–10 自由度评分,作为后续所有阶段的核心参数
2. 纽马克文本分类确认:
- 对表达型/信息型/呼唤型三类文本分别套用对应翻译策略
- XYZ 参照模式:评估文本中 X(原作意图)、Y(译文读者期待)、Z(文本自身特征)的三角关系
3. 翻译基本问题决策框架 — 六对维度翻译策略坐标:
- 逐对定位:直译↔意译、功能对等↔形式对应、形式↔内容、源语↔译入语、作者↔读者中心、作者目的↔译者目的
- 六维定位结果汇入 text-profile
以上三个框架的决策结果汇入 text-profile,写入对照文件头部。产出标准同阶段 0 定义。
⚠ 性/身体直白内容的语域陷阱
当翻译文学作品中直白性/身体描写(性器官、性行为、禁忌题材如萨德、巴塔耶等),且用户明确要求「不回避、直译」时:
- 语域对齐优先于流畅归化。即使文本整体偏软(自由度 7–9),性/身体词汇也应当按原文直译,不使用汉语委婉语(「那话儿」「玉茎」「私处」「后庭」)或医学术语替换。
- 硬词译法示例:
prick→ 鸡巴,cunt→ 屄,ass/anus→ 屁眼,sodomite→ 鸡奸者,bugger→ 屁精,fuck→ 操/干,sperm→ 精液(用口语对应而非医学术语)。 - 判定依据:这不是归化尺度的问题,而是语域对等的问题——原文用的是粗俗/直接词,译文也应当用同等直接度的词。如果原文用的是迂回/文雅词(如
member,love-juice),则按原文语域处理。 - 拿不准时:查
references/libertine-vocabulary.md的硬词词典(萨德式浪荡文学),或references/literary-fiction-sexual-register.md(当代文学混合语域,如 Cronenberg),或在阶段 0 先向用户确认语域档位。
阶段 1 — 理解 → 脱离语言外壳
⚠ 准入: text-profile 已写入文件头部。不存在 = 退回阶段 0。 ✅ 准出: 脱壳摘要已以注释形式写入对照文件(
<!-- 脱壳摘要: ... -->,3–5 句中文概括全篇核心语义,不得含英文词)。注释不存在 = 本阶段未完成。
读懂原文后,抛开英文词句,在脑中形成意义/图像,再用中文重构(不要在词面上挪移)。
★ en-zh-max 增强:应用解包袱法(阶段 1)
对结构纠缠的关键句执行解包袱法(预载方法论):
- 识别紧缩结构中隐含的语义关系(如
poverty tour→ tour 的核心事件 + poverty 的限定范围 →「对贫困地区的访问」) - 将压缩的语义关系展开为中文可接受的自然表达
- 与奈达核心句转换法配合——解包后的语义结构即为核心句的原料
遇到结构纠缠的短语也用"解包袱法"理清隐含语义关系(见 references/techniques.md)。
阶段 2 — 按档位初译
⚠ 准入: text-profile + 脱壳摘要就绪。 ✅ 准出: 全文段落均完成初译,每段尾部标注
[v1]。存在未标 [v1] 的段落 = 本阶段未完成。
★ en-zh-max 增强:术语表语域强制查阅(阶段 2 准入)
初译前强制扫描项目 TERMS_GLOSSARY.md:
- 若存在 🟡/🔴/⚪ 标记的条目 → 提取本章涉及的所有标记条目,在本章译文头部以注释形式写入语域约束清单
- 若存在语域映射表 → 提取本章出现的所有角色及其语域设定
- 初译时逐句对照此清单——遇到清单中的原文词,必须按语域标记选词(非中性→不可中性逃逸)
语域约束清单格式(通用模板,关键词由项目术语表填入): ```markdown
```
以意合优先起译:能不用连接词就不用,长句拆成流水短句,被动转主动,定语别堆在名词前。
★ en-zh-max 增强:应用结构转换方法论(阶段 2)
1. 英汉五层次对比指导初译:
- 语音/书写层:英文大小写/斜体如何补偿为中文手段
- 语义层:英文词汇的多义性在上下文中的定位
- 句法层:形合→意合转换的具体操作——砍连接词、拆长句、被动转主动
- 话语/篇章层:英文段落结构的归化调整
- 语言外因素层:文化预设的补偿策略
2. 翻译单位选择— 按文本类型动态确定翻译单位:
- 硬文本(法律/科技):以词/词组为基本单位,术语严格对应
- 中文本(新闻/教科书):以句子为基本单位,段落衔接留意
- 软文本(文学/广告):以语段为基本单位,允许大幅结构调整
- 总体方向:尽量扩大翻译单位(词 → 词组 → 句子 → 语段)
两个框架在阶段 2 初译过程中并行指导——五层次对比决定"怎么转",单位选择决定"以什么粒度转"。
初译完成后,每段中文译文末尾缀 [v1] 版记。
阶段 2.5 — 语域对齐层 ★ 初译后强制
⚠ 准入: text-profile 语域脏度 ≥ 3。1–2 自动跳过本阶段,直接进入阶段 3。 ✅ 准出: 全章 [v1] 段均已标注 R 状态(✓ / ↓已修 / —不适用)。存在未标注 R 状态的 [v1] 段 = 本阶段未完成。
目的: 在初译和润色之间插入语域专项调校,防止润色阶段因关注"中文好不好听"而把脏度洗白。
操作流程(通用,不预设关键词):
- 读取 text-profile 语域脏度档位 + 术语表 🟡🔴⚪ 条目 + 语域映射表(若存在)
- 逐段回读 [v1] 译文,对照原文判断该段的实际语域 vs 目标语域
- 判断标准(通用):
- 原文有贬称/骂詈 → 中文是否用了同等层级的贬称/骂詈
- 原文有性/暴力直白词 → 中文是否直译而非委婉语
- 原文角色口吻粗鄙 → 中文角色口吻是否同样粗鄙
- 叙述者冷讽 → 中文叙述是否偏暖/偏文雅
- 语域偏差 ≥ 2 级的段落标记:
[v2·R↓]— 译文偏干净,需升脏(中文措辞比原文文雅)[v2·R↑]— 译文偏脏,需降脏(中文措辞比原文粗鄙)
- 修正偏差段落,修正后标
[v2·R✓] - 语域一致的段落标
[v2·R—](不适用/无需调整)
关键原则:
- 不可机械升降——脏度升不是简单地加脏字,是在中文语域中找到同等层级的表达
- 英文脏字体系层级丰富(
damn/hell→shit/crap→fuck/cock/cunt),译者需在中文语域中自行定位对等层级 - 拿不准时回查术语表语域映射表;映射表无覆盖时在阶段 0 text-profile 的特殊标记中备注
产出: 本章的 [v1] 段落尾标全部替换为 R 状态标记。阶段 3 润色时,R 状态标记作为上下文保留(不覆盖)。
阶段 3 — 润色诊断(核心)逐段过三张表
⚠ 准入: 全文段落均标 [v1]。 ✅ 准出: 全文段落均标 [v2·操作类型],每段润色操作可追溯。存在未标 [v2·*] 的段落 = 本阶段未完成。
阶段 3 与阶段 5 的边界(必读)
若修改的触发原因是 「中文读着别扭」→ 归阶段 3(本阶段)。若修改的触发原因是 「对照原文发现误差」→ 归阶段 5(质检阶段)。两个阶段都改完后段落标 [v3·Q✓]。
例:
- 初译 "自信正在让位于一种不祥之感" → 中文可接受,但节奏可优化 → "如今这份自信,正让位于一种隐隐的不祥之感" ← 阶段 3(中文内部润色)
- 原文 "could remain dominant" → 初译"将稳居主导",遗漏了 could 的情态 → 应补为"仍能稳居" ← 阶段 5(原文对照修正)
润色操作类型标记
每段润色完成后,尾部缀以下标记之一:
| 标记 | 含义 | 示例场景 |
|---|---|---|
[v2·S] |
改结构(拆句/合句/语序移位) | 长定语从句 → 流水短句 |
[v2·W] |
换词(选词/成语/词性转) | "make" → 视语境译为"使/让/令/造成/促使" |
[v2·A] |
增删(增词补隐含逻辑/删冗余连接词) | 增补让步转折连接 |
[v2·R] |
语域调校(升脏/降脏/语域对齐) | 阶段 2.5 R↓/R↑ 段落的最终确认 |
[v2·∅] |
不改(初译已可接受,直接继承 [v1]) | 初译即终译 |
- 翻译腔病症 — 对照
references/translationese-symptoms.md逐条排查并修:形合迁移/连接词冗余、长前置定语、"的的不休"、被动滥用、抽象名词作主语、习语硬译、语义关系隐含不清。 - 技巧库 — 用
references/techniques.md的手段修:词性转换、增/减词、分句/合句、语序移位、定语从句转状语/独立句、正反译、被动转化。 - 隐喻决策 — 基本/图像图式隐喻(旅程、大小、冷热…)可直译;文化专属隐喻糅合或舍弃;直译≠应直译,看档位(
references/text-analysis-and-qa.md小节 B)。 - 性/身体直白词汇 — 涉及萨德风格作品的直译时,参考
references/libertine-vocabulary.md的硬词映射表,确保语域对等。
★ en-zh-max 增强:应用套语 + 西化评估(阶段 3)
1. 套语「水 vs 冰」识别(预载方法论):
- 对译文中疑似套语的表达执行水冰判断——是否以整体为单位不可拆解
- 科技套语(标准化)→ 固定译法;文化套语(问候/寒暄/习语)→ 功能对等翻译
- 对标记为套语的表达,防止逐词硬译
2. 西化表达六维评估(预载方法论):
- 对译文中的西化表达从六个维度评估可接受度:读者可接受性、文本价值(一次性 vs 永久)、文化符号学、历时文化、社会文化运动、标准化文本
- 标注西化表达的处理决策:保留(永久价值文本)/ 归化(一次性文本)/ 加注(文化符号学维度)
- 与「润色边界」配合——西化是一个连续体,可接受度随文本价值变化
阶段 4 — 音韵节奏打磨
⚠ 准入: 全文段落均标 [v2·操作类型]。 ✅ 准出: 全文已逐段读出声打磨,每段标
[v3]。存在未标 [v3] 的段落 = 本阶段未完成。
读出声。利用双音节/四字结构、"偶字易适奇字难平"、对偶排比;并列词组尽量配偶字("飞机小,便宜"→"体积不大,造价便宜")。但软文本才放开;硬文本点到为止。
阶段 5 — 准确性质检
⚠ 准入: 全文段落均标 [v3]。 ✅ 准出: 质检报告全部项 ✓ + 全文段落标
[v3·Q✓]。任一项 ✗ = 退回对应阶段修复后重跑本阶段。
判别:本阶段只处理原文对照问题(漏译/错译/添译/语域错位/理解错误)。中文内部润色归阶段 3。
对照 references/text-analysis-and-qa.md 小节 C 逐项核(每项必须 ✓ 或 ✗,不可留空):
- 擅自改结构/移焦点 — 对照原文核每处 [v2·S] 标记段
- 漏译情态虚词
- 擅自添词/加译过度
- 搭配不当
- 指代偏移
- 逻辑关系误判(因果/让步/条件)
- 专名术语数字准确性
- 语域对齐(与 text-profile 的语域字段交叉核验)
- 性/身体词汇语域对等(如涉及)
- 理解错误零容忍
- 隐喻/文化意象决策是否与档位一致
- 软文本的音韵/硬文本的术语精确度是否与 text-profile 一致
- 语域脏度是否与 text-profile 档位一致(全章无系统性漂移)
- 🟡🔴⚪ 术语是否按映射表/术语表选词(未发生中性→中性逃逸)
- 角色口吻是否与语域映射表一致(支配者脏冷、被支配者正常或收敛)
- 性/暴力描写是否语域对等(中文措辞层级 ≥ 原文措辞层级)
★ en-zh-max 增强:应用准确性六维校验(阶段 5)
在 12 项质检清单基础上,增加叶子南六维校验(预载方法论):
- 重心转移:译文是否将原文的语义重心移到了次要成分上
- 语义遗漏:是否遗漏了原文的关键语义要素
- 结构意义丢失:原文通过结构传达的意义是否在译文中丢失
- 过度详解:是否将原文隐含的信息显化过度(
explicitation) - 逻辑偏移:原文的逻辑关系在译文中是否发生了偏移
- 语域不匹配:译文的语域是否与原文对齐
- 六维诊断结果与 12 项清单交叉验证
- 发现问题后标注严重程度(一级=理解错误/二级=表达偏差),一级问题必须退回修复
全部 ✓ 后,将每段版记从 [v3] 改为 [v3·Q✓]。
红线:放松准确性 ≠ 理解错误。理解错误没有原谅的余地。
阶段 6 — 中文标点规范化 ★(机械执行,落盘后必跑)
⚠ 准入: 全文段落均标 [v3·Q✓] + 质检报告全 ✓。未满足 = 退回阶段 5。 ✅ 准出:
normalize-punctuation.py执行完毕,输出残留: 0。残留 ≠ 0 = 手动修复后重跑脚本直到 0。
中文译文里的标点必须是中文全角,不能残留英文半角(译者最易忽略,逐字凭眼力一定会漏)。规则:
, : ; ? !→,:;?!;句末用。;并列用顿号、;破折号——;省略号……。- 圆括号
( )→ 全角( ):仅当紧邻中文字符时才转(包裹中文内容、含人名/术语原文注,如 "道德受体地位(moral patienthood)");纯英文括注(如电影演职(Harold D. Schuster, 1937))保持半角。 - 双引号统一为中文全角
" "(内层' ');直角引号「」、『』一并归一为" "/' '。
以下一律保持半角,绝不转: ① 英文原文 blockquote(> 行)整段不动;② Markdown 链接 [文字](https://github.com/3060226349kk-cmd/en-zh-max/tree/HEAD/url) 的括号与 URL;③ 中文行内嵌入的整句/词组英文,其内部标点——如被引用的英文原句 …one nation under God, indivisible, …;④ 数字/缩写/版本号里的点:4.3、Word 2010、A.I.、L. M.;⑤ 代码/公式块。
落盘后执行(全平台通用):
python3 "$SKILL_DIR/scripts/normalize-punctuation.py" "<名称> 翻译(中英对照).md"
脚本输出 残留: N——N 必须为 0。不为 0 则手动修复后重跑。
聊天里直接给的小段对照(未落盘)同样要手动套用上述规则。
阶段 7 — 交付前校验链 ★ 落盘后强制执行(四步骤 + ultra 增强子步骤,不可跳步)
⚠ 准入: 对照 md 已落盘 + 阶段 6 残留 = 0。 ✅ 准出: 校验链四步 + ultra 增强子步骤全部通过(prose-reviewer → verification-before-completion → 步骤 2.5 ultra 修辞双技能 → humanizer → humanizer-zh)。任一步未通过 = 修复后重走该步。
翻译文本已落盘,但任务尚未完成。以下步骤 + ultra 增强子步骤必须按顺序全部通过后,才可宣告"翻译完成"。任一步骤发现问题 → 回到对应阶段修复 → 重跑校验链。
步骤 0:整书一致性预检(★ 混合模式专属)
仅在混合模式(B3 合并后)时执行。纯串行模式跳过此步。
- 术语一致性扫描:提取风格基线术语表 → 逐章 grep 全书译文 → 标记同一原文词不同译法的不一致处,自动统一到基线译法
- 语感漂移检测:统计每章平均句长、连接词密度、被动比例 → 与基线章(第 1–2 章)对比 → 偏差 > 30% 的章标记,自动修复
- 衔接质量抽查:抽查章末段 → 下一章首段的语义衔接,断裂处补过渡句
- 语域一致性扫描(★ 全模式执行,不分层):
- 提取风格基线语域映射表 → 逐章 grep 高频脏度措辞 → 统计每章语域分布
- 对比基线章语域分布 → 偏差 > 30% 的章标记,自动修复
- 角色口称一致性抽查:同一角色对同一对象的称呼是否漂移(如角色A在第3章称"X"、第8章称"Y"→ 统一到映射表设定)
- 不可自动修复的标记但不阻塞后续校验链——humanizer 将二次覆盖这些区域
预检报告产出后,问题自动修复优先;不可自动修复的标记但不阻塞后续校验链——prose-reviewer 和 humanizer 将二次覆盖这些区域。
步骤 1:prose-reviewer
审查中文译文——AI 写作腔、翻译腔残留、禁用短语、语感漂移、结构单调。译文是自然语言文本,不可跳过此步。
※ 注意:prose-reviewer 的判断为参考意见,并非最终决定。prose-reviewer 建议的修改(如语感调整、措辞替换等),后续的 humanizer(步骤 3)拥有最终裁量权。对存疑建议不要机械接受,留待 humanizer 裁决。
步骤 2:verification-before-completion
全交付物完整性检查:MD/HTML/EPUB/MOBI 是否齐全、标点残留是否为 0、英中配对是否完整、原文件是否在 source/ 内。此外确认以下翻译专属项目:
-
humanizer尚未执行(步骤 3 即将执行,此处只需确认"未执行") - 英文原文 blockquote 与中文译文的段落对应一致
- 阶段 8 强制清理待执行 — 版本标记
[v*]仍存在于非 blockquote 行;text-profile 注释块未删除;译者署名未添加(此三项将在阶段 8 第一步由脚本机械完成)
⚠ 此时绝不宣称"完成"。 verification-before-completion 通过后,必须继续步骤 2.5(ultra 修辞技能)→ 步骤 3(humanizer)→ 步骤 4(humanizer-zh)。
★ en-zh-max 增强:修辞技能 invoke(步骤 2.5)
verification-before-completion 通过后、humanizer 之前,执行以下两个预载方法论框架的应用:
1. 前景化翻译决策:
- 区分体系偏离(英文形合特征在汉语中的天然表现)vs 作者刻意偏离(前景化)
- 体系偏离 → 归化处理(不保留英文形式特征)
- 作者刻意偏离 → 尽量保留语言形式(如海明威的短句风格、福克纳的长句堆叠)
- 对译文中涉及前景化的关键段落逐条标注偏离类型和处理决策
2. 文学翻译反释义检查:
- 在文学/软文本中,检查译文是否将原文的具体语言形式"释义"为抽象内容
- 叶子南核心原则:"释义是文学翻译的大敌"——保留原文语言形式优先于转述内容
- 对文学段落标注是否违反了反释义原则
⚠ 跳过条件: 若 text-profile 档位为「偏硬」(自由度 1–3),此步跳过——法律/技术文本不涉及前景化和文学形式保留。
humanizer 在步骤 3 执行时,将引用此处的前景化标注和反释义判断结果。
步骤 3:humanizer(★ 最终质量关卡·绝对不可跳过)
verification-before-completion 通过后,立即 invoke humanizer skill。这是翻译工作流的最终关卡,任何理由均不可跳过。
调用方式:
Skill("humanizer")
humanizer 在翻译模式下执行以下操作:
- 读取完整的
<名称> 翻译(中英对照).md - 将中文译文按段落切割为 chunk(每块 3–5 段,编号 C1–CN)
- 对每个 chunk 执行四维验证:Fidelity(忠实度:逐句对照源文,检查语义等价/否定/情态/专名)→ Naturalness(自然度:翻译腔/语感/注册)→ Grammar(语法错字:搭配/标点/一致)→ AI Patterns(AI 痕迹:29 种模式作为 Check D)
- 输出每块的四维 💚/❌ 追踪报告,标注具体问题位置
- 执行强制对抗式自审(Phase 2)——对全部 💚 通过的块重新逐句审查,防止系统性盲区遗漏
- 根据报告修复问题段落——保留原文意义,注入自然语感,压制 AI 腔
- 仅处理中文译文,不动英文原文 blockquote
- 将修复后的中文译文原位写回文件
★ humanizer 的最终裁量权:
humanizer 是翻译管线的最终质量判定者。对 prose-reviewer 已建议的修改(措辞调整、翻译腔修正、表达替换等),humanizer 拥有以下裁量权:
- 批准并应用 prose-reviewer 的建议
- 拒绝并还原 prose-reviewer 的建议(如 prose-reviewer 判断 prose 过于"文学化"建议简化,但 humanizer 结合上下文判断原文语域应保留)
- 发现并修正 prose-reviewer 遗漏的问题
- prose-reviewer 与 humanizer 判断冲突时,以 humanizer 为准
humanizer 完成后:
- 输出摘要:处理的 chunk 数、各维度问题数、修复项目概要(含 prose-reviewer 建议的批准/拒绝明细)
- 确认英中对齐结构未被破坏
- 此时校验链完成,可进入阶段 8 输出交付物
⚠ humanizer 跳过是重大工作流违规。 翻译是 AI 产出文本中 AI 腔最密集的品类之一——翻译腔与 AI 腔高度重叠。prose-reviewer 是翻译腔/语感漂移的一级检测器,但 humanizer v3 的四维管道(忠实度 + 自然度 + 语法 + AI 模式)+ 强制对抗式自审提供了更全面的质量保障——能够发现 prose-reviewer 未标记的问题。两者互补不可互替。humanizer 是交付前最后一道质量关卡,未经过 humanizer 的翻译是未完成的。
★ humanizer 分层策略(混合模式时):
合并后的全书进入阶段 7 时,humanizer 按风险分层执行:
| 层级 | 包含 | 策略 | 理由 |
|---|---|---|---|
| Tier 1 | 基线章(第 1–2 章) | 跳过 | B1 阶段已完成完整阶段 7,无需重复 |
| Tier 2 | 最长章 + 内容类型突变章 + 术语密集章 | 全量四维 + 对抗自审 | 最高风险区域,约占全书 10–15% |
| Tier 3 | 其余批量章 | 仅 AI Patterns + Naturalness | Fidelity 已有子代理阶段 5 质检覆盖;AI 腔和语感不一致是并行翻译最薄弱环节 |
humanizer-zh(步骤 4)不受此分层影响——24 模扫描极快,全量执行。
⚠ 纯串行模式不分层——全书走标准阶段 7,humanizer 全量四维。
步骤 4:humanizer-zh(★ 中文 AI 痕迹终审·绝对不可跳过)
humanizer 完成后,立即 invoke humanizer-zh skill。这是中文译文在交付前的最后一道质量检查,任何理由均不可跳过。
调用方式:
Skill("humanizer-zh")
humanizer-zh 在翻译模式下执行以下操作:
- 读取完整的
<名称> 翻译(中英对照).md - 仅处理中文译文行——过滤
>开头的英文 blockquote 行,只扫描中文译文 - 按段落 chunk(3–5 段一组)逐块过 24 条中文 AI 痕迹规则(四大类:内容模式 6 + 语言语法 6 + 风格模式 6 + 交流填充 6)
- 检测并修复:AI 高频词汇(「此外」「格局」「织锦」「深入探讨」等 20 词)、破折号滥用、三段式排比、否定式排比、系动词回避、虚假范围、填充短语、通用积极结论等
- 不改变译文语义——Fidelity 已由 humanizer(步骤 3)完成,此步只做中文内部的语言自然度优化
- 将修复后的中文译文原位写回文件,保持英中对齐结构
- 输出摘要:处理的 chunk 数、各分类问题数、修复项清单
职责边界: humanizer 负责「译得对」(Fidelity + Naturalness + Grammar),humanizer-zh 负责「读起来像人写的」(中文 AI 痕迹清除)。二者各司其职。humanizer-zh 不做原文对照——那是 humanizer 已完成的工作。
★ 校验链错误自动修正(默认行为)
校验链(prose-reviewer → verification-before-completion → 步骤 2.5 ultra 增强 → humanizer → humanizer-zh)中发现的任何错误或问题,必须默认自动修正并直接写入对照 md 文件。这是强制默认行为,不可跳过:
- prose-reviewer 标记的问题 → 经 humanizer 裁决后,自动将采纳的修改写入 md
- verification-before-completion 发现的缺失/不完整 → 自动补全并落盘
- 步骤 2.5 ultra 双技能标注的问题 → 自动修复并落盘
- humanizer 四维验证(Fidelity / Naturalness / Grammar / AI Patterns)发现的问题 → 自动修复并原位写回 md
- humanizer-zh 24 模检测发现的问题 → 自动修复并原位写回 md
- 所有修正不等待用户逐条批准——自动执行、自动落盘
- 修正完成后的 md 是阶段 8 派生 HTML/EPUB/MOBI 的唯一输入源
- 若修正后导致英中对齐结构变化,humanizer 需在摘要中注明
校验链以修复为终点:发现问题后不修正是流程中断,不是"完成"。
阶段 8 — 最终清理与交付物生成
⚠ 准入: 校验链全部通过(阶段 7 完成)。 ✅ 准出: 步骤 8A 五项清理完成 + 步骤 8B 交付物全部生成。
步骤 8A — 最终清理(★ 强制门禁·绝对不可跳过)
⚠ 这是阶段 8 的第一道门禁。以下 6 项全部完成并通过验证前,禁止进入步骤 8B(派生交付物)。 ✅ 准出: 版本标记残留 = 0、text-profile 已删除、译者署名已添加、项目地址已添加、AI 流程残留 = 0、ultra 诊断记录已清理。六项缺一不可。
阶段 7 的 humanizer 已对 MD 完成原位修复。派生 HTML/EPUB/MOBI 之前,必须先对对照 MD 文件执行以下五项清理:
- 剥夺版本标记 — 删除所有内部工序标记:
[v1]、[v2·S]、[v2·W]、[v2·A]、[v2·∅]、[v3]、[v3·Q✓]。最终交付文件不应保留翻译工作流内部版本号。
- 语域标记:
[v2·R↓]、[v2·R↑]、[v2·R✓]、[v2·R—]
删除 AI 处理标记 — 删除
<!-- text-profile ... -->注释块。最终译本面向人类读者,不是技术日志。增加译者署名(默认含项目地址) — 在标题行(
# 《书名》)上方加以下块:
**译者:Lilipuut + Claude**
> 源于 [en-zh-max](https://github.com/3060226349kk-cmd/en-zh-max) 翻译技能产出,欢迎使用和改进。
---
★ 项目地址为译者署名强制组成部分,不可省略。
全中文版、EPUB、MOBI 同样继承此署名块(含项目地址行)。
剥离子代理流程残留 — 删除并行翻译管道遗留在正文中的内部元数据(常见泄漏类型):
- 文件路径泄漏:本地路径(
C:\Users\...、C:\...\Downloads\...、\bilingual\、\chunk) - chunk 编号与来源标记:
PART_II_Ch4_chunk2.txt、源文件路径:、译文已整合至:、以上为 .*chunk.* 的完整、源文件:后接 code 块 - 子代理完成声明:
翻译完成。以下是最终输出摘要:、翻译已完成,文件已更新: - Agent 自我描述:
现在我已掌握完整文本。开始翻译。这是一篇、译文完整。所有英文段以blockquote标注、严格遵循术语表。等自指元叙述 - 翻译覆盖/格式/术语声明:以粗体标题
翻译覆盖内容、格式:、术语遵循:开头的结构化元数据块
这些内容源自子代理在 bilingual/ 目录中输出时附带的工作日志,合并阶段若未清理,会随 EPUB/html 打包进入最终交付物。
- 文件路径泄漏:本地路径(
清理 ultra 诊断记录 — 删除 en-zh-max 专属的内部诊断记录(新增于步骤 2.5 和阶段 0/3 的 invoke 产出),包括:前景化标注列表、文学反释义判断记录、西化六维评估的逐项评分、准确性六维校验的严重等级标记。这些不进入最终交付文件。
机械执行(强制脚本——与阶段 6 标点脚本同级强制力):
python3 "$SKILL_DIR/scripts/strip-version-markers.py" "<名称> 翻译(中英对照).md"
脚本自动完成上述六项操作并输出统计。脚本跑完 ≠ 门禁通过——还需执行以下六项 grep 验证(六项均须通过):
# 验证 1:版本标记残留必须为 0
grep -cE '\[v[123]' "<名称> 翻译(中英对照).md" && echo '❌ 版本标记残留!' || echo '✅ 版本标记已清零'
# 验证 2:text-profile 必须已删除
grep -c 'text-profile' "<名称> 翻译(中英对照).md" && echo '❌ text-profile 残留!' || echo '✅ text-profile 已删除'
# 验证 3:译者署名必须存在
grep -c '译者:Lilipuut' "<名称> 翻译(中英对照).md" && echo '✅ 译者署名已添加' || echo '❌ 译者署名缺失!'
# 验证 4:子代理流程残留必须为 0(检查常见泄漏模式)
echo '=== AI 流程残留扫描 ==='
LEAKS=$(grep -cE '翻译(完成|已就绪|已处理|已更新)|C:\\\\(Users|盘)|chunk[_.]|以上为.*完整(翻译|中英对照)|译文已整合|翻译覆盖内容|术语遵循:' "<名称> 翻译(中英对照).md" 2>/dev/null || echo 0)
if [ "$LEAKS" -gt 0 ]; then echo "❌ 发现 $LEAKS 处 AI 流程残留!"; else echo '✅ AI 流程残留 = 0'; fi
# 验证 5:ultra 诊断记录清理确认(人工目视检查以下模式不存在)
echo '=== ultra 诊断记录目视检查 ==='
grep -ciE '前景化标注|反释义判断|西化六维评分|准确性六维等级' "<名称> 翻译(中英对照).md" 2>/dev/null && echo '⚠ 可能存在 ultra 诊断残留,请目视确认' || echo '✅ ultra 诊断记录已清理'
⚠ 任一项验证失败 = 门禁未通过。 退回修复后重跑脚本 + 重验,直到五项全部通过。
步骤 8B — 派生交付物
⚠ 准入: 步骤 8A 五项 grep 验证全部通过。 ✅ 准出: HTML 已生成 + EPUB/MOBI(全文翻译时按需)。
以下输出基于清理后的最终译文。 步骤 8A 已完成版本标记剥夺 + AI 标记删除 + 译者署名添加 + AI 流程残留清理 + ultra 诊断记录清理,本步骤从中派生 HTML/EPUB/MOBI。
按下方格式逐段配对:
英中对照输出格式
按段落配对:英文原段作为 blockquote,紧接中文译文。
> It is a truth universally acknowledged that a single man in possession of a
> good fortune must be in want of a wife.
凡是有钱的单身汉,总想娶位太太,这是一条举世公认的真理。
规则:
- 中文译文用中文全角标点;半角标点只留给英文原文、链接、行内英文词句、数字缩写、代码(详见阶段 6,落盘后用脚本自检)。
- 只清理提取噪声(接回断行连字符、删页眉页脚页码),不要从中文反推英文。
- 标题作中文
##/###,不加 blockquote;可选地把英文标题作为上一行 blockquote。 - 不该被脚本删掉、需保留进全中文版的东西(图片、表格、标题块)不要 blockquote。
- 公式/代码用共享代码块,不按语言重复。
润色边界 ★(防止方法论被用过头)
叶子南本人警告的三个反模式,务必守住:
- 不要过度归化:别为了"地道"抹掉原文该保留的风格、术语精度、文化标记。西化是一个连续体,可接受度随文本价值变化——硬文本/永久价值文本能容纳更多异化(见
references/translationese-symptoms.md第七节)。 - 不要堆砌四字成语:音韵节奏是手段不是目的,为文字而文字会显得卖弄、失真。
- 文学翻译不要释义:释义(paraphrase)是文学翻译的大敌——尽量保留原文语言形式(第十四章)。
- 拿不准"该改到多狠"时,回到阶段 0 的档位:自由度越低,越克制。最终仲裁者永远是读者中心——问自己:「在这个语境下,读者需要看到什么?」
示例
输入(英文):
The confidence that the West would remain a dominant force in the 21st century is giving way to a sense of foreboding.
输出(英中对照;阶段 0 判定:偏硬/政论,自由度≈3,准确优先、克制音韵):
The confidence that the West would remain a dominant force in the 21st century is giving way to a sense of foreboding.
西方曾笃信自己将在 21 世纪稳居主导地位,如今这份自信,正让位于一种隐隐的不祥之感。