任务单:《汉英翻译教程》背诵清单修复与补全

本任务单为自包含工作说明书,执行 Agent 无需任何前置对话上下文。
工作目录:D:\BaiduNetdiskDownload\MTI(Obsidian vault,以下路径均相对此目录)。


一、任务背景(为什么做这件事)

用户备考 2027 山东大学 MTI(055101),357 翻译基础第一篇(50 分)的选材参考”理解当代中国”系列教材。已核实的情报:2026 年真题从《汉英翻译教程》《高级汉英翻译教程》各抽一段连续课文作为汉译英考题。备考策略为”精读 → 背诵 → 默写”,考前背 5 遍。

vault 内已有 12 个单元的”知识清单”(词条 + 典范例句),但存在 OCR 乱码、水印污染、中文句丢失三类缺陷(见第四节实测样例),且缺少”完整段落”这一考试实际形态。本任务的目标:产出 12 份干净、完整、可直接背诵的单元背诵清单,使用户无需翻阅原书即可开展背诵。

二、范围

  • 在范围内:《汉英翻译教程》(学生用书,246 页,12 单元)对应的 12 份背诵清单。
  • 不在范围内:《高级汉英翻译教程》(扫描版无文本层,需 OCR,另立任务);Understanding_NOTES 讲义;任何形式的翻译练习或批改。

三、输入材料

文件角色注意事项
99_教材清单_碎片整理/理解当代中国/知识清单/U01-02_核心词条与典范例句.md 及 U03_…md ~ U12_…md(共 11 个 md,覆盖 12 单元)修复对象(旧知识清单)带伤,详见第四节
99_教材清单_碎片整理/理解当代中国/知识清单/U01-02_知识清单.pdf、U03_知识清单.pdf ~ U12_知识清单.pdf、U05_背诵清单.pdf旧清单的 PDF 原件水印(“小万大学教育科学与考试研究院”)即来源于此,仅作对照
99_教材清单_碎片整理/理解当代中国/汉英翻译教程.md中文原文权威来源(学生用书全文 md)每单元结构:核心概念解读 → 关键语句理解与翻译 → 重点段落分析与翻译 → 翻译实践。该文件曾修复 20 处 NUL 坏字节,其中 6 处为中置信度语义重建(位置 03/05/06/08/14/15),逐字存疑时对照 汉英翻译教程.pdf
99_教材清单_碎片整理/理解当代中国/汉英翻译教程.pdf学生用书 PDF 原件终极核对基准
99_教材清单_碎片整理/理解当代中国/汉英翻译教程_教师用书.md / .pdf段落层素材来源仅覆盖 U3–U12(无 U1–U2)。每单元含:核心概念中英文汇总表、关键语句理解与翻译、重点段落分析与翻译(含参考译文与策略分析)
99_教材清单_碎片整理/理解当代中国/汉英翻译教程_术语整理表.md交叉参考与旧知识清单同源、同样带伤,不得作为底本
99_教材清单_碎片整理/理解当代中国/知识清单/U05_坚持以人民为中心的发展思想.md格式参照旧清单中结构最规范的一份(但同样带伤)

四、已知缺陷样例(已实测核实)

  1. OCR 乱码 / 水印残留(U01-02):“南渡""渡泽""南液""南渡湾”等无意义词嵌入正文;页脚残留”第X页共4页小万大学教育科学与考试研究院”。
  2. 英文缺空格 / 拼写粘连(U01-02):thecore socialist values、socialism withChinese characteristics、5,oo0 years(应为 5,000)。
  3. 中文错别字(U01-02):“广衰土地”(应为”广袤”)、“磅之力”(应为”磅礴之力”)。
  4. 中文原句整体丢失(U05):例句 3/4/5 的【汉语原文】被水印文字”小万大学教育科""小万大学教育科学与万向研究院""小”替换,只剩英文译文。修复方法:用英文译文在 汉英翻译教程.md 全文检索定位,找回中文原句。
  5. 其他单元清单未逐一排查,执行时须按第七节验收标准全量过筛。

五、输出规格

  • 位置:新建目录 99_教材清单_碎片整理/理解当代中国/背诵清单/,输出 U01_背诵清单.md ~ U12_背诵清单.md 共 12 份(U01、U02 拆开成两份)。不得覆盖或修改 知识清单/ 下任何旧文件。
  • frontmatter(参照 vault 既有风格):
---
title: "Unit 0X 背诵清单|单元主题"
unit: "Unit 0X"
subject: "357 翻译基础"
source: "理解当代中国·汉英翻译教程"
tags:
  - 357/理解当代中国
  - 背诵清单
---
  • 正文三层结构(每份清单必须三层齐全):
层内容来源
一、核心术语中英对照表格(序号|中文|官方译文),修复乱码与缺空格后收录旧清单 + 教师用书核心概念汇总表(U3–U12)
二、典范例句编号例句,每句【汉语原文】+【参考译文】完整对照旧清单(修复后)+ 教师用书关键语句
三、重点段落每单元 1–2 个完整段落,中英逐段对照(这是考试抽段的实际形态,旧清单完全缺失此层)U3–U12:教师用书”重点段落分析与翻译”,与学生用书核对原文;U1–U2:教师用书未覆盖,从学生用书课文圈选 1–2 段,并在段落后标注 (本段为执行者自圈,教师用书无覆盖)
  • 每条/每段末尾用 HTML 注释标注出处,格式:<!-- 来源:学生用书U5重点段落 / 教师用书U5关键语句第2句 -->。出处信息仅供核对,不影响背诵阅读。

六、工作流(逐单元执行)

  1. 读旧清单 + 对应 PDF,列出该单元缺陷清单(乱码 / 水印 / 缺中文 / 缺空格 / 错别字)。
  2. 修复词条层与句子层:缺中文的句子用英文译文在 汉英翻译教程.md 全文反查定位,找回中文原句;乱码对照 PDF 原件修正。
  3. 提取段落层:从教师用书 md 取该单元重点段落(U3–U12),与学生用书核对一致;U1–U2 直接从学生用书课文圈选。
  4. 组装新清单(按第五节规格),写入 背诵清单/ 目录。
  5. 自检:跑第七节全部机检项 + 每单元抽检 5 条出处。
  6. 记录:在每份清单末尾附”修复记录”小节(修复了哪几处、哪些条目存疑)。

七、验收标准

机检(全量,必须全部通过):

  • 对 12 份新清单全文搜索,以下模式命中数必须为 0:南渡、渡泽、南液、南湾、小万大学、考试研究院、第\d+页共\d+页。
  • 英文不得出现小写字母与大写字母直接粘连的缺空格模式(如 thecore、withChinese),可用正则 [a-z][A-Z] 初筛后人工确认。
  • 不得出现 【汉语原文】 后内容为水印文字或长度 < 10 字的条目(U05 例句 3/4/5 类缺陷)。

抽检(每单元):

  • 随机抽 5 条(词条或句子),中文必须能在学生用书或教师用书中找到出处;找不到出处的不得收录,标注 【原文缺失,待人工核对】 后置于清单末尾。
  • 重点段落必须中英完整对照,段落连续、非单句拼接。

数量验收: 12 份清单,每份三层齐全。

八、分批交付

批次单元说明
第 1 批U1–U4优先交付,对齐用户当前备考周(W1)目标
第 2 批U5–U8第 1 批验收通过后开始
第 3 批U9–U12第 2 批验收通过后开始

每批完成后向用户汇报:本批修复缺陷数量、存疑条目清单、自检结果。不要一口气做完 12 个单元再交付。

九、红线(不可违反)

  1. 不得创作内容:所有中文、英文都必须出自学生用书 / 教师用书 / 旧清单修复。绝对禁止用英文译文回译中文来”补全”丢失原句——找不到就出处标注待核。
  2. 不得修改旧文件:知识清单/ 目录、术语整理表、两本教程 md 均只读。
  3. 不得扩大范围:不做《高级汉英翻译教程》,不做翻译讲解或策略批注(教师用书的策略分析不入清单,清单只留可背诵的双语本体)。
  4. 逐字存疑处(学生用书 md 有 6 处中置信度语义重建,位置 03/05/06/08/14/15)必须对照 PDF 原件。

十、执行环境

  • 操作系统 Windows,文件均为 UTF-8 Markdown;PDF 可直接用 Read 工具读取。
  • 全文检索建议用 Grep 工具(ripgrep),路径用绝对路径。
  • 完成后输出一份总的执行报告(Markdown),列出:每单元修复缺陷明细、存疑条目、机检结果、交付文件清单。