znlgis 博客

GIS开发与技术分享 — GDAL · GeoServer · PostGIS · QGIS · OpenLayers · Cesium · FreeCAD · NPOI

第05章:翻译工作区

产品官网https://shandianweihu.com/


5.1 本章概述

在前一章中,我们详细讲解了如何将图纸中的文字提取为翻译会话文件(.tw 文件)。提取完成之后,便进入了同文(Tongwen)工作流中最核心的阶段——在翻译工作区中完成文字的翻译、校对与审批。

翻译工作区是同文翻译引擎与人机协作的交汇点。它既不是简单的”输入框+译文栏”的表格工具,也不是全自动的”一键翻译”黑箱——它是一个结合了四层翻译知识系统、内联编辑、质量风险检测、术语约束、置信度评估与批量操作的精细化翻译工作站。本章将系统、详尽地讲解翻译工作区的每一个功能模块、每一个操作细节,以及与翻译质量息息相关的各项机制。

本章在整个工作流中的位置

图纸文字提取(第04章)→ 翻译工作区(本章)→ 回写到图纸 → 质量审查

翻译工作区承上启下——上游接收提取结果,下游为回写提供经过审核的高质量译文。如果把这个工作流比作一条生产线,翻译工作区就是其中最精密、最耗时、也最能决定最终成品质量的核心工位。

本章阅读建议:首次使用者建议通读全章。如果您只关心某个特定功能,也可以使用目录直接跳转到对应章节。第 5.5 节(翻译知识系统)和第 5.7 节(翻译操作流程)是理解整个工作区设计逻辑的关键,建议优先阅读。


5.2 工作区整体布局

打开翻译工作区后,您会看到一个结构清晰的界面。我们首先从整体上认识各个功能区域的位置和作用,后续各节再逐一深入。

5.2.1 布局概览

翻译工作区按照从上到下、从左到右的组织方式,分为以下几个核心区域:

区域位置 区域名称 核心功能
顶部第一行 工具栏(主操作栏) 会话管理(保存/导入/导出)、语言设置、专业选择、翻译触发、批量审批
顶部第二行 工具栏(辅助操作栏) 搜索过滤、状态筛选、清空译文、术语表抽屉、回写模式与执行
中部左侧(主区域) 数据表格 原文/译文列表,支持排序、筛选、内联编辑、多选,是翻译操作的核心交互区
中部右侧(可收起) 详情面板 选中条目的详细信息:对象属性、图层位置、文本样式、QA 风险、术语命中
中部右侧(可收起) 术语表面板 项目术语表的查看、编辑和维护(通过工具栏”术语表”按钮打开)
底部 状态栏 翻译进度统计、当前选中数量、翻译引擎连接状态

5.2.2 界面自适应

翻译工作区支持以下布局调整,以适应不同的屏幕尺寸和工作习惯:

  • 详情面板可收起:当您专注于表格翻译时,可以收起右侧详情面板,让数据表格占据更多横向空间。
  • 列宽可拖拽调整:数据表格中每一列的宽度都可以通过拖拽列边界自由调整,收起不常用的列(如”句柄”)以获得更大的译文编辑空间。
  • 列序可排序:点击列标题可按该列排序(升序/降序切换),方便按图层、状态或置信度集中查看某类条目。
  • 窗口大小自适应:整体界面随窗口大小自动调整,支持全屏模式下的沉浸式翻译。

5.2.3 快速识别各区域

首次打开翻译工作区时,您可以按以下顺序快速定位:

  1. 先看顶部两行工具栏——这是所有操作的起点。
  2. 再看中间占据最大面积的数据表格——这是您的主要工作区域。
  3. 点击表格中任意一行,观察右侧是否出现详情面板——这是辅助决策的信息区。
  4. 最后看底部状态栏——它告诉您当前的翻译进度和引擎状态。

5.3 工具栏第一行详解(主操作栏)

工具栏第一行承载了最核心的操作功能,从左到右依次排列。下面逐一详细说明。

5.3.1 💾 保存

功能:将当前所有翻译数据(包括已编辑的译文、审批状态等)保存到 .tw 翻译会话文件中。

操作:点击”保存”按钮即可。

详细说明

翻译工作区中的数据修改——无论是您手动输入的译文、AI 翻译的结果、还是审批状态的变更——首先保存在内存中。点击”保存”按钮后,这些修改才会被持久化写入磁盘上的 .tw 会话文件中。

保存的内容包括

  • 每一条原文及其对应的译文(含来源标记)
  • 每条译文的置信度评分
  • 每条译文的审批状态(待翻译/已翻译/已回写/失败)
  • 翻译记忆(TM)中新增的匹配对
  • 人工修正记忆(CM)中记录的编辑覆盖

使用建议

  • 养成频繁保存的习惯。虽然部分操作会自动触发保存,但手动保存是最可靠的保障。
  • 在以下操作前务必保存:关闭翻译工作区、发起回写、切换任务。
  • 快捷键提示:保存操作通常绑定有键盘快捷键(如 Ctrl+S),可在菜单中查看具体绑定。

保存失败的处理

如果保存时提示”保存失败”,常见原因包括:

  • .tw 文件所在目录没有写入权限。
  • .tw 文件被其他程序锁定(如在另一个同文窗口中打开了同一文件)。
  • 磁盘空间不足。

解决方法:检查上述条件后重试。


5.3.2 📥 导入

功能:导入一个已有的 .tw 翻译会话文件,将其内容加载到当前翻译工作区中。

操作

  1. 点击”导入”按钮。
  2. 在弹出的文件选择对话框中,浏览到目标 .tw 文件所在路径。
  3. 选中文件,点击”打开”。
  4. 导入完成后,工作区会自动刷新,显示导入的翻译数据。

应用场景

场景 说明
继续之前的翻译 之前保存的翻译会话,重新打开继续工作。
合并外部翻译结果 翻译人员 A 在离线环境中完成了部分翻译,将 .tw 文件交给翻译人员 B 合并入主会话。
复用历史翻译 类似项目的历史翻译会话,导入后可作为参考或通过 TM 匹配加速当前翻译。
跨机器协作 .tw 文件从一台计算机拷贝到另一台,导入后继续工作。

注意事项

  • 导入操作会将文件中的翻译数据追加到当前会话中。如果存在相同的条目(通过句柄匹配),系统会提示您选择覆盖或保留。
  • 导入的 .tw 文件不会自动与原始 DWG 图纸关联,如果后续需要回写,请确保在当前项目中正确配置了源图纸路径。
  • .tw 文件是同文的专有格式,无法用其他软件打开。如果需要与外部工具交换数据,请使用”导出”功能(见 5.3.3 节)。

5.3.3 📤 导出

功能:将当前翻译会话导出为一个独立的 .tw 文件,用于备份、分发或跨项目复用。

操作

  1. 点击”导出”按钮。
  2. 在弹出的保存对话框中,选择目标文件夹并输入文件名。
  3. 点击”保存”。
  4. 导出完成后,指定路径下会生成一个 .tw 文件。

导出内容

导出的 .tw 文件包含当前会话的完整快照:

  • 所有原文和译文(包括已翻译和待翻译的条目)。
  • 每条译文的来源、置信度、审批状态。
  • 与翻译记忆(TM)匹配的信息。

使用场景

场景 说明
数据备份 定期导出 .tw 文件到备份目录或云存储,作为灾难恢复的手段。
离线翻译 翻译人员在没有安装同文的计算机上,可以通过其他工具编辑译文(虽然不推荐),或者将文件转交给有同文环境的同事使用。
版本管理 翻译过程中的关键里程碑(如”初审完成”、”终审完成”)导出独立副本,便于追溯。
交付审校 将翻译结果导出为 .tw 文件,交付给审校人员在另一台计算机上打开审阅。

与”保存”的区别

操作 保存 导出
目标 覆盖当前关联的 .tw 文件 生成一份新的独立 .tw 文件
路径 固定在项目目录中 用户自由选择
用途 日常工作保存 备份、分发、版本归档

5.3.4 源语言下拉框

功能:选择当前图纸中文字的原始语言。

操作:点击下拉框,从 26 种语言中选择一项。

可选的 26 种语言(按常见程度排列):

序号 语言 英文名
1 中文(简体) Chinese (Simplified)
2 中文(繁体) Chinese (Traditional)
3 英语 English
4 日语 Japanese
5 韩语 Korean
6 法语 French
7 德语 German
8 西班牙语 Spanish
9 葡萄牙语 Portuguese
10 俄语 Russian
11 阿拉伯语 Arabic
12 意大利语 Italian
13 荷兰语 Dutch
14 波兰语 Polish
15 土耳其语 Turkish
16 越南语 Vietnamese
17 泰语 Thai
18 印度尼西亚语 Indonesian
19 马来语 Malay
20 印地语 Hindi
21 孟加拉语 Bengali
22 乌尔都语 Urdu
23 波斯语 Persian
24 斯瓦希里语 Swahili
25 希伯来语 Hebrew
26 希腊语 Greek

重要说明

  • 源语言设置直接影响大模型翻译的质量。大模型需要知道原文是什么语言,才能正确理解语义并生成翻译。
  • 如果源语言设置错误(例如,原文是英文但设置为中文),翻译引擎会产生完全错误的结果。
  • 在创建翻译任务时通常已经设置了语言对,但您可以在工作区中随时调整(例如,发现图纸中实际混合了中英文)。

5.3.5 → 方向指示

功能:直观展示当前的翻译方向(从源语言到目标语言)。

说明

这是一个静态的视觉指示器,位于源语言和目标语言下拉框之间,以箭头符号(→)表示翻译方向。它不是可操作的元素,仅用于让用户快速确认当前的翻译方向配置。


5.3.6 目标语言下拉框

功能:选择译文的目标语言。

操作:点击下拉框,从 26 种语言中选择一项(与源语言相同的 26 种语言)。

重要说明

  • 目标语言与源语言必须不同。如果选择了相同的语言,翻译引擎将不会产生有意义的输出。
  • 如果翻译任务需要多语种输出(例如同一张图纸需要同时生成英文版和日文版),建议创建两个独立的翻译任务,分别设置不同的语言对。

5.3.7 专业下拉框

功能:选择翻译的专业领域,使大模型在翻译时采用该领域的专业术语和表达习惯。

操作:点击下拉框,从以下选项中选择一项:

选项 说明
全部 通用翻译模式,不限定专业领域。适用于图纸中内容涵盖多个专业,或您不确定该选择哪个专业的情况。
建筑 建筑专业(Architecture)。适用于建筑平面图、立面图、剖面图、门窗表、建筑说明等。术语偏重建筑构件、空间名称、材料做法等。
暖通给排水电气(MEP) 暖通(HVAC)、给排水(Plumbing)、电气(Electrical)三大机电专业的合并选项。适用于风管图、水管图、电气系统图、设备表等。术语涵盖管道、阀门、风口、配电、线缆等。
结构 结构专业(Structural)。适用于结构平面图、配筋图、节点详图、结构设计说明等。术语涵盖混凝土、钢筋、型钢、基础、荷载等。
材料 材料与设备专业(Materials)。适用于材料表、设备清单、规格说明等。术语涵盖各类工程材料的名称、规格、等级、标准号等。

专业选择对翻译的影响

选择正确的专业对翻译质量有显著影响。举一个典型例子:

  • 原文:”柱子”
  • 选择”全部”:可能翻译为 “pillar”(通用含义)
  • 选择”建筑”:翻译为 “column”(建筑专业术语)
  • 选择”结构”:翻译为 “column”(与建筑相同,但会搭配更准确的上下文术语)

更关键的是多义词的处理:

  • 原文:”管井”
  • 选择”全部”:可能翻译为 “tube well”(不准确)
  • 选择”MEP”:翻译为 “pipe shaft”(准确的机电术语)

使用建议

  • 如果图纸明确属于某个专业,务必选择对应的专业选项。
  • 如果一张图纸中同时包含建筑和结构内容(如建筑结构平面图),可以先选择主要专业完成翻译,再切换到另一专业对剩余条目进行针对性翻译。
  • “全部”模式下的翻译质量通常不如指定专业模式,建议在能确定专业时尽量指定。

5.3.8 ▶️ 翻译未翻项

功能:对当前工作区中所有译文为空的条目,批量执行大模型(LLM)翻译。

操作

  1. 确认源语言、目标语言、专业选择已正确设置。
  2. 点击”翻译未翻项”按钮。
  3. 系统开始遍历所有译文为空的条目,逐一调用大模型进行翻译。
  4. 翻译过程中,数据表格会实时更新——译文列从空白变为填充状态,置信度列显示评分,来源列标记为”AI 翻译”(蓝色标签)。
  5. 翻译完成后,底部状态栏更新统计数据。

详细工作机制

当您点击”翻译未翻项”时,系统执行的并不是一次简单的”把原文丢给 AI,拿回译文”的操作。实际过程如下:

对于每一条待翻译的原文,系统按照四级翻译知识优先级依次查找(详见 5.5 节):

  1. 优先查找人工修正记忆(CM):如果该原文(或高度相似的原文)之前被您手动修改过,系统优先返回您曾经修改后的版本。
  2. 其次查找翻译记忆(TM):如果 CM 中没有,查找审批通过的历史翻译记录。匹配阈值通常为 100% 精确匹配或高相似度匹配(如 95% 以上)。
  3. 再次匹配术语表(Glossary):如果 TM 也没有命中,系统会在术语表中查找与该原文匹配的术语,并在翻译时强制使用术语表中定义的译法。
  4. 兜底调用大模型(LLM):如果以上三个层面都没有命中,系统最终调用 DeepSeek v4 大模型进行翻译,并将术语表中匹配到的术语作为约束条件传入,确保关键术语的翻译一致性。

以此机制,系统在翻译时会自动利用已有的知识积累,而不是每次都从零开始翻译。

翻译进度与中断

  • 翻译过程中,进度条会显示当前处理到第几条、共多少条。
  • 您可以随时点击“停止”按钮(翻译开始后,原来的”翻译未翻项”按钮会变为”停止”按钮)来中断翻译。已翻译完成的条目会保留,未翻译的条目保持空白状态。
  • 中断后可以再次点击”翻译未翻项”继续——系统会自动跳过已有译文的条目,只处理空白条目。

使用建议

  • 在首次翻译前,务必确认语言和专业设置正确。设置错误后再修改,需要手动清除已翻译的条目才能重新翻译。
  • 如果有重要的术语需要统一,建议先导入术语表(见 5.4.5 节),再执行”翻译未翻项”。这样大模型在翻译时会自动遵循术语约束。
  • 对于大型图纸(上千条文字),翻译过程可能需要几分钟。这是正常现象,因为每条翻译都需要调用大模型 API。

5.3.9 ✅ 审批选中(N)

功能:将当前在数据表格中勾选(☐)的条目,批量标记为”已审批”状态。

操作

  1. 在数据表格中,勾选需要审批的条目(勾选第一列的 ☐ 复选框)。
  2. 点击”审批选中”按钮。
  3. 被勾选的条目状态变为”已翻译”(即已审批通过)。
  4. 按钮上的 [N] 数字会更新,显示当前勾选的数量。

什么是”审批”

在翻译工作流中,”审批”是一个关键的质量控制动作。它表示您(或审校人员)已经人工确认该条译文正确、可用,可以放心地回写到图纸中。

审批操作的影响:

  • 状态变更:条目从”待翻译”变为”已翻译”(审批通过)。
  • TM 积累:审批通过的译文会自动加入翻译记忆库(TM),供后续翻译复用。
  • 质量标识:审批通过意味着该译文经过了人工验证,质量有保障。

按钮上的 N 数字

按钮上的数字 N 实时反映当前勾选的条目数量,让您在点击之前就能确认批量操作的范围,避免误操作。

审批的最佳时机

  • 在翻译和校对完成后,逐条或批量审批。
  • 不要在大模型刚翻译完就立即全部审批——大模型的翻译虽然质量高,但在工程领域仍然可能出现不准确的情况,必须先人工检查。

5.4 工具栏第二行详解(辅助操作栏)

工具栏第二行提供搜索、筛选、清空、术语管理和回写等辅助功能。

5.4.1 🔍 搜索框

功能:通过关键词实时过滤数据表格中的条目。

操作

  1. 在搜索框中输入关键词(支持中文、英文、数字、特殊字符)。
  2. 数据表格会实时更新,只显示匹配的条目。不需要按回车或点击搜索按钮——键入即搜。
  3. 清空搜索框即可恢复显示全部条目。

搜索范围

搜索框会同时匹配以下三个字段:

匹配字段 说明 示例
原文 匹配原始文字内容 输入”混凝土”,匹配所有原文中包含”混凝土”的条目
译文 匹配翻译后的文字内容 输入”concrete”,匹配所有译文中包含”concrete”的条目
ID 匹配唯一标识符 输入某个句柄值,精确定位到某一条

搜索技巧

需求 操作
查找所有包含”钢筋”的原文 搜索框中输入”钢筋”
查找所有翻译结果中包含”beam”的条目 搜索框中输入”beam”
定位某条特定记录 如果知道句柄或 ID,直接输入
查找漏翻的术语 在原文中搜索某个术语,然后检查对应译文中是否正确翻译
查找翻译风格不一致的条目 例如,搜索”柱子”,检查不同条目中是否统一翻译为”column”

搜索与其他筛选的关系

搜索框与状态筛选(见 5.4.2 节)是叠加生效的。例如,状态筛选选择”待翻译”,同时在搜索框中输入”钢筋”,则表格只显示原文中包含”钢筋”且当前状态为”待翻译”的条目。这使您可以非常精确地定位到需要关注的目标子集。


5.4.2 状态筛选

功能:按翻译状态过滤数据表格中的条目。

操作:点击状态下拉框,从以下选项中选择一项:

状态选项 筛选结果
全部 不筛选,显示所有条目
待翻译 只显示译文为空、尚未开始翻译的条目
已翻译 只显示已有译文、尚未回写到图纸的条目(含审批通过和未审批的)
已回写 只显示译文已经回写到图纸的条目(即翻译工作已完成闭环的条目)
失败 只显示翻译过程中出现错误的条目(如 API 调用失败、网络超时等)

实际应用场景

场景 推荐筛选
刚开始翻译,需要专注于未翻译的条目 选择”待翻译”
翻译完成,需要逐条检查译文质量 选择”已翻译”
回写完成后,确认哪些条目已经闭环 选择”已回写”
排查翻译过程中出现的错误 选择”失败”

与搜索框的叠加效果

状态筛选与搜索框是叠加关系。例如:

  • 筛选”已翻译” + 搜索”beam” = 查看所有译文中包含”beam”的已翻译条目。
  • 筛选”待翻译” + 搜索”混凝土” = 查看所有原文中含”混凝土”但尚未翻译的条目——这些是需要优先处理的核心术语。

5.4.3 🗑️ 清空所有译文

功能:一键清除当前工作区中所有条目的译文,将它们重置为”待翻译”状态。

操作

  1. 点击”清空所有译文”按钮。
  2. 系统会弹出确认对话框,提示”此操作将清除所有译文,不可恢复,是否继续?”。
  3. 点击”确认”后,所有译文字段清空,状态恢复为”待翻译”。

⚠️ 警告

此操作不可撤销。一旦确认,所有已翻译的内容和审批状态都会丢失。

适用场景

场景 说明
语言或专业设置错误 发现源语言、目标语言或专业设置错误,导致翻译结果全部不正确,需要重新翻译。
术语表大幅更新 术语表进行了大规模修改(增删数百条术语),旧译文中的术语已不准确,需要重新翻译以应用新术语表。
翻译引擎升级 大模型版本升级或切换,翻译质量显著提升,希望重新生成所有译文。
从头开始的试译 对一张新图纸,想先试试不同的专业设置效果,每次清空后重新翻译对比。

使用建议

  • 在执行此操作前,务必使用”导出”功能保存当前会话的备份(见 5.3.3 节)。
  • 如果只是想重新翻译部分条目,不要使用”清空所有译文”,而应该:
    • 使用搜索框定位到目标条目。
    • 手动逐条清空译文(双击进入编辑,按 Delete 清空,按 Enter 确认)。
    • 或使用状态筛选定位后,针对性处理。

5.4.4 📗 术语表 [N]

功能:打开或关闭右侧的术语表抽屉(侧边面板),显示当前项目关联的术语表内容。按钮上的 [N] 数字显示当前术语表中定义的术语数量。

操作

  1. 点击”术语表”按钮,右侧会滑出一个侧边面板(术语表抽屉),显示术语表内容。
  2. 再次点击按钮(或点击抽屉的关闭按钮),术语表抽屉收起。
  3. 按钮上的 N 数字实时显示术语表中词条的总数。

术语表抽屉的内容

术语表抽屉打开后,以表格形式展示当前项目导入的所有术语:

列名 说明
源术语 原文中的术语(如”混凝土”、”钢筋”)
目标术语 规定的中文译法(如”concrete”、”rebar”)
专业 该术语所属的专业领域(建筑/MEP/结构/材料)
匹配模式 精确匹配 / 模糊匹配 / 正则匹配
备注 人工添加的备注信息

术语表的来源

术语表基于 CSV 文件导入和维护。典型的术语表 CSV 格式如下:

源术语,目标术语,专业,备注
混凝土,concrete,结构,
钢筋混凝土,reinforced concrete,结构,
框架柱,frame column,结构,

术语表的作用

术语表是同文翻译知识系统的第三优先级(详见 5.5 节)。当大模型执行翻译时,会收到术语表中匹配到的术语约束——即”遇到这个词,必须翻译成这个词”。这确保了关键术语在整个图纸翻译中的一致性。

操作建议

  • 在首次翻译之前,先导入术语表,再执行”翻译未翻项”。
  • 翻译过程中,可以随时打开术语表抽屉查看当前术语。如果发现某条术语的翻译不合适,可以在术语表中修改,修改后需要重新翻译受影响的条目。
  • 术语表抽屉中的内容与底层的 CSV 文件同步。您可以随时替换或更新 CSV 文件,工作区中会自动反映变化。

5.4.5 回写模式下拉框

功能:选择译文回写到 DWG 图纸时采用的方式。

操作:点击下拉框,从以下三种模式中选择一项:

回写模式 说明 适用场景
创建新图层 在图纸中创建一个新图层(默认图层名包含语言标识,如”TEXT_EN”),将译文写入新图层,原文所在的图层保持不变。 需要双语对照查看;业主或监理要求同时保留原文和译文;审校阶段需要对比。
原位替换 直接用译文覆盖原文。译文替换后,原文信息丢失(不可恢复)。文字的位置、样式、图层保持不变。 最终交付版本,不需要保留原文;出图打印时只需要目标语言版本。
双语追加 在原文字后面追加译文,用分隔符(如” / “或换行符)连接。原文和译文出现在同一个文字实体中。 需要在同一行文字中同时显示原文和译文;标注空间充足,追加译文不会导致文字溢出。

三种模式的详细对比

对比维度 创建新图层 原位替换 双语追加
原文保留 是(在原图层中) 是(在同一实体中)
译文所在图层 新图层(可自定义图层名) 原图层 原图层
文件大小变化 少量增加(新增图层和文字) 几乎不变 少量增加(文字变长)
翻译可逆性 可逆(删除新图层即可恢复) 不可逆 部分可逆(需手动删除追加部分)
排版影响 无影响(两次写,各不影响) 可能影响(译文长度与原文不同,可能造成文字溢出或重叠) 可能影响(追加后文字长度增加,可能超出原有包围盒)
适用阶段 翻译审校、双语交付 终版交付 对照参考

选择建议

  • 初次翻译/试译阶段:建议使用”创建新图层”。这样即使译文有问题,也可以方便地删除译文图层,重新翻译后再次回写,不会对原图造成任何影响。
  • 审校阶段:建议使用”创建新图层”。审校人员可以在 AutoCAD 中逐条对比原文图层和译文图层的内容,快速发现翻译问题。
  • 最终交付:如果交付要求只需要目标语言版本,使用”原位替换”。但在此之前,请务必做好以下检查:
    • 所有译文已经过人工审校和审批。
    • 已导出 .tw 文件作为备份。
    • 已保存原始 DWG 文件的一份副本。
  • 双语对照需求:如果业主或监理明确要求图纸上同时显示中英文(或其他语言对),使用”双语追加”。但需提前评估文字空间是否足够——如果原文字后面空间不足以放置追加的译文,可能导致文字重叠或超出图框。

5.4.6 合并图层 ☑

功能:勾选此项后,回写时会将译文合并到原文所在的同一图层(而非创建独立的新图层)。此选项仅在回写模式为”创建新图层”时有效,用于微调回写行为。

操作:勾选或取消勾选复选框。

详细说明

  • 当回写模式为”创建新图层”时,默认行为是将译文写入一个独立的新图层(例如 TEXT_EN)。
  • 勾选”合并图层”后,译文不再写入独立的新图层,而是直接写入到原文所在的图层中。这样译文和原文处于同一图层,但仍然是两个独立的文字实体——原文不被替换,译文以新实体的形式出现在同一图层。
  • 如果回写模式为”原位替换”或”双语追加”,此选项不生效(因为这两种模式本身就发生在原图层上,不存在”合并到原图层”的概念)。

适用场景

  • 您希望译文的图层归属与原图层的逻辑分组保持一致(例如,建筑标注的译文仍然在建筑标注图层中,而不是集中到一个大的”译文图层”中)。
  • 您不希望在图纸中增加一个额外的图层,使图层列表保持简洁。

不适用场景

  • 您希望译文图层独立,以便于在 AutoCAD 中通过开关图层来一键显示/隐藏所有译文(用于对比查看)。
  • 审校人员需要在 AutoCAD 中通过图层隔离来分别审查原文和译文。

5.4.7 💾 回写到图纸

功能:将当前翻译工作区中已审批通过(状态为”已翻译”)的译文,按照设定的回写模式和合并图层选项,写回到源 DWG 图纸文件中。

操作

  1. 确认回写模式(见 5.4.5 节)和合并图层选项(见 5.4.6 节)已正确设置。
  2. 确认需要回写的条目状态为”已翻译”(审批通过)——只有审批通过的条目才会被回写。
  3. 点击”回写到图纸”按钮。
  4. 系统执行回写操作,进度条显示回写进度。
  5. 回写完成后,成功回写的条目状态变为”已回写”,底部状态栏更新。
  6. 如果过程中有失败,失败条目状态变为”失败”,可在状态筛选中查看失败原因。

回写的前提条件

  • 翻译工作区已与源 DWG 图纸建立关联(通常在提取文字时自动建立)。
  • 源 DWG 图纸文件存在且可访问(路径没有变更、文件没有被移动或删除)。
  • 有足够的磁盘写入权限。
  • 已审批的条目至少有一条。

回写的工作机制

回写操作并不是简单地”把译文写回图纸”。实际过程涉及以下步骤:

  1. 定位目标实体:系统根据每个条目的句柄(Handle)——DWG 文件中实体的唯一标识符——精确定位到图纸中的对应文字实体。
  2. 根据回写模式处理
    • 创建新图层:在指定图层中创建一个与原文实体属性完全相同的副本,将其文字内容替换为译文。原文实体保持不变。
    • 原位替换:直接修改原文实体的文字内容为译文。原文内容被覆盖,不可恢复。
    • 双语追加:在原文字内容的末尾追加译文,以分隔符连接(如 “ / “ 或换行符)。
  3. MText 格式恢复:对于 MText 实体,回写引擎会自动将之前提取时保存的占位符还原为原始格式码。因此,译文会继承原文的字体、颜色、大小、下划线、粗体等全部格式属性。
  4. 保存图纸:所有修改写入 DWG 文件后,自动保存文件。
  5. 更新状态:对于回写成功的条目,更新状态为”已回写”。

回写失败的处理

如果某些条目回写失败,常见原因及处理方法:

失败原因 说明 处理方法
句柄无效 原文实体在图纸中已被删除或修改,句柄不再有效。 在翻译工作台中删除该条目,或重新提取该图纸后进行合并。
文件被占用 DWG 文件正被 AutoCAD 或其他程序打开。 关闭占用程序后重试。
写入权限不足 文件或所在目录没有写入权限。 检查文件权限设置。
译文为空 虽然状态为”已翻译”,但译文实际为空(异常情况)。 为该条目输入译文后重新审批再回写。

回写后的验证

回写完成后,建议立即在 AutoCAD 中打开图纸进行以下检查:

  1. 随机抽查若干条译文,确认其位置、样式、内容均正确。
  2. 如果是”创建新图层”模式,检查新图层中的译文数量是否与工作区中已回写条目数一致。
  3. 检查是否有文字溢出包围盒(译文长度显著大于原文的情况)。
  4. 检查块属性(如图框标题栏)中的译文是否正确显示。

如果发现问题,可以:

  • 在翻译工作区中修改译文,重新审批,再次回写(”原位替换”模式下会覆盖之前的译文)。
  • 如果使用了”创建新图层”模式,可以在 AutoCAD 中直接删除译文图层,修改译文后重新回写。

5.5 翻译知识系统

理解翻译知识系统是理解整个翻译工作区运作机制的关键。同文不是简单地”把每条原文丢给 AI 翻译”,而是构建了一个四级优先级的翻译知识体系,确保翻译质量逐步积累、越来越好。

5.5.1 四级优先级概述

翻译知识系统按优先级从高到低排列如下:

优先级 1 (最高):人工修正记忆 (CM)
    ↓ 未命中
优先级 2:翻译记忆 (TM)
    ↓ 未命中
优先级 3:术语表 (Glossary)
    ↓ 未命中
优先级 4 (最低):大模型 (LLM)

每条翻译请求都会依次经过这四级查找——上级命中则直接返回结果,不再向下级请求;上级未命中则继续向下查找,直到大模型兜底。

下面逐一详解每一级。


5.5.2 优先级 1:人工修正记忆(CM —— Correction Memory)

定义:人工修正记忆记录的是用户在过去手动修改过的译文。当用户在大模型翻译或 TM 匹配的结果上进行了手动编辑后,系统会自动记录”原文→用户最终译文”的对应关系,存入 CM 库。

工作原理

  1. 大模型生成了一条译文(或 TM 匹配了一条历史译文)。
  2. 用户在翻译工作区中手动编辑了这条译文(修改了部分措辞、术语或句式)。
  3. 用户保存会话(或触发自动保存)。
  4. 系统检测到译文被手动修改,将”原文 + 用户修改后的译文”作为一条 CM 记录保存。
  5. 下次翻译时,如果遇到相同或高度相似的原文,CM 优先命中,直接返回用户曾经修改过的译文。

CM 的意义

CM 解决了”AI 翻译在特定语境下反复犯同一个错误”的问题。比如:

  • 原文:”本工程抗震设防烈度为7度”
  • 大模型首次翻译:”The seismic fortification intensity of this project is 7 degrees”
  • 用户手动修正为:”The seismic design intensity for this project is Grade 7”
  • 系统记录此修正,后续所有图纸中出现的”抗震设防烈度为X度”都会自动采用”seismic design intensity … Grade X”的表达方式。

CM 的特点

  • CM 是用户专属的,每台计算机、每个项目的 CM 独立存储,不会自动跨项目共享。
  • CM 的优先级最高——即使 TM 中有不同的翻译,CM 也会覆盖 TM。
  • CM 记录的是精确匹配或高相似度匹配,不是简单的子串匹配。对于”抗震设防烈度为7度”和”抗震设防烈度为8度”,系统会识别为高度相似并命中。

5.5.3 优先级 2:翻译记忆(TM —— Translation Memory)

定义:翻译记忆记录的是审批通过(状态为”已翻译”或”已回写”)的译文。当用户审批通过一条译文后,该译文自动加入 TM 库,供后续翻译复用。

CM 与 TM 的核心区别

对比维度 CM(人工修正记忆) TM(翻译记忆)
触发条件 用户手动编辑了译文 用户审批通过了译文
记录内容 用户修改后的最终版本 审批时的最终版本(可能是 AI 翻译的,也可能是手动修改后审批的)
优先级 最高(第1级) 次高(第2级)
含义 “我之前改过这个” “这个翻译已经通过了质量检查”
生命周期 每次编辑都会创建/更新 CM 记录 每次审批都会创建/更新 TM 记录

TM 的工作原理

  1. 用户在翻译工作区中审批通过了一条译文。
  2. 系统将”原文 → 审批通过的译文”记录存入 TM 库。
  3. 下次遇到相同或高度相似(相似度阈值可配置,默认为 95%)的原文时,TM 命中,直接返回历史审批通过的译文。
  4. 如果 TM 命中的相似度低于 100%,系统会在工作区中标记为”模糊匹配”,并在置信度上给予相应评分。

TM 的意义

TM 使翻译工作具有累积效应——翻译过的越多,需要重新翻译的越少。对于同一个工程项目中的数百张图纸,大量的术语和表述是重复出现的(如”混凝土强度等级”、”钢筋保护层厚度”、”设计依据”等)。TM 逐步积累后,后续图纸的翻译效率会大幅提升。

TM 的管理

  • TM 数据保存在项目的翻译记忆库文件中。
  • 可以导出 TM 库,分享给团队其他成员,实现团队级的翻译记忆共享。
  • 如果发现某条 TM 记录不准确,可以在翻译工作区中手动修改译文后重新审批,新的译文会更新 TM 记录。

5.5.4 优先级 3:术语表(Glossary)

定义:术语表是用户主动定义的术语对译表,以 CSV 文件的形式导入。术语表定义了”某个专业术语必须翻译成什么”,强制约束翻译引擎的输出。

工作原理

  1. 用户准备一个 CSV 格式的术语表文件,包含”源术语”和”目标术语”两列。
  2. 将术语表导入到翻译项目中。
  3. 当大模型执行翻译时,系统首先在术语表中查找原文中出现的术语。
  4. 对于匹配到的术语,系统将术语表中规定的译法作为强制约束传递给大模型。
  5. 大模型在生成译文时,必须使用术语表中规定的译法,不得自行发挥。

术语表的匹配逻辑

  • 精确匹配:原文中出现了与术语表完全相同的字符串。
  • 分词匹配:对于中文,系统会对原文进行分词,然后将每个词与术语表进行匹配。例如,术语表中定义了”混凝土 → concrete”,原文为”混凝土强度等级”,系统识别出”混凝土”这个词后,强制译文中的对应部分使用”concrete”。
  • 大小写不敏感:英文术语的匹配不区分大小写。

术语表的意义

术语表解决了”AI 翻译术语不统一”的问题。在没有术语约束的情况下,大模型可能将同一个术语翻译成多种不同的表达:

  • “混凝土”可能被翻译为 “concrete”、”cement concrete”、”cast-in-place concrete” 等。
  • “框架柱”可能被翻译为 “frame column”、”framed column”、”column of frame”。

通过术语表约束,可以确保关键术语在整个项目的所有图纸中始终使用同一种译法

术语表的优先级

需要注意的是,术语表的优先级低于 CM 和 TM。这意味着:

  • 如果 CM 中已经有一条”混凝土 → cast-in-place concrete”的记录(因为用户在某个特定语境下改过),则 CM 优先命中,术语表中的”混凝土 → concrete”不会生效于该条。
  • 如果 TM 中有一条审批通过的高相似度匹配,TM 优先命中,术语表也不会覆盖。

只有在 CM 和 TM 都未命中的情况下,术语表才会对大模型的翻译产生约束。


5.5.5 优先级 4:大模型(LLM —— Large Language Model)

定义:大模型是翻译知识系统的兜底——当 CM、TM、术语表都没有命中时,系统调用 DeepSeek v4 大语言模型执行翻译。

工作原理

  1. 系统确认前三级均未命中。
  2. 构建翻译请求,包含以下信息:
    • 原文内容。
    • 源语言和目标语言标识。
    • 专业领域标识(建筑/MEP/结构/材料)。
    • 术语表中匹配到的术语约束列表(如存在)。
  3. 将请求发送至 DeepSeek v4 API。
  4. 大模型返回译文。
  5. 系统将译文填充到工作区中,标记来源为”AI 翻译”(蓝色标签),并给出置信度评分。

大模型翻译的特点

  • DeepSeek v4 作为底座模型,具备出色的中英双向翻译能力和工程领域知识储备。
  • 专业上下文感知:通过传入专业领域标识(如”MEP”),大模型会采用该领域的专业表达习惯。
  • 术语约束遵循:通过传入术语约束,大模型在生成译文时会强制使用指定的术语译法。
  • 格式感知:对于包含特殊工程符号的文本(如 φ、±、°),大模型会保留这些符号,仅翻译文字部分。

大模型的局限性(需要人工校对的根本原因):

尽管大模型翻译质量很高,但在工程图纸翻译中仍可能存在以下问题:

  1. 上下文缺失:大模型只能看到单条文本,无法了解该文本在图纸中的具体位置和上下文(例如,一个”柱子”标注是建筑柱还是结构柱,大模型无法区分)。
  2. 歧义处理不足:工程图纸中的缩写、简写、行业黑话可能被大模型误译。
  3. 格式约束:虽然大模型可以处理常见工程符号,但对于复杂的 MText 内嵌格式,可能无法完全正确处理。
  4. 一致性:对同一类表述,大模型在不同条目中可能采用不同的表达方式(这正是术语表要解决的问题)。

因此,大模型翻译的结果需要人工校对后才能审批通过。不应跳过人工校对的环节。


5.5.6 四级系统的协同工作示例

下面通过一个完整的示例,演示四级翻译知识系统是如何协同工作的。

场景:用户正在翻译一张建筑结构图纸,原文中有一条”混凝土强度等级为C30”。

第1步:系统检查 CM

  • 查找 CM 中是否有”混凝土强度等级为C30”(或高度相似的原文)对应的手动修改记录。
  • 假设用户在翻译另一张图纸时,将大模型翻译的 “The concrete strength grade is C30” 手动改成了 “Concrete Strength Grade: C30”。
  • CM 命中,系统直接返回 “Concrete Strength Grade: C30”,流程结束。
  • 用户看到这条译文,确认无误,直接审批通过。

第2步(如果 CM 未命中):系统检查 TM

  • 查找 TM 中是否有”混凝土强度等级为C30”(或高度相似)的审批通过记录。
  • 假设 TM 中有一条相似度 97% 的记录:”混凝土强度等级为C25 → Concrete Strength Grade: C25”。
  • TM 模糊匹配命中(相似度 97%),系统返回 “Concrete Strength Grade: C30”(将 C25 替换为 C30),置信度标记为 97%。
  • 用户检查后确认无误,审批通过。

第3步(如果 CM 和 TM 都未命中):系统检查术语表

  • 术语表中定义了:”混凝土 → concrete”、”强度等级 → strength grade”。
  • 术语匹配命中(原文中包含这两个术语)。
  • 系统将术语约束 {"混凝土": "concrete", "强度等级": "strength grade"} 传递给大模型。

第4步(兜底):大模型翻译

  • 大模型接收到原文”混凝土强度等级为C30”和术语约束。
  • 大模型生成译文:”Concrete strength grade is C30”。
  • 系统标记来源为”AI 翻译”,置信度 85%(因为大模型无法 100% 确定这是最优表达)。
  • 用户在翻译工作区中看到译文后,将其手动修改为 “Concrete Strength Grade: C30”(标题化、加上冒号,更符合图纸标注习惯)。
  • 用户保存——此时系统自动在 CM 中记录这条修改。
  • 用户审批通过——此时系统自动在 TM 中记录这条译文。

从此以后,所有图纸中出现的”混凝土强度等级为C30”和类似表述,都会在 CM 或 TM 层面直接命中,不再需要大模型重新翻译。


5.6 数据表格操作

数据表格是翻译工作区的核心交互组件,占据界面最大的面积。以下逐一讲解表格的每一列和每一项操作。

5.6.1 数据表格的各列说明

从左到右,数据表格包含以下列:

列序号 列名 说明 交互方式
1 ☐ 复选框 用于勾选/全选条目,配合批量操作(如批量审批)。 点击复选框勾选/取消。表头复选框为全选/取消全选。
2 原文 从图纸中提取的原始文字(只读)。 不可编辑。可点击排序。
3 译文 翻译后的目标语言文字。 双击进入编辑模式,输入译文后按 Enter 或点击其他位置确认。
4 置信度 翻译引擎对该译文质量的信心评分(0%~100%)。 只读。色标显示(绿/黄/红)。可点击排序。
5 状态 当前条目的翻译流程状态。 只读。可点击排序。可配合工具栏筛选。
6 风险 QA 质量风险等级。 只读。表示该译文在自动质量检查中发现的问题等级。
7 来源 译文的来源标识(谁/什么生成了这条译文)。 只读。彩色标签显示。
8 对象类型 原文在 DWG 中的实体类型。 只读。可点击排序。
9 图层 原文在 DWG 中所属的图层名称。 只读。可点击排序。
10 ID 实体在 DWG 中的唯一标识符(句柄Handle)。 只读。用于精确定位。

5.6.2 排序操作

操作:点击任意列的列标题,表格即按该列排序。再次点击同一列,切换升序/降序。

排序的实际应用

排序目标 操作 用途
按置信度排序(升序) 点击”置信度”列标题 将低置信度的条目排在最前面,优先人工校对
按状态排序 点击”状态”列标题 将”待翻译”条目集中在一起,方便批量翻译
按图层排序 点击”图层”列标题 按图层分组查看,例如只看”建筑-标注”图层的所有文字
按对象类型排序 点击”对象类型”列标题 分别查看 DBText、MText 和 AttributeReference,不同类型可能需要不同的校对策略

排序状态指示

  • 列标题旁会出现 ▲(升序)或 ▼(降序)箭头指示当前排序方向。
  • 排序是单列的——不支持多列组合排序。需要组合筛选时,请结合搜索框和状态筛选使用。

5.6.3 复选框与多选操作

功能:通过勾选复选框来选择多条条目,用于批量操作(如批量审批)。

操作方式

操作目标 操作方法
勾选/取消单条 点击该行第一列的 ☐ 复选框
全选当前显示的所有条目 点击表头(列标题行)的 ☐ 复选框
取消全选 再次点击表头复选框(当所有条目已选中时)

批量操作关联

勾选的条目可以配合以下工具栏按钮使用:

  • “审批选中(N)”:将勾选的 N 条条目批量标记为”已审批”状态。

注意事项

  • 勾选状态是跨筛选保持的。例如,您在”全部”筛选下勾选了 5 条,然后切换到”待翻译”筛选,那些被勾选但不在当前筛选范围内的条目仍然保持勾选状态。
  • 全选操作只选中当前筛选/搜索条件下可见的条目,不会选中被筛选隐藏的条目。

5.6.4 内联编辑译文

功能:在数据表格中直接双击编辑译文,无需打开额外的编辑窗口。

操作步骤

  1. 在数据表格中,定位到需要编辑的条目。
  2. 双击”译文”列的单元格。
  3. 单元格进入编辑模式(显示输入光标,单元格高亮)。
  4. 输入或修改译文内容。
  5. Enter 键确认编辑(或点击表格中其他任意位置也可确认)。
  6. Esc 键取消编辑(恢复为编辑前的内容)。

编辑后的自动处理

  • 当您修改了由大模型(LLM)或翻译记忆(TM)生成的译文后,系统会自动在人工修正记忆(CM)中记录此次修改(详见 5.5.2 节)。
  • 来源(来源列)会自动更新为”手动编辑”(绿色标签),表示该译文经过人工修改。
  • 如果该条目此前已经审批通过,修改后状态可能会发生变化(取决于具体版本的逻辑,通常需要重新审批)。

编辑技巧

需求 操作
快速将整列中相同的术语替换 先搜索定位,再逐条编辑。批量替换功能(如有)可在详情面板或右键菜单中查找。
复制某条译文到另一条 选中源条目的译文字段,Ctrl+C 复制,然后双击目标条目,Ctrl+V 粘贴。
查看编辑前的原文 原文列始终可见,无需切换视图。
编辑时参考上下文信息 在编辑某条译文时,点击该行后右侧详情面板会显示该条目的所有上下文信息(图层、位置、对象类型等),辅助判断。

5.6.5 来源列详解

“来源”列以彩色标签的形式标识每条译文的产生方式。这是理解每条译文”可信度”的重要参考。

来源标签 颜色标识 含义
AI 翻译 蓝色 该译文由大模型(LLM)生成(DeepSeek v4)。在 CM、TM、术语表均未命中的情况下,大模型兜底翻译。
术语表 紫色 该译文由术语表(Glossary)匹配生成。原文中的术语在术语表中有精确匹配,译文遵循了术语表的规定。
标记不译 灰色 该条目标记为”不翻译”——原文中的内容不需要翻译(例如纯数字标注、图号、标准代号等)。用户或系统可以标记某些条目为”不译”。
TM 青色 该译文来自翻译记忆(TM)匹配。原文在历史审批通过的翻译记录中有精确或高相似度匹配。
CM 橙色 该译文来自人工修正记忆(CM)。原文在用户之前手动修改过的记录中有匹配,直接返回了用户的历史修改版本。
手动编辑 绿色 该译文由用户在当前会话中手动输入或修改。在 CM 和 TM 中都无记录时,用户直接手动输入译文。

如何根据来源判断处理策略

来源 可靠性 建议处理
手动编辑 最高(您自己写的) 直接审批通过。
CM 很高(您以前手动改过的) 快速确认后审批通过。
TM 高(历史上审批通过的) 逐条检查——历史审批通过的译文可能在当前语境下不完全适用。
术语表 中高(术语正确但句子可能不自然) 重点检查术语之外的句子部分是否通顺。
AI 翻译 中(大模型生成,未经人工验证) 必须逐条人工校对后才能审批通过。
标记不译 无需评估 确认确实不需要翻译后即可忽略。

5.7 翻译操作流程

本节以一个完整的翻译流程为主线,讲述从打开工作区到完成全部翻译的每一步操作。

5.7.1 标准翻译流程总览

第1步:打开翻译工作区
    ↓
第2步:检查翻译设置(语言、专业)
    ↓
第3步:(如有术语表)导入术语表
    ↓
第4步:点击"翻译未翻项",启动批量翻译
    ↓
第5步:按置信度排序,从低到高逐条人工校对
    ↓
第6步:修改有问题的译文(自动积累 CM)
    ↓
第7步:对校对通过的条目逐条或批量审批(积累 TM)
    ↓
第8步:保存会话
    ↓
第9步:设置回写模式,执行回写到图纸
    ↓
第10步:在 AutoCAD 中验证回写结果

5.7.2 第1步:打开翻译工作区

翻译工作区可以从以下两个入口进入:

方式一:从 Studio 项目管理进入

  1. 启动同文 Studio。
  2. 在项目管理页面中,找到包含已提取文字的翻译任务。
  3. 点击任务详情,找到目标图纸文件。
  4. 点击“进入翻译工作台”按钮(或双击文件条目)。
  5. 系统加载该图纸的翻译会话文件(.tw),打开翻译工作区。

方式二:从 AutoCAD 插件端自动进入

  1. 在 AutoCAD 中打开图纸,通过侧边面板执行文字提取(整图提取或框选提取)。
  2. 提取完成后,翻译工作区自动打开,加载提取结果。

5.7.3 第2步:检查翻译设置

在开始翻译之前,务必先检查以下设置:

  1. 源语言:是否与图纸中的原文语言一致?如果不确定,可随机查看几条原文确认。
  2. 目标语言:是否是您需要的目标语言?
  3. 专业:是否选择了与图纸内容对应的专业(建筑/MEP/结构/材料)?

为什么这一步很关键:如果语言或专业设置错误,所有大模型翻译的结果都将是错误的,您需要清空所有译文后重新翻译,浪费大量时间。

5.7.4 第3步:导入术语表(可选但推荐)

如果您已经准备好了术语表 CSV 文件(详见 5.5.4 节),建议在翻译开始前导入:

  1. 在项目管理或任务设置中,找到”术语表”管理入口。
  2. 上传或选择 CSV 文件。
  3. 确认术语表加载成功后,在翻译工作区工具栏中点击”术语表 [N]”按钮,检查术语数量和内容是否正确。

注意:如果在翻译开始之后才导入术语表,已经翻译完成的条目不会自动应用新的术语表约束。您需要清空已翻译的条目(或仅清空受影响的条目),然后重新翻译。

5.7.5 第4步:批量翻译

  1. 确认以上设置无误后,点击工具栏中的“▶️ 翻译未翻项”按钮。
  2. 系统开始逐条翻译。翻译过程需要一些时间,取决于条目数量(通常每秒处理数条到数十条)。
  3. 在翻译过程中,您可以观察数据表格中的变化:
    • 译文列从空白变为填充状态。
    • 置信度列显示百分比数字和色标。
    • 来源列显示彩色标签。
  4. 翻译完成后,底部状态栏更新统计:”待翻译 N”的数字减少,”已翻译 N”的数字增加。

5.7.6 第5步:按置信度排序,优先处理低置信度条目

翻译完成后,不要立即审批。应该首先按置信度从低到高排序:

  1. 点击数据表格的“置信度”列标题,确保排序为升序(▲)。
  2. 低置信度条目(红色标记,<70%)会排在最前面。
  3. 这些条目最可能需要人工修改。

5.7.7 第6步:人工校对

这是整个翻译流程中最关键、最耗时的环节。对于每一条需要校对的译文,执行以下操作:

校对清单

检查项 检查内容
术语准确性 专业术语的翻译是否正确?是否与术语表中的规定一致?
语境适配 译文在当前图纸语境下是否合适?(例如,”柱子”在建筑图中翻译为”column”,在设备基础图中可能需要”pedestal”)
格式一致 同类表述在不同条目中是否采用了统一的翻译?
符号保留 工程符号(φ、±、°等)是否正确保留?数字和单位是否正确转换?
长度评估 译文长度是否显著长于原文?是否可能导致回写后文字溢出?

修改操作

  • 如果译文有问题,双击译文单元格进入编辑模式,直接修改。
  • 修改后按 Enter 确认。来源标签自动变为”手动编辑”(绿色)。
  • 如果不确定如何修改,可以先标记或记录下来,待后续统一处理。

5.7.8 第7步:审批译文

校对通过的译文需要审批,以确认其质量合格:

逐条审批

  • 点击该行第一列的 ☐ 复选框,然后点击工具栏的”审批选中”按钮。

批量审批

  1. 在数据表格中,通过以下方式选中需要批量审批的条目:
    • 使用状态筛选为”已翻译”,然后表头全选(但注意这会选中所有已翻译的条目,包括尚未校对的)。
    • 逐条勾选已校对通过的条目。
  2. 点击工具栏的“✅ 审批选中(N)”按钮。
  3. 确认 N 数字与您预期的勾选数量一致后,点击按钮执行。

审批后的自动操作

  • 条目状态变为”已翻译”(审批通过)。
  • 译文自动加入翻译记忆库(TM)。
  • 如果该译文之前被手动修改过,对应的 CM 记录也会更新。

⚠️ 重要警告:不要对大模型刚翻译完、未经人工校对的条目进行批量审批。一旦审批通过,错误的译文会进入 TM 库,不仅影响当前项目,还可能通过 TM 共享影响其他项目。

5.7.9 第8步:保存会话

在关闭工作区或执行回写之前,务必保存:

  1. 点击工具栏的“💾 保存”按钮(或使用快捷键 Ctrl+S)。
  2. 确认保存成功(状态栏可能有提示)。

5.7.10 第9步:回写到图纸

确认以下条件后执行回写:

  1. 所有需要回写的条目状态为”已翻译”(审批通过)。
  2. 回写模式已正确设置(见 5.4.5 节)。
  3. 合并图层选项已确认(见 5.4.6 节)。
  4. 已保存当前会话。

点击“💾 回写到图纸”按钮。

5.7.11 第10步:验证回写结果

回写完成后,立即在 AutoCAD 中打开图纸验证:

  1. 打开对应的 DWG 文件。
  2. 切换图层可见性,检查译文图层是否存在且内容完整。
  3. 随机抽取 10~20 个位置,对比原文与译文的内容和位置。
  4. 特别检查:
    • 图框标题栏中的译文是否正确(AttributeReference 类型)。
    • MText 的格式(字体、颜色、大小)是否与原文一致。
    • 是否有译文超出了文字包围盒。

如果发现问题,回到翻译工作区修改对应条目,重新审批后再次回写。


5.7.12 翻译流程中的常见决策

情景 建议操作
图纸中有些纯数字或代号不需要翻译 在译文列中留空(不填),或标记为”不译”。这类条目可以在最终回写时选择不处理。
同一句话在不同图纸中出现 利用 TM 的累积效应——翻译并审批通过第一张图纸后,后续图纸的相同内容会自动匹配 TM。
不确定某个术语的正确译法 查阅项目规范或行业标准,确定译法后加入术语表,然后统一应用到所有相关条目。
译文太长,担心回写后溢出 在详情面板中查看包围盒信息(见 5.9 节),评估空间是否足够。如果空间确实不足,可以考虑缩写或换行。
需要中断工作,稍后继续 保存会话后关闭工作区。下次打开时,从项目管理页面重新进入工作区,数据完整保留。

5.8 置信度解读

置信度是翻译工作区中用于辅助判断译文质量的核心量化指标。正确理解和使用置信度,可以大幅提升校对效率。

5.8.1 什么是置信度

置信度是一个 0% 到 100% 的数值,表示翻译引擎对该译文质量的信心评分。它不是翻译的”正确率”——一条置信度 90% 的译文不意味着有 90% 的概率是正确的——而是引擎基于多种因素综合计算的一个参考指标

置信度的计算因素

因素 说明
来源类型 CM 的置信度最高(99%~100%),TM 精确匹配次之(100%),TM 模糊匹配随相似度递减(95%~99%),大模型翻译的置信度根据模型内部评估而定(通常 70%~95%)。
术语匹配情况 如果原文中的术语在术语表中全部匹配,置信度会上浮。如果存在未匹配的疑似术语,置信度会下降。
文本复杂度 长句、含特殊符号、嵌套表达等复杂文本,置信度通常低于简短、规范的标注文字。
专业适配度 如果原文内容与所选专业领域高度相关,置信度相对较高;如果原文内容跨专业,置信度可能较低。
模型内部评估 DeepSeek v4 在生成译文时会给出自身的信心评估,此评估被纳入置信度计算。

5.8.2 色标体系

置信度以颜色标签的形式直观展示,让您一眼就能识别出需要重点关注的条目:

颜色 置信度范围 含义 建议操作
🟢 绿色 ≥ 90% 高置信度——翻译引擎对该译文很有信心。 可以快速浏览确认,通常不需要逐字检查。但如果是关键标注或专业术语密集的文本,仍建议抽查。
🟡 黄色 ≥ 70% 且 < 90% 中置信度——翻译引擎对该译文有一定信心,但存在不确定性。 建议逐条检查。重点检查术语、句式和语境的适配性。
🔴 红色 < 70% 低置信度——翻译引擎对该译文信心不足,可能存在明显问题。 必须逐条仔细校对,很可能会出现错误或不自然的表达。这类条目是校对工作的最高优先级。

5.8.3 如何处理不同置信度的条目

绿色(≥90%)条目的处理

  1. 快速浏览译文,确认关键术语翻译正确。
  2. 如果译文看起来通顺、专业术语正确,可以直接审批通过。
  3. 建议抽查比例:至少 20%~30%(每 5 条中抽查 1 条)。如果抽查结果良好,剩余条目可以批量审批。

黄色(70%~89%)条目的处理

  1. 逐条阅读译文,与原文对照。
  2. 重点检查:
    • 专业术语是否使用了正确的工程表达。
    • 句子结构在目标语言中是否自然。
    • 数字、符号、单位是否正确保留。
  3. 发现问题时,双击编辑译文,手动修正。
  4. 修正后,该条目的来源会变为”手动编辑”(绿色标签),置信度不再有意义(因为已经人工验证)。

红色(<70%)条目的处理

  1. 优先处理——在编辑任何其他条目之前,先集中精力处理红色条目。
  2. 逐条仔细阅读原文,理解其在图纸中的含义。
  3. 往往需要参考上下文信息(在详情面板中查看图层、对象类型等)来辅助判断正确的翻译。
  4. 如果大模型翻译明显有问题,手动输入正确的译文。
  5. 如果对某条原文的含义不确定(例如,不知道某个缩写或代号代表什么),可以:
    • 在 AutoCAD 中打开图纸,找到该文字的位置,通过上下文判断。
    • 咨询相关专业工程师。
    • 标记为”待定”,后续统一处理。

5.8.4 置信度的局限性

需要强调的是,置信度是一个辅助参考指标,而非绝对的翻译质量评判标准。以下情况需要特别注意:

  • 高置信度也可能出错:大模型翻译可能对一个它”很确定”的术语给出了错误的译法(因为它在训练数据中学到的是非工程领域的译法)。例如,”管井”的通用翻译是”tube well”,但在机电语境下应该是”pipe shaft”——大模型可能给出高置信度的错误答案。
  • 低置信度也可能正确:某些简短的标注文字(如”C30”、”Φ8@200”)置信度可能偏低(因为模型无法确定其含义),但实际上不需要翻译(或翻译非常简单)。
  • 置信度与审批状态无关:一条置信度为 100% 的 TM 精确匹配记录,意味着”历史上这条译文被审批通过过”,但并不代表它在当前语境下一定正确。

原则:置信度告诉您应该在哪里花更多时间校对,但最终判断译文是否正确的依据是人工审查,而非数字。


5.9 详情面板使用

详情面板位于翻译工作区右侧(可以收起/展开),当您在数据表格中选中某一行(单击即可,不需要双击编辑)时,详情面板会自动显示该条目的完整上下文信息。

5.9.1 详情面板包含的信息

详情面板的内容分为以下几个信息组:

基础信息

字段 说明
对象类型 该文字实体在 DWG 中的类型:MText(多行文字)、DBText(单行文字)或 INSERT+ATTRIB(块参照中的属性文字)。
句柄(Handle) 实体在 DWG 文件中的唯一十六进制标识符,用于回写时的精确定位。
空间/布局 实体所在的图纸空间。通常为”模型空间”(Model)或某个”布局”(Layout,如图纸空间的某个视口)。

图层 & 位置

字段 说明
图层名 文字所在的 AutoCAD 图层名称。通过图层名可以大致判断文字的专业归属(例如”建筑-标注”、”S-COLU”等)。
锁定/可见状态 该图层在提取时的锁定状态和可见性状态。这有助于理解为什么某些文字在图纸中看不到(可能图层被关闭或冻结了)。
X / Y / Z 坐标 文字插入点的精确几何坐标。可用于在图纸中定位该文字。

文本样式

字段 说明
字体 文字使用的 AutoCAD 文字样式(Style)及关联的字体文件(如 SimSunROMANS.shx 等)。
字高 文字在图纸中的打印高度(以图纸单位计,通常为毫米)。该字高是回写时的重要参考——译文将使用相同的字高。
对齐方式 文字的对齐方式(如”左对齐”、”居中”、”右对齐”、”中间对齐”等)。对于 MText,还可能有”左上”、”中上”等附着点信息。

QA 发现

字段 说明
各等级风险列表 该译文在自动质量检查(QA)中发现的问题列表。风险等级包括:正常、低、中、高、阻断(详见 5.9.2 节)。

术语命中

字段 说明
命中的术语表匹配结果 原文中与术语表匹配的术语列表及其对应的译法。显示格式通常为”源术语 → 目标术语”。

5.9.2 QA 风险等级说明

同文在翻译过程中会对译文进行自动质量检查,识别潜在问题并按严重程度分级:

风险等级 颜色标识 含义 示例
正常 绿色 未发现任何问题。
浅黄色 存在轻微的格式或风格问题,不影响理解。 标点符号不一致(中英文逗号混用)、大小写不统一。
黄色 译文可能存在语义偏差或术语不规范。 术语表中定义的术语未使用规定的译法;译文长度显著偏离原文(可能溢出)。
橙色 译文可能存在实质性错误,影响工程信息的准确传达。 数字翻译错误;方向/位置描述反转;专业术语严重误译。
阻断 红色 严重问题,该译文不能用于回写,必须修正后才能审批。 译文为空(异常);译文包含明显乱码;关键字词完全错译导致工程安全隐患。

如何处理 QA 风险

  1. 在翻译工作区中,按”风险”列排序(降序),将高风险条目前置。
  2. 逐条点击高风险条目,在详情面板的”QA 发现”区域查看具体问题描述。
  3. 根据问题描述修改译文。如果 QA 标记的问题经人工判断是误报(例如,术语表中未收录但当前译法在语境下是正确的),可以忽略该风险,正常审批。
  4. 修改完成后,QA 会重新评估译文,风险等级可能会降低。

5.9.3 详情面板的实际应用

场景一:判断不明缩写

原文为”LL”,您不确定它在图纸中代表什么。

  1. 点击该条目,查看详情面板。
  2. 在”图层 & 位置”中,看到图层名为”电气-照明”。
  3. 推断”LL”很可能代表”Living Room Light”或”照明回路”。
  4. 结合上下文确定正确翻译后,手动输入译文。

场景二:评估译文长度是否合适

原文为 4 个中文字,译为英文后变为 20 个字符。

  1. 点击该条目,查看详情面板中”文本样式”的字高和”图层 & 位置”的坐标。
  2. 如果字高较大、位置靠近图框边缘,译文可能溢出。
  3. 考虑使用缩写或换行来缩短译文长度。

场景三:确认 MText 格式是否影响翻译

某条 MText 译文看起来排版混乱。

  1. 点击该条目,查看详情面板中”对象类型”——确认为 MText。
  2. MText 的格式保护机制(见第 04 章 4.9 节)确保回写时格式不变。在翻译工作区中看到的”混乱”可能只是渲染差异,不影响实际回写质量。

5.10 术语命中解读

术语命中是翻译知识系统中术语表(Glossary)正常工作的重要体现。

5.10.1 什么是术语命中

当原文中包含术语表中定义的术语时,系统就会”命中”该术语。术语命中意味着:

  • 系统识别出了这条原文中包含了需要统一翻译的专业术语。
  • 在调用大模型翻译时,系统会将术语表中规定的译法作为约束条件传入。
  • 大模型生成的译文中,该术语必须使用术语表中规定的译法。

5.10.2 在详情面板中查看术语命中

  1. 在数据表格中点击某一行。
  2. 在右侧详情面板的”术语命中”区域,查看命中结果。
  3. 显示格式示例:

    术语命中:
    - 混凝土 → concrete
    - 强度等级 → strength grade
    - 抗震 → seismic
    

这表示原文中包含了这三个术语,系统已强制大模型在翻译时使用对应的译法。

5.10.3 术语命中的不同情况

情况 说明 操作建议
全部命中 原文中的所有专业术语都在术语表中定义了对应的译法。 翻译质量有保障,可以快速审批。
部分命中 原文中有部分术语在术语表中定义了译法,另一部分未定义。 检查未命中术语的翻译是否准确。如果未命中的术语较为关键,考虑将其加入术语表。
无命中 原文中没有能与术语表匹配的术语。 可能原文不包含专业术语(如”详见设计说明”),也可能术语表不够完善。
误命中 术语表匹配了原文中的某个子串,但该子串在当前语境下并不是一个独立的术语。例如,术语表中定义了”高度 → height”,原文为”高度关注”,系统可能误将”高度”作为术语命中。 检查译文是否被误约束。如果译文因为误命中而变得不自然,可以手动修改。如果误命中的情况频繁,考虑调整术语表的匹配模式(从子串匹配改为整词匹配)。

5.10.4 术语表未命中的排查

如果您发现某条译文中,一个关键术语的翻译与术语表中定义的不一致,可能的原因和排查步骤:

  1. 打开术语表抽屉(点击”📗 术语表 [N]”按钮),搜索该术语,确认术语表中确实定义了该术语。
  2. 检查优先级:该条译文是否来自 CM 或 TM(来源列为橙色或青色)?如果是,说明 CM 或 TM 的优先级高于术语表,CM/TM 中已有的翻译结果覆盖了术语表的约束。这通常不是问题——CM 和 TM 代表了更可靠的翻译来源。
  3. 检查原文:原文中的该术语是否因为格式码、特殊字符或全角/半角差异,导致与术语表中的词条不完全一致?例如,术语表中定义的是”混凝土”,但原文中写的是”混 凝 土”(中间有空格),匹配会失败。
  4. 检查术语表格式:CSV 文件中的术语条目是否有格式问题(如多余的逗号、引号不匹配等)。

5.11 状态筛选与批量操作

状态筛选和批量操作是处理大型翻译任务时提高效率的关键工具。

5.11.1 五种状态的含义与流转

翻译工作区中的每个条目都处于以下五种状态之一:

状态 含义 界面显示
待翻译 译文为空,尚未开始翻译。通常出现在提取后刚进入工作区时,或清空译文后。 状态列显示”待翻译”,译文列为空。
已翻译 已有译文,且该译文已经过人工审批(审批通过)。这是可以回写的前提状态。 状态列显示”已翻译”,译文列有内容。
已回写 译文已经成功回写到图纸中,翻译工作完整闭环。 状态列显示”已回写”。该条目通常不再需要进一步操作。
失败 翻译或回写过程中出现错误。 状态列显示”失败”,通常以红色高亮。需要查看错误原因后重试。

翻译单元状态机

Extracted(提取完成)
    ↓ 点击"翻译未翻项"或手动输入译文
Draft(草稿——有译文但未审批)
    ↓ 点击"审批选中"
Approved(已审批——译文通过人工验证)
    ↓ 点击"回写到图纸"
Written(已回写——完成闭环)

注:Failed(失败)状态可以在任意阶段出现(翻译失败、审批异常、回写失败等)

5.11.2 状态筛选的使用场景

筛选条件 使用场景
全部 常规浏览,了解整体进度。
待翻译 刚开始翻译,或需要清空重译时,专注于空白条目。
已翻译 翻译完成,进入校对和审批阶段。配合按置信度排序,从低到高校对。
已回写 回写完成后,确认哪些条目已经闭环。可用于生成翻译完成报告。
失败 排查翻译或回写过程中的错误,集中处理失败条目。

5.11.3 批量操作的最佳实践

批量审批

  1. 筛选”已翻译”,查看所有已有译文的条目。
  2. 按置信度排序(升序),优先校对低置信度条目。
  3. 校对完一批(例如 20~50 条)后,手动勾选这些已校对的条目。
  4. 点击”审批选中(N)”,确认 N 数字正确后执行。
  5. 一次不要审批太多——建议每次 50~100 条以内,避免误操作。

批量搜索+修改

  1. 搜索框中输入某个关键词(如”柱子”)。
  2. 筛选”已翻译”,查看所有已翻译的包含”柱子”的条目。
  3. 逐条检查”柱子”的翻译是否统一为”column”。
  4. 如果发现不一致,手动修改。
  5. 全部修改完毕后,全选当前搜索结果,批量审批。

5.12 工作区会话管理

翻译工作区的所有数据都保存在翻译会话文件(.tw 文件)中。妥善管理这些会话文件是翻译工作可持续进行的基础。

5.12.1 保存(💾)

何时保存

  • 完成一批翻译修改后。
  • 完成一批审批后。
  • 关闭翻译工作区之前。
  • 执行回写之前。
  • 每隔 15~30 分钟的常规保存。

自动保存

  • 同文可能具备自动保存功能(取决于具体版本配置)。自动保存的间隔和触发条件可以在设置中调整。
  • 即使有自动保存,仍建议养成手动保存的习惯,以防自动保存机制未能触发。

5.12.2 导出(📤)

导出的典型工作流

工作流一:备份归档

  1. 翻译工作达到一个里程碑(如”初审完成”)。
  2. 点击”导出”,选择备份目录,文件名包含日期和版本号(如”XX项目-20260722-v1.tw”)。
  3. 将备份文件拷贝到云存储、U 盘或 NAS 等安全位置。
  4. 如果后续操作出现问题(如误清空了所有译文),可以从备份恢复。

工作流二:跨机器协作

  1. 翻译人员 A 在自己的计算机上完成了一部分翻译。
  2. 翻译人员 A 点击”导出”,生成 .tw 文件。
  3. 通过邮件、内部共享或 U 盘将文件传给翻译人员 B。
  4. 翻译人员 B 在自己的同文环境中点击”导入”(见 5.3.2 节),加载文件,继续翻译。

5.12.3 导入(📥)

导入时可能出现的提示

提示 含义 操作
“发现重复条目,是否覆盖?” 导入的文件中包含与当前会话中相同句柄的条目(同一张图纸的两次导出)。 如果导入的文件是更新的版本,选择”覆盖”。如果不确定,选择”保留当前”,然后手动比对。
“导入的文件与当前任务不关联” 导入的 .tw 文件与当前项目的源图纸不匹配。 导入后可以继续翻译,但回写时可能需要手动指定目标图纸。

5.12.4 会话文件的组织建议

对于多项目、多图纸的翻译工作,建议采用以下文件组织方式:

翻译项目/
├── 项目A-建筑图纸/
│   ├── 01-平面图_中文→英文_20260722.tw
│   ├── 02-立面图_中文→英文_20260722.tw
│   └── 术语表-建筑.csv
├── 项目A-结构图纸/
│   ├── 01-基础平面图_中文→英文_20260722.tw
│   └── 术语表-结构.csv
└── 备份/
    └── 2026-07-22/
        ├── 01-平面图_中文→英文_20260722.tw
        └── ...

命名规范建议[图纸编号]-[图纸名称]_[源语言]→[目标语言]_[日期].tw


5.13 翻译质量风险与应对

5.13.1 常见的翻译质量问题

问题类型 表现 原因 应对方法
术语不一致 同一个术语在不同的条目中翻译不同。 未使用术语表;TM 中存在不一致的历史记录。 建立并导入术语表;定期审查 TM 库。
语境错误 译文在语言上正确,但在图纸语境下不恰当。 大模型无法感知图纸上下文。 人工校对时结合详情面板的图层、位置、对象类型信息判断。
格式符号丢失 译文中的工程符号(φ、±、°)被替换或丢失。 大模型对特殊符号的处理偶有遗漏。 人工校对时重点检查符号。
译文溢出 译文长度显著大于原文,回写后文字超出包围盒。 中译英时,英文通常比中文长 2~3 倍。 对于过长的译文,考虑使用缩写;必要时在详情面板中检查包围盒信息。
块属性遗漏 图框中的属性文字未被翻译。 提取时勾选了”不提取图框文字”。 重新提取时取消该选项。

5.13.2 提升翻译质量的工作习惯

  1. 先建术语表,再翻译:在项目开始前,与项目团队一起梳理关键术语及其译法,编制术语表 CSV 文件并导入。
  2. 小批量试译验证:在批量翻译大量图纸之前,选取 1~2 张典型图纸进行试译,验证术语表、TM 和翻译质量是否达到预期。根据试译结果调整术语表和翻译策略后再批量铺开。
  3. 逐图闭环:每张图纸的翻译完成(审批+回写+验证)后,再开始下一张。避免积累大量”已翻译但未回写”的条目——拖延回写意味着问题推迟发现。
  4. 定期清理 TM 库:翻译记忆库随着时间的推移会积累越来越多的记录。如果发现某些 TM 记录不准确(例如早期翻译的术语后来被替换了),应及时清理或更新。
  5. 建立审校清单:为审校工作制定标准化的检查清单(Checklist),涵盖术语、格式、符号、长度等维度,确保审校质量的一致性。

5.14 本章小结

本章全面、系统地讲解了同文(Tongwen)翻译工作区的全部功能和使用方法。以下为本章核心要点回顾:

5.14.1 核心概念

  • 四级翻译知识系统是翻译工作区的灵魂:人工修正记忆(CM)→ 翻译记忆(TM)→ 术语表(Glossary)→ 大模型(LLM)。理解这四级优先级及其协同工作方式,是高效使用翻译工作区的基础。
  • 翻译单元状态机定义了每条翻译从提取到闭环的完整生命周期:Extracted → Draft → Approved → Written(Failed 可发生在任意阶段)。
  • 置信度是辅助参考,不是最终判决。绿色的高置信度条目可以快速审批,红色低置信度条目必须仔细校对。

5.14.2 操作要点

操作 要点
翻译设置 翻译前必须确认源语言、目标语言、专业设置正确。
批量翻译 点击”翻译未翻项”后,系统自动四级查找并生成译文。
人工校对 按置信度从低到高校对;绿色快速批,黄色逐条看,红色仔细改。
审批 人工校对确认无误后才可审批。审批通过后译文进入 TM 库。
回写 选择正确的回写模式(创建新图层/原位替换/双语追加),确认后执行。回写后在 AutoCAD 中验证。
会话管理 频繁保存,定期导出备份,按规范命名和组织 .tw 文件。

5.14.3 本章在完整工作流中的位置

第01章:产品概述 → 第02章:安装与启动 → 第03章:项目管理
    → 第04章:图纸文字提取 → ★ 第05章:翻译工作区(本章)
    → 第06章:回写与交付 → 后续章节

翻译工作区是整个同文工作流中投入时间最长、对翻译质量影响最大的环节。掌握本章内容后,您已经具备了使用同文独立完成高质量工程图纸翻译的核心能力。后续章节将介绍回写策略的高级配置、批量处理自动化以及多项目协作管理等内容,帮助您进一步提升效率和翻译质量。


上一篇第04章:图纸文字提取 下一篇:[第06章:回写与质量审查](待更新) 返回同文教程目录