

同一个中文词在美妆、服装和电子产品里可能需要不同译法。解决这类歧义,不能只靠增加品牌名;系统还需要知道“谁在什么场景,对谁说话”。
ObsTrans/言播的 AI 角色编辑器把两层放在一起管理:角色说明提供场景上下文,术语表记录“原词 → 指定译法”。但它们并不在每条线路上同时生效:
- 走 AI 大模型翻译线路时,完整人设说明和术语表会注入文本翻译;
- 走普通在线识别线路时,角色配置会被忽略;
- 走高级在线识别的实时同传线路时,只有术语表生效,人设说明不生效;
- 弹幕翻译是另一条场景,不受语音角色影响。
因此,先看“AI 角色”页顶部的线路提示,再决定测试人设还是只测试术语。否则同一段录音前后完全不变,可能是线路边界,不是人设写得不够长。
一段合格的角色说明
角色说明应回答四个问题:
- 主播是谁: 品牌导购、工厂讲解员还是测评者;
- 观众是谁: 首次了解品类,还是已经熟悉规格;
- 当前任务: 商品演示、售后问答或活动说明;
- 语气边界: 简洁、可信,不添加原文没有的功效或承诺。
例如:
你正在翻译一场面向美国普通消费者的护肤品直播。主播以品牌导购身份解释使用顺序和成分。保持口语、简洁;保留型号;不要把主观体验改写成医学功效。
这比“请专业准确翻译”有信息,也比粘贴整份商品手册更稳定,但只有 AI 大模型翻译线路会读取这段人设。实时同传要固定品牌和型号,应使用下方术语对。
什么必须放术语表
品牌、型号、成分、系列名和固定活动名需要精确输出,应该写成术语对。Google Cloud 对翻译术语表的定义也是让领域专有术语保持一致,典型对象包括命名实体。
上下文可以告诉系统“这是护肤品”,却不能保证每次把一个品牌写成完全相同的大小写。确定译法不要藏在一段说明里。
ObsTrans 当前角色编辑器最多接收 50 条成对术语。这个产品上限来自实际界面与后端校验,不代表“填满 50 条效果最好”。两层术语表指南已经解释:识别错的品牌名,还需要识别层偏置;翻译术语表只能处理已经正确到达文本层的词。
不要写进上下文的内容
- 会频繁变化的价格和库存;
- 尚未确认的物流承诺;
- 整场逐字脚本;
- “适当美化”“补全卖点”这类允许添加事实的指令;
- 相互冲突的市场和语言要求。
角色配置应该稳定跨多场复用。临时事实由主播说出口,且要遵守话术本地化的短句与明确条件。
用差异表验收
选五分钟真实录音,至少包含一个多义词、三个品牌/型号、一个否定句和一个促销条件。在确认使用 AI 大模型翻译线路后,分别关闭角色和开启角色运行,记录:
| 原句 | 无角色输出 | 有角色输出 | 是否更准确 | 是否引入副作用 |
|---|
只看“目标术语命中了几个”不够。角色可能修正品类词,同时把普通句子改得过度营销。新增上下文后,应检查旧的正确句子仍然正确。
按品类拆,不按主播拆
同一主播今天卖美妆、明天卖耳机,语境完全不同;同一品类换主播,术语与受众仍然相近。角色更适合按“品类 + 目标市场 + 任务”拆分。
在 ObsTrans 里可以从预设复制为自己的角色,再修改、设为当前角色。预设是只读起点,不是实时引用;上线前仍要在实际使用的翻译线路上用自己的商品录音验证。
它不能替代什么
角色上下文不能修复麦克风收音、断句和识别漏字,也不能证明某个市场允许你的功效宣称。它只影响文本翻译阶段。先看语音识别准确率排查,确认输入文本正确,再评估上下文带来的变化。
操作步骤
- 1
先确认当前线路会读取什么
AI 大模型翻译线路读取人设和术语;普通在线识别忽略角色;实时同传只读取术语表。不要在不读取人设的线路上用样例效果验收人设。
- 2
写清说话者、受众和语气
用三到五句描述主播身份、观众熟悉程度、语气和输出禁忌。不要粘贴整场脚本,也不要要求模型编造未出现的信息。
- 3
把确定译法移到术语表
品牌、型号、成分和固定活动名用原词到目标译法的成对条目记录,不要只埋在角色说明里。
- 4
用真实录音做对照
选一段含歧义词、品牌名和促销表达的录音,分别在角色关闭和开启时运行,逐句记录改变。
- 5
按错误维护而不是按目录扩张
只添加真实直播中翻错或不一致的上下文与术语。每次修改后确认旧的正确句子没有被带偏。
常见问题
- 角色上下文和术语表有什么区别?
- 上下文描述场景与语气,帮助歧义消解和风格一致;术语表给出明确的原词与目标译法。需要精确固定的词必须进术语表。
- 能不能把全部商品资料粘进角色说明?
- 不建议。过长说明会混入过期信息和互相冲突的要求。角色保留稳定背景,具体商品名和译法放术语表,临时价格仍由主播实际口播。
- 一个角色可以用于多个语言对吗?
- 场景描述可以复用思路,但术语目标列与语气习惯依赖目标语言。至少应按目标语言分别维护和验收。

