wenyi文译实时术语表实战自动抽取专名、检测译法冲突彻底告别前后不一【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/gh_mirrors/we/wenyiwenyi文译是一款面向长篇小说的 AI 翻译工具其核心亮点之一是实时术语表翻译每完成一批段落就会自动从原文与译文中抽取人名、地名、称谓等专名写入术语库约束后续翻译一旦发现同一原文术语出现了不同译法立即记录为译法冲突等你人工裁决——从此彻底告别前后不一。无论你是用 Web 界面还是 CLI 命令行wenyi 的术语表都会边翻译、边积累、边校验让几百章的长作品始终保持命名一致。一个术语表要解决的痛点长作品翻译最头疼的不是翻不出句子而是同一个角色在第 3 章叫艾伦第 40 章变成阿伦。传统做法是人工整理一张 Excel 术语表再祈祷模型每次都遵守。wenyi 的做法是把术语表变成翻译流程的活零件自动抽取——不靠你手动整理模型边翻边把新专名提炼进库按需注入——每批次只注入本章匹配到的词条无关术语不占上下文冲突留痕——已定译法不会被自动覆盖新译法进入冲突队列等待裁决。官方对术语库的定位描述得很清楚它用于约束后续翻译并为最终审校提供证据。详见 docs/zh/pipeline.md。自动抽取三步闭环抽取、对齐、冲突检测第一步从已译段落里抽取专名每翻译完一个批次GlossaryExtractor会拿原文片段 译文片段 现有术语表调用轻量模型返回结构化的候选词条原文source、译名target、读音reading、类型person/term/appellation/honorific 等、性别、别名和备注。抽取不是无脑全量注入——如果传入全书语料只有出现至少两次的现有词条才会被注入提示词低频词条保留在库中但不反复消耗上下文这在 packages/core/wenyi_core/glossary/extractor.py 中实现。第二步首次译法对齐更巧妙的是历史对齐机制。当一个新术语此前已在前面章节被翻译过抽取器会找到该术语第一次出现的原译文对照让模型判断库里这条译名和当初实际怎么翻的是否一致一致 → 词条入库能判断 → 改用首次译法入库保证全书口径统一不确定 →暂缓入库避免把一个错误的译名固化、污染后续文本。相关逻辑见 extractor.py 中的 _align_with_first_occurrences。第三步冲突检测绝不静默覆盖GlossaryStore.upsert_term的裁决规则非常克制见 packages/core/wenyi_core/glossary/store.py情形处理新术语直接入库inserted译名相同合并别名、补全读音/性别/备注unchanged译名不同保留已确立译法新译法写入term_conflicts表词条标记为conflict等待人工裁决也就是说自动抽取永远不会偷偷改掉你确认过的译名——所有分歧都摆在明面上。Web 端管理术语表搜索、批量操作与冲突裁决在 Web 端术语表是独立导航页前端实现在 apps/web/src/features/glossary/GlossaryPage.tsx一个表格覆盖全流程搜索与筛选按原文、译名或别名搜索按人物 / 术语 / 称谓 / 敬语 / 口癖 / 固定表达六类筛选增删改弹窗添加或编辑词条含读音、性别、别名、备注支持多选批量删除导入导出支持 CSV / JSON 双向导入导出导入时若与现有词条冲突会逐条列出由你选择覆盖还是跳过冲突裁决页面底部琥珀色卡片列出所有未解决冲突每条对比当前译法与AI 建议点一下保留当前或采纳建议即可裁决后所有相关冲突自动关闭。后端对应的 REST 接口在 apps/api/wenyi_api/routers/glossary.py包括术语增删改查、/conflicts列表与/conflicts/{cid}/resolve裁决、JSON/CSV 导入导出。⚠️ 小提示翻译任务运行中术语表保持只读编辑需先暂停任务避免写冲突。CLI 快速排查三条命令掌握全书译名偏好命令行的用户wenyi CLI 提供了完整的术语管理子命令实现在 packages/cli/wenyi_cli/commands/glossary.pyuv run wenyi glossary list book.epub # 列出全部已确立译名与状态 uv run wenyi glossary conflicts book.epub # 查看未解决的译法冲突 uv run wenyi glossary resolve book.epub 原文术语 指定译名 # 裁决并关闭冲突list以表格展示 Source / Translation / Type / Status状态为conflict的词条一目了然conflicts逐条打印现有译法 vs 建议译法含出现章节resolve调用 resolver.py把最终译法写回术语库并关闭该术语的全部冲突。这三条命令在 docs/zh/usage.md 的独立阶段与术语管理一节有完整说明。术语一致性还能再进一步吗术语表负责约束未来而已完成的历史段落怎么办wenyi 的答案是把术语库作为审校证据review阶段会用最终术语库全书检查译文中的译名漂移发现问题可结合--autofix发布修订。人工校阅页面则让你逐段核对原文与译文逐段确认译名统一。此外docs/zh/configuration.md 提供了glossary_scope配置chapter只注入本章相关术语默认省上下文full注入全量术语表更严格。而术语抽取与历史对齐两个操作默认路由到fast档模型既省成本又保持响应速度。小结wenyi 文译的实时术语表把译名一致从人工纪律变成了工程机制自动抽取每批翻译完成后即刻提炼新专名无需手动维护首次译法对齐新词条优先对齐历史首次译法不确定就暂缓⚖️冲突留痕译法分歧不静默覆盖Web 与 CLI 双端一键裁决审校兜底术语库同时作为 Review 证据历史漂移也能被发现。从第 1 章到第 500 章专名自始至终一个译法——这就是实时术语表带给长作品翻译的确定性。【免费下载链接】wenyi将被语言阻隔的作品带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/gh_mirrors/we/wenyi创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考