善忘技术夹 Logo
善忘技术夹
善用佳软 MIT

我发现了一个 2.4k Star 的开源工具,直接把我的英文书单全翻译了

你有没有过这种经历:Kindle 里攒了几十本英文原著,每次打开翻两页就放下了。不是不想读,是读着太累了——一个段子里三四个生词,查完回来上下文都忘了。

用 Google 翻译?复制一段粘一段,翻完前面忘了后面,人物关系乱成一锅粥。沉浸式翻译?那是浏览器插件,管不了你 EPUB 里的整本书。

直到我挖到了 wenyi,一个 2.4k Star 的开源项目,MIT 协议,免费。名字叫”文译”,定位很明确:专门处理”整本书”的翻译。

今天聊聊这个工具到底能干什么,以及我用了之后的真实感受。

这是个什么工具?

wenyi 是一个命令行工具,用 AI 做长文本翻译。输入一本 EPUB 小说、一篇 Markdown 技术文档、甚至 SRT 字幕文件,它输出完整的中文译文,格式和排版尽量保持原样。

支持的输入格式:EPUB、FB2、TXT、Markdown、HTML、PDF、DOCX、SRT。

输出可以是 EPUB(单语或双语对照)、TXT、HTML、Markdown、DOCX、SRT。翻译完扔到 Kindle 里,排版基本不会乱。

双语对照输出效果

为什么我觉得它跟别的翻译工具不一样?

市面上翻译工具不少,但大多数解决的是”翻一段话”的问题。wenyi 做的是另一件事——把整本书当一个整体来翻译。

普通做法wenyi 的做法
逐段翻译,前面说了什么后面不知道先通读全书,生成章节梗概和全书摘要,翻译时随时参考
术语翻到哪算哪自动提取人名、术语建表,同一词翻出两个译法会报冲突
翻译到一半断了,回来重新来按批次存进度,断了接上就行
翻完交卷,不管质量初译之后用更强的模型润色,再跑一遍全书一致性检查

我实际用下来的感受是:它不是”一个能处理长文本的 ChatGPT”,而是一套为长文本场景专门设计的工作流。

全书预扫描

这是我觉得最值得说的功能。翻译正式开始前,wenyi 会先把全书读一遍,整理出每章大意和全书摘要,然后在翻译过程中把这份”笔记”喂给模型。

效果是什么?翻译第三章的时候,模型知道第一章里那个配角后来怎么样了。不会出现同一本书里人名翻三个样的问题。

术语管理

翻译过程中,wenyi 自动提取人名、地名、专业术语,建一张术语表。遇到同一个词翻了两种译法,它会标记出来让你确认。

我翻译一本技术书的时候,某个 API 名称翻到一半被换成了另一个译法,工具直接报了冲突。这个功能在翻译系列小说或者专业书籍的时候特别管用。

多阶段质量控制

翻译分三步走:先初译一遍,再用强模型润色,最后做全书的 AI 审校,检查术语一致性和语言风格。

实际怎么用?

wenyi 是命令行工具,需要装 Python 3.10+ 和 uv 包管理器。如果你平时用终端,跟着做就行。

安装

克隆仓库装依赖:

git clone https://github.com/BigDawnGhost/wenyi.git
cd wenyi
uv sync

配置 API Key

wenyi 支持多家大模型。DeepSeek 性价比最高,配置方式:

export DEEPSEEK_API_KEY="sk-你的密钥"

OpenAI、Google Gemini、OpenRouter、Ollama、vLLM 都支持,本地跑用 Ollama 就行。

开始翻译

一行命令:

uv run trans-novel translate book.epub

工具会自动走完 解析章节 → 全书预扫描 → 逐章翻译 → 润色审校 → 输出结果 的流程。

如果你想先试试效果,可以加 --chapter 0 只翻第一章看看质量,满意了再翻译全书。

几个常用选项:

选项作用
--polish开启润色
--review开启全书审校
--bilingual输出双语对照版
--chapter 0只翻第一章试试
--format txt输出 TXT 格式

支持哪些模型?

wenyi 不绑定任何一家提供商。除了 DeepSeek、OpenAI、Gemini、OpenRouter,还能接 Ollama 和 vLLM 本地跑,完全离线,数据不用出本机。

适合谁,不适合谁

适合:

  • 想读英文原著但词汇量跟不上的读者
  • 需要翻译专业书的技术人员
  • 囤了一堆英文电子书没看完的人

不太适合:

  • 完全零基础、想靠翻译替代自己看书的(翻译质量跟模型能力挂钩)
  • 对翻译质量要求极高、要求”像人译的”(AI 翻译还是有局限)
  • 需要翻译扫描版 PDF 的(得额外配 MinerU)

还有一件事:版权。只翻译你有权阅读的书,这个不用说。

常见问题

Q:免费吗?

工具本身 MIT 开源,免费。大模型的 token 费用自己承担。DeepSeek 最便宜。

Q:翻译质量如何?

跟模型和是否开润色+审校有关。DeepSeek V3 性价比不错,GPT-4o 质量最高但贵。开了润色和审校之后,比直接复制粘贴给 ChatGPT 靠谱很多。

Q:能双向翻译吗?

支持。内置中文、英文、日文、韩文、法文、德文等 10 种语言的互译配置。

Q:有图形界面吗?

没有,纯命令行。但用起来就是一行命令的事,门槛没想象中高。

项目 Star 增长趋势

我的看法

wenyi 解决的确实是真实需求。以前要翻译一本英文书,要么逐段复制粘贴给 AI(前面忘了后面),要么用浏览器插件(管不了 EPUB)。wenyi 的思路是把整本书当一个整体来处理——先通读,再翻译,最后审校。这个流程设计比”直接丢给大模型”要合理得多。

我不是说它的翻译结果能替代专业译者的工作。但在自己读英文原著这个场景下,它能帮你把门槛从”生词太多读不下去”降到”大致能看懂,生词偶尔查一下”——这对大多数人来说,已经足够打开一本书了。

开源免费,花十几分钟配好环境,值得试一下。


你最近有没有想读却卡在语言上的书? 评论区聊聊,我帮你看看 wenyi 能不能帮上忙。

觉得有用就 点赞 + 在看,转发给同样囤了一堆英文书的朋友。

项目地址:github.com/BigDawnGhost/wenyi

下期见。

喜欢这款工具?关注「善忘技术夹」全媒体

扫描二维码关注微信公众号与小程序,获取更多高品质开源软件推荐与效率工具测试。

善忘技术夹 微信公众号宣传图
微信公众号 (扫码关注)
善忘技术夹 微信小程序宣传图
微信小程序 (扫码即用)