Front Page
Watched
Popular
Torrents
Favorites
My Home
My Uploads
Toplists
Bounties
News
Forums
Wiki
HentaiVerse

[Tetsuna] Yokubou no Hako 4 Wa (COMIC AUN Kai Vol. 42) [Chinese]

[テツナ] 欲望の箱 4話 (COMIC 阿吽 改 Vol.42) [中国翻訳]

Manga
Posted:2026-10-10 14:38
Parent:None
Visible:Yes
Language:Chinese  TR
File Size:55.59 MiB
Length:24 pages
Favorited:321 times
Rating:
59
Average: 2.27

Showing 1 - 20 of 24 images

<12>
<12>
Posted on 10 October 2026, 14:38 by:   火的意志    PM
Uploader Comment
通过 manga-translator-ui 进行 AI 翻译,翻译 API 用了 GLM、Kimi 和 DeepSeek,Agent 用的是 Codex、Claude Code 和 DeepSeek Harness
专门翻译一些暂时没有人翻译的催眠类题材作品,无广告,无水印
raw:https://e-hentai.org/g/4051082/9b88bb99b9/
Posted on 10 October 2026, 14:39 by:   火的意志    PM
Score +22
这一批和之前不太一样,想借这条评论聊聊这段时间折腾机翻的一些想法。

一开始我以为翻译效果不好是模型的问题,所以前后实测了好几批 API,结果发现效果其实大差不差。真正拖后腿的是 OCR:有时候认出错字,有时候只认出半句,有时候干脆没认出来。原文都给错了,翻译模型再强也只能对着错的原文瞎猜,不光译文质量差,页面效果也跟着变差——有的拟声词翻了,有的又没翻,翻出来的拟声词还经常乱七八糟。再加上翻译模型看不到画面,不知道一句话是谁对谁说的,日语又经常省略主语,人称搞反也就很常见了。

所以后来我把力气都花在了流程上,整理成了一个翻译 Skill。思路是:翻译模型看不到画面,那就让能看图的 Agent 把它缺的信息补上。现在每一本大概是这样走的:
1. 先用 manga-translator-ui 跑一遍,只负责检测气泡、算出擦字和排版要用的坐标,再给出一版 OCR 初稿。不让 Agent 从零识别文字,因为它看得懂画面,但定位不了精确的气泡位置。
2. 脚本按坐标排出初步的阅读顺序,把每个气泡的编号、阅读顺序连线和"OCR 可能认错"的标记画在原图上,生成预览图。
3. Agent 逐页看预览图,这一步是整个流程的核心:阅读顺序不对就改,比如跨页大格、斜着排的气泡;标出每个气泡是谁说的、对谁说的,是对白、心理、旁白还是拟声词;OCR 认错或者只认了一半的,照着原图把原文改对。对白、心理和旁白就算 OCR 认得再烂也一定要翻,认不全的拟声词才保留原图不动。同时给这部作品写一份剧情概要、人物表(每个人怎么自称、说话什么语气、怎么称呼别人)和专有名词表。
4. 把这些标注和原文一起,几页一批交给翻译 API,每一批都带上前一批的中日对照当上下文,中途断了也能接着翻。
5. 翻完先让脚本检查漏翻、译文太长、同一句话前后译法不一致;然后 Agent 再按最终的阅读顺序,对照原图和原文一页一页审,人称、肯定否定、前因后果这类错误直接改掉。只有放大原图也看不清、或者几种理解都说得通的地方,才列出来让我判断。
6. 最后写回工程,把不需要翻译的区域保护好,避免渲染时把乱码画上去,再交回 manga-translator-ui 出图。
用上这个 Skill 之后,人称、语气和句子衔接都顺了很多,漏翻明显少了,拟声词也不再一会儿翻一会儿不翻。

这个 Skill 也在一直更新:每翻完一本,我会让模型把它总结出来的翻译规则和注意事项整理出来,持续更新进 Skill 里,让它不断"学习"。不过更新之前必须先把要改的内容列出来给我检查,免得把不必要的信息写进去。

为了试这些东西,前前后后大概花了四五百块,调各家官方 API、买 coding plan。到现在我差不多已经翻译了 150 本,但其中一百多本是用老流程翻的,质量比不上这一批,除了之前已经传上来的那些,剩下的我也懒得传了,就留在本地吧。

这一批的提升主要来自工程上的优化,而不是换了更好的 API。也就是说,随着模型越来越强,效果只会越来越好;而工程这边,我感觉已经优化得差不多到极限了。

把这些想法写出来,是想分享给所有正在用机翻、或者以后可能会用机翻的朋友,也欢迎大家把自己的经验分享出来。
Posted on 10 October 2026, 16:58 by:   wewwun    PM
Score +7
大佬可以打包成项目放github吗?
Posted on 10 October 2026, 17:27 by:   fyjwqh    PM
Score +6
先说机翻。
机翻其实确实能做到较好的程度,但是由于扣字的问题会导致句意和上下文读取不全,但是对于部分语言来说上下文的缺失只会导致语言逻辑上的不连贯而不是单句的歧义。除非是遇到很诡异的双关和别的什么文艺语言才会导致完全脱离原意。
再说机嵌,机嵌效果真的很差,我目前是没有看到一个十分优秀的机嵌,嵌字的字体大小,方位,艺术化目前的ai都做不好,对于后续的汉化我还是建议手嵌而不是机嵌,你的文字都不舒服我看什么内容呢,而且ai有些修图就是完全的抽象。
再说对于目前的ai汉化
我希望的是润色+手嵌,理由已经说了,目前的ai局限性还是太大了,你搞了半天还不如自己用PS,sai2甚至美图秀秀修图来的自在。翻译的话也是要校对一遍的。AI全自动带来的毁画廊事情真是屡见不鲜,我已经看了一堆库库跑一堆垃圾出来的ai全自动画廊了,这个画廊也很难说优秀,一堆小毛病都是人工做不出来的。不过既然自己说了ai辅助,我也会稍微谅解,但是不想看到成堆的低质量作品来把e站当免费网盘用。
还有那些觉得能骗过别人说自己没有用ai的人,别觉得别人看不出来,1天90多p的拟声词加汉化嵌字觉得自己老厉害了说是。
Posted on 10 October 2026, 20:14 by:   火的意志    PM
Score +7
研究机翻只是为了自己能体验那些大概率不会有人翻的漫画,我也不会觉得我的质量就很顶尖发出来求表扬的,所以对质量的要求当然是点到而止了,能在工程上优化最好,不能那我大不了就自己看,事实上这次发出来是为了看评论区分享经验的,也有很多人分享了他们对机翻的经验。嵌字机器替代不了,但是人工又很耗费精力,所以还是像我说的,大不了以后不发,自己看就完事了,欢迎更多人能分享更好的汉化
Posted on 10 October 2026, 21:39 by:   wellknow    PM
Score +8
这个总结确实是很有意思,嵌字问题本质是扩散模型实际上看不懂字,llm实际上看不懂图
Posted on 11 October 2026, 03:37 by:   RyN9Sun    PM
Score +5
而你我的朋友 你才是真正的英雄

[Post New Comment]

Front   LoFi   Forums   HentaiVerse   Wiki   ToS   Advertise