Skip to content

Feature Request:支持多模态大模型生成漫画剧情摘要,以辅助润色翻译 #1275

Description

@chencxt

版本信息

python 3.12.8
version v1.5.11

建议类型

功能优化

描述

目前,BallonsTranslator 已经支持了“上下文的 LLM 翻译”功能,可以通过参考已完成的页面历史来统一人名、术语和语气。然而,这种上下文是基于文本的,模型无法“看到”漫画的视觉元素,例如角色表情、场景氛围、动作细节等。

对于长篇幅漫画或剧情复杂的作品,仅依赖前文的文本翻译历史,可能不足以让 LLM 完全理解当前页面的语境,尤其是在角色首次登场或场景发生转换时,翻译的准确性和连贯性仍有提升空间。

Describe the solution you'd like
我注意到,目前一些更现代的 AI 漫画翻译工具(如“猫译员(https://nekonekone.com/?lang=zh-Hans)”和 manga-translator-ui)已经支持通过多模态大模型,获取漫画的剧情摘要或结合图像上下文进行高质量翻译。经测试后效果确实有所提升。

因此,在此建议 BallonsTranslator 参考并引入类似的功能

图片

No response

其他信息

No response

Metadata

Metadata

Assignees

Labels

enhancementNew feature or request

Projects

No projects

Milestone

No milestone

Relationships

None yet

Development

No branches or pull requests

Issue actions