给视频加字幕翻译不用一帧一帧抠了,BaoCut 新功能配合 Codex 自动搞定,还能导出到剪映。
BaoCut v0.8.2 新增视频画面翻译功能,可对视频中全屏 slides 进行 OCR 识别并添加翻译字幕。推荐使用 Codex Agent 自动化操作,无需人工干预。用户可在 GUI 暂停画面后点击 Screen Text 按钮进行 OCR,支持批量翻译队列。翻译结果以字幕叠加在原始文字上,可直接导出到剪映(CapCut)二次处理。
这两天终于把 BaoCut 的视频画面翻译功能做了,这功能技术实现不复杂,但是交互比较麻烦,也没有同类产品借鉴参考,迭代了好几个版本终于觉得还不错了。 亮点是可以 Agent(推荐 Codex)自动...
这两天终于把 BaoCut 的视频画面翻译功能做了,这功能技术实现不复杂,但是交互比较麻烦,也没有同类产品借鉴参考,迭代了好几个版本终于觉得还不错了。 亮点是可以 Agent(推荐 Codex)自动化操作,不用人工干预,另外翻译好的结果,可以直接导出到剪映(CapCut)二次处理。 用起来倒是很简单: 一种是自己去 Agent 那边,让 Agent 自己找出来需要翻译的画面帧,然后翻译后把翻译后的文字加到 OCR 出来的位置。 参考提示词: > 帮我转录翻译 <视频地址>,并为所有全屏的 slides (不是背景中的)也添加翻译 一种是自己从 GUI 主动在要翻译的位置暂停,然后点击播放器下面的 Screen Text 按钮,就能对当前画面进行 OCR,找出来所有文字位置,当然人工可以勾选哪些需要翻译的。 最开始的版本是一次翻译一张,后来发现太慢,现在改成了添加到队列,批量翻译,效率就快多了。 之所以没有做成图片翻译替换画面,是因为视频画面是动态的,如果只是替代一帧或者几帧,效果并不好,就折衷了一下,做成了字幕叠加在原始文字上,人工可以二次调整。 如果你还不是最新版本需要升级到最新版本(v0.8.2)。 下载地址: baocut.app Punkcan @punkcan @dotey 有一个点子,虽然我暂时不会用到 就是抓取画面上原文的内容,OCR之后,换成翻译的内容,可以呼叫Codex的图片生成 🔗 View Quoted Tweet 💬 2 🔄 0 ❤️ 4 👀 1026 📊 2 ⚡