Chenyme AAVT 是一个功能强大、使用简单的全自动视频 / 音频 翻译工具 。它可以快速识别声音并翻译生成字幕文件, 然后将翻译后的字幕与原视频合并, 生成翻译后的视频。该项目主要基于 OpenAI 的 Whisper 进行声音识别, 支持多种 语言 , 并利用 LLMs 如 ChatGPT、KIMI、DeepSeek 等进行字幕翻译, 或使用本地大语言模型进行翻译。它还支持 GPU 加速和 VAD 辅助, 提高了识别和翻译的 效率 。此外, 该工具支持输出多种字幕格式, 并提供字幕修改和预览功能, 同时还支持对音频直接进行 AI 总结和问答。项目使用 Streamlit 搭建了一个快速使用的 WebUI 界面, 并利用 FFmpeg 实现了字幕与视频的合并。总的来说, 这是一个功能强大、使用简单的全自动视频 / 音频翻译工具, 值得广大用户尝试使用。
开源地址:https:// github .com/Chenyme/Chenyme-AAVT
【新用户手机夸克APP转存可以获得1TB免费空间】
夸克网盘「电影」精选合集:https://pan.quark.cn/s/0755e002f4b6
夸克网盘「纪录片」精选合集:https://pan.quark.cn/s/8c76cd47e8be
夸克网盘「短剧」精选合集:https://pan.quark.cn/s/0f27fae4301e
夸克网盘「音乐」精选合集:https://pan.quark.cn/s/c999e39a7f49
夸克网盘「教程」精选合集:https://pan.quark.cn/s/27984fcacdad
夸克网盘「书籍」精选合集:https://pan.quark.cn/s/2532536273dd
评论列表
发表评论