Thanks to visit codestin.com
Credit goes to github.com

Skip to content

Latest commit

 

History

66 Commits

Folders and files

NameName
Last commit message
Last commit date
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 

Repository files navigation

ASMR Dubber

GitHub Release Windows 10/11 Linux x86_64 License: MIT

把日语或英语音频、视频制作成中文配音、双语音频和字幕。保留原声,识别、翻译、配音、混音可以分步执行,文字和时间可人工校对。

演示

demo-1.mp4
demo-2.mp4
demo-3.mp4

在 B 站观看完整演示。素材仅用于功能展示,如有侵权请联系删除。

下载与启动

Windows 从 GitHub Releases 下载便携 ZIP,完整解压到短且可写的路径,例如 D:\Apps\ASMR-Dubber

使用前请启用 Windows 长路径。 如果你的 Windows 设置中提供此开关,进入“设置 → 系统 → 高级 → 文件资源管理器”,打开“启用长路径”,然后重新启动 ASMR Dubber。未启用时,IndexTTS2 等第三方运行环境中的深层文件可能超过 Windows 的传统路径限制,出现“文件明明存在但程序报告找不到”的错误。如果当前 Windows 没有这个开关,请优先把程序解压到 D:\ASMR-Dubber 这类短路径,以降低路径过长的风险。

Windows“启用长路径”开关位置

  1. 首次运行 ASMR-Dubber-Setup.exe,选择安装方案。
  2. 安装完成后运行 ASMR-Dubber.exe,保留启动终端。
  3. 在“设置 → 设备与模型”检查后端,再配置识别、翻译和配音。

不要求预装 Python、uv、Git、FFmpeg 或 CUDA Toolkit。下载需要系统 curl.exe;本地 GPU 推理需要兼容的 NVIDIA 驱动。SmartScreen、显存要求及安装失败处理见安装指南

Linux x86_64(含 WSL2)在源码根目录执行:

bash scripts/linux/setup.sh 推荐
bash scripts/linux/run-ui.sh

需要 bashcurltargetconf;ARM64、macOS 不在支持范围内。CPU 也可运行部分本地后端,但长音频通常明显慢于 GPU。安装方案与硬件要求以安装指南为准。

安装方案 主要用途
基础 网页、媒体工具、Edge TTS 和 API 客户端,不含大型本地模型
推荐 基础 + 两个 Parakeet 日语模型;NVIDIA 机器再安装 IndexTTS2
进阶 推荐所需组件及 Kotoba、Faster-Whisper、ASMR VAD、Qwen3 对齐

IndexTTS-2.5 为按需安装项,不属于以上方案。英语本地识别需要 Faster-Whisper,不要把日语推荐方案当作英语模型包。

按你的素材选择流程

手上有什么 最短制作路线
只有日语/英语音频或视频 新建项目 → ASR → 校对原文 → 翻译 → 配音 → 混音
已有原文时间轴字幕 新建项目 → 导入原文字幕 → 翻译 → 配音 → 混音
已有中文字幕 新建项目 → 导入中文配音稿 → 配音 → 混音;不需要 ASR 或正文翻译
只有 TXT 台本 导入并选择估算时间或 ASR 台本重新定时,之后人工检查
多条音轨/多个作品 批量扫描 → 逐轨检查字幕、语言和顺序 → 加入队列 → 执行

详见使用指南完全依据已有字幕制作。字幕齐全是指每条所选音轨都有对应文件,不要求字幕覆盖音乐、停顿等每一秒。

设置保存到哪里

“设置保存范围”有三个选项:仅新项目默认值/仅当前项目/两者。默认只保存新项目默认值;要改变已打开的项目,必须选择“仅当前项目”或“两者”。API Key 使用各服务自己的保存按钮。

切换页签保留未保存草稿;刷新浏览器会丢弃草稿并开启新的页面会话,已有项目需重新打开。程序重启会重新加载运行环境,不等同于刷新网页。详见配置作用范围

多模型复核不是必选步骤

实验性,效果可能不如单模型。 新版先独立保存主稿,再让所选模型复听相同音频片段。默认只提出建议,不覆盖主稿、不依赖 LLM;可试听、比较、采纳、保留和撤销。它不保证提高识别准确率。

复核面板的用途说明、候选差异与试听操作

查看多模型复核图文教程。原文台本的 LLM 重新定时校对是另一个功能,不要混淆。

能用哪些后端

环节 支持范围
ASR Parakeet(日语)、Kotoba-Whisper(日语)、Faster-Whisper(日语/英语)、通用 ASR API
时间对齐 后端自带时间戳、Qwen3 ForcedAligner
本地配音 IndexTTS2、按需安装的 IndexTTS-2.5
在线配音 Edge TTS、MiMo、MiniMax、IndexTTS2 API、GPT-SoVITS、CosyVoice、Fish、通用 TTS API
翻译 DeepSeek、百炼、豆包、SenseNova、OpenAI、Claude、Gemini、OpenAI-compatible、DeepL、Google、Microsoft

Edge TTS 不需要密钥,但需要联网且不克隆音色。其它云服务需要用户自己的账户或服务端;程序不代为部署第三方服务。详见后端指南

数据、恢复与隐私

默认数据在 .asmr-dubber:项目在 projects,设置与密钥在 config,模型与环境在 modelsruntimes,批量状态在 autoflow。配置了外部项目目录时,需要另外备份那个目录。

  • 备份项目要复制整个项目目录,不是只有 project.json
  • 重试会复用满足条件的缓存;不要为排障直接删除整个 .asmr-dubber
  • 重做批量结果可能替换旧成品,先备份再明确选择重做。
  • Key 明文保存在 .asmr-dubber/config/secrets.json。不要共享配置目录或未经脱敏的日志。
  • 原文字幕、中文台本、音色参考会按所选服务发送;本地多模型复核本身不调用翻译 API。

详见排障指南安全策略支持入口

文档导航

文档索引选择入口:

许可

项目代码采用 MIT。模型、运行时、云服务、输入作品与生成内容适用各自规则,不因代码开源而自动获得使用授权。见第三方声明

友链

About

音视频字幕及配音工具:支持 ASR(语音识别)、台本导入、AI 翻译、双语字幕、音色克隆、TTS(语音合成)与混音以得到双语音频。

Topics

Resources

Code of conduct

Contributing

Security policy

Stars

185 stars

Watchers

0 watching

Forks

Releases

Packages

Used by

Contributors

Languages