
MoneyPrinterTurbo 离线配音上手3 个能力 1 张配置表跑通 AI 视频生成【免费下载链接】MoneyPrinterTurbo利用 AI 大模型和自动化工作流根据主题或关键词一键生成高清短视频。Generate HD short videos from a topic or keyword with an automated AI workflow.项目地址: https://gitcode.com/GitHub_Trending/mo/MoneyPrinterTurbo你有没有过这样的经历配音稿已经写好发给在线语音平台又舍不得按字数计费的账单产量一上来就跟着水涨船高。MoneyPrinterTurbo 是一个按主题一键生成 AI 短视频的开源项目输入关键词它自己写脚本、合成配音、打字幕、拼素材产出成片。其中的离线语音合成与字幕对时环节在本地完成语音文件不出你的机器敏感稿件也不用担心被第三方留存。1. 30 秒把 MoneyPrinterTurbo 跑起来git clone https://gitcode.com/GitHub_Trending/mo/MoneyPrinterTurbo cd MoneyPrinterTurbo pip install -r requirements.txt cp config.example.toml config.toml装依赖后打开config.toml填上大模型的 Key——大模型只负责写脚本语音合成、字幕对时这些环节本身不需要额外密钥。然后两个入口二选一sh webui.sh # Web 界面 python main.py # API 服务访问 127.0.0.1:8080/docs 查看接口在 WebUI 里输入主题、点生成几分钟后一条带字幕和背景音乐的成片就出来了。这是你的第一个跑通时刻比看十篇教程都让人上头。2. 三个核心能力拆解️ 双引擎 TTS日常用 V1正式内容上 V2项目内置两套语音合成引擎。V1 基于 edge-tts 库装完就能出声音适合日常批量试产V2 走 Azure 语音服务 SDK音色更自然、时间戳事件更精细适合正式交付的内容。在配置里补上密钥即可启用[azure] speech_key 你的密钥 speech_region 你的区域发音人名字带-V2后缀比如zh-CN-XiaoxiaoMultilingualNeural-V2时会自动路由到 V2 引擎不用改任何代码。没有密钥就用 V1两者接口完全一致。⏱ 字幕时间戳同步词与词对齐这是它和先生成音频、再手动补字幕的关键差别。合成时系统实时记录每个词的起始时间与持续时长直接产出词级字幕画面里的字幕永远跟得上声音不需要事后对轴。两种模式各有所长[app] subtitle_provider edge # 复用时间戳流快、轻量 # subtitle_provider whisper # 本地 faster-whisper 重新识别更准 1000 多语言发音人抄个名字就能用内置语音覆盖中、英、日、法、德等数十种语言每种语言都有多个音色可选。从 docs/voice-list.txt 里复制一个名字即可voice_name zh-CN-YunxiNeural-Male voice_rate 1.1 # 语速倍率中文有晓晓、云健这类常用音色英文有 Ava、Brian 等选音色前先试听比盯着参数表猜准得多。3. 语音合成参数怎么调、字幕模式怎么选参数作用怎么设voice_name发音人决定语言与音色语音列表里任意一个voice_rate语速倍率1.0 默认调大加速、调小放慢voice_volume人声音量倍率背景音乐大时适当调高subtitle_provider字幕模式求快 edge求准 whispermax_concurrent_tasks并发生成任务数默认 5机器吃力就调小Whisper 模型推荐large-v3有 GPU 就把[whisper]段的device改成cuda识别速度会明显变快。想控制素材缓存位置就设置[app]的material_directory不填默认落在./storage/cache_videos批量生产时素材可复用不必重复下载。4. 两个真实工作流中文口播教学视频。需求是课程导学片讲解要清楚、节奏不能赶。关键配置发音人zh-CN-XiaoxiaoNeural-Female语速 1.1字幕走 whisper 保证术语准确。一条任务走下来脚本、配音、词级字幕、素材拼接全部就位成片直接可用不用再开剪辑软件。多语言演示视频。需求是产品演示中文和英文各出一版配音。关键配置中文用zh-CN-YunxiNeural-Male英文用en-US-JennyNeural把内容拆成两个任务并行生成视频选 1920x1080 横屏。两版配音跑完字幕字体风格一致导出即可交付。5. 你大概率会遇到的问题 怎么绕开字幕不准切到 whisper 模式保证语音音频干净有 GPU 就把 device 改成cuda。edge 模式适合快速验证正式内容值得多等 whisper 那几十秒。生成慢、机器吃力先把max_concurrent_tasks降到 1–2 再试。语音合成本身不重耗时大头通常在素材下载和视频拼接耐心等资源释放比升级硬件更实在。机器该怎么配档位CPU内存存储最低4 核8GB256GB SSD推荐8 核16GB512GB SSD最佳12 核以上32GB1TB SSD6. 接下来会去哪、怎么参与团队排进路线图的几件事接入本地自定义语音模型比如用 GPT-SoVITS 训练专属音色、给声音加情感表达、以及一键发布到视频平台。想参与的话入口很明确发现 Bug 或有新想法提 Issue会写代码发 PR文档哪页写得别扭直接帮忙改。7. 今天就做的 3 件事克隆仓库装依赖用默认配置在 WebUI 生成一条成片翻一遍语音列表试听 3 个不同发音人记下你最喜欢的那个名字把subtitle_provider在 edge 和 whisper 之间切一次对比两模式字幕质量。想再深入从使用文档 sites/docs/guide/ 入手语音合成的核心代码在 app/services/voice.py视频拼接流水线在 app/services/video.py对着跑通的任务读一遍收获比翻十篇评测大。【免费下载链接】MoneyPrinterTurbo利用 AI 大模型和自动化工作流根据主题或关键词一键生成高清短视频。Generate HD short videos from a topic or keyword with an automated AI workflow.项目地址: https://gitcode.com/GitHub_Trending/mo/MoneyPrinterTurbo创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考