
Dograh快速入门从Docker Compose到第一个AI电话助手的完整教程【免费下载链接】dograhOpen source voice AI platform. Self-hosted alternative to Vapi and Retell. On Prem, BYOK across Speech to Speech or LLM/STT/TTS, with a visual workflow builder, MCP native and telephony support.项目地址: https://gitcode.com/GitHub_Trending/do/dograhDograh是一个开源、可自托管的语音AI平台被誉为 Vapi 和 Retell 的自托管替代方案。通过 Docker Compose 一条命令即可在本地或服务器上部署完整的语音AI基础设施再用可视化工作流编辑器在 5 分钟内创建你的第一个 AI 电话助手——支持 LLM/STT/TTS 或端到端 Speech-to-Speech 模型自带 MCP 集成与电话线路Twilio、Vonage、Telnyx 等支持数据完全掌握在自己手里。本文将从零开始带你走完「Docker Compose 部署 → 创建语音助手 → 浏览器实测 → 接入真实电话」的全流程。为什么选择 Dograh 部署语音AI对比维度Dograh商业SaaS方案开源协议BSD 2-Clause100% 开源闭源自托管✅ 一条 Docker 命令❌ 仅 SaaS模型选择BYOK任意 LLM/STT/TTS 提供商受限于平台集成数据主权你的基础设施你的规则平台云端供应商锁定无有核心卖点零 API Key 门槛。Dograh 自带自动生成的密钥和完整的 LLM/TTS/STT 技术栈开箱即用想换成自己的模型密钥BYOK随时可以切换。部署前准备系统与端口检查开始之前先确认环境满足以下最低要求详见 prerequisites.mdx 文档目录下的说明内存8 GB其中 4 GB 分配给 Docker磁盘10 GB 可用空间CPU2 核x86_64 或 ARM64 均可系统macOS 10.15 / Windows 10/11WSL2/ Linux软件Docker 20.10Docker Compose 已内置同时确认这些端口未被占用3010Web UI、8000API、5432PostgreSQL、6379Redis、9000/9001MinIO 对象存储。# Linux/macOS 检查端口占用 lsof -i :3010 如果使用 Docker Desktop记得在Settings → Resources中至少分配 4 GB 内存、2 个 CPU。第一步Docker Compose 一键部署 Dograh打开终端执行下面这条命令它会自动下载docker-compose.yaml和启动脚本生成必要的密钥与.env文件然后拉起全部服务curl -o docker-compose.yaml https://raw.githubusercontent.com/dograh-hq/dograh/main/docker-compose.yaml curl -o start_docker.sh https://raw.githubusercontent.com/dograh-hq/dograh/main/scripts/start_docker.sh chmod x start_docker.sh ./start_docker.sh这条命令背后做了几件关键的事下载最新的 docker-compose.yaml 编排文件自动创建OSS_JWT_SECRET、REDIS_PASSWORD等凭据到.env启动 PostgreSQL、Redis、MinIO、API、UI 等全部服务自动拉取最新镜像⏱️ 首次启动需要 2-3 分钟下载镜像。不想收集匿名遥测数据的话在执行前设置ENABLE_TELEMETRYfalse即可。Windows 用户使用 PowerShell 版本脚本见scripts/start_docker.ps1Invoke-WebRequest -OutFile docker-compose.yaml https://raw.githubusercontent.com/dograh-hq/dograh/main/docker-compose.yaml; Invoke-WebRequest -OutFile start_docker.ps1 https://raw.githubusercontent.com/dograh-hq/dograh/main/scripts/start_docker.ps1; .\start_docker.ps1部署完成后浏览器打开http://localhost:3010即可进入控制台。第二步创建你的第一个 AI 语音助手进入控制台后创建一个新 Agent只需填写三项内容Call Type呼叫方向选Inbound用户打给 AI或OutboundAI 主动外呼Use Case用例用 5-10 个词描述场景例如「客服咨询」「保险线索筛选」Activity Description活动描述详细描述助手的任务它会被送入 LLM 生成完整的工作流提示词——描述越具体生成的对话流越贴合你的需求点击Create Agent后系统会直接进入可视化工作流编辑器。第三步看懂可视化工作流编辑器Dograh 的核心是拖拽式工作流画布LLM 会自动为你的用例生成一张包含Start Call开始呼叫→ Agent 节点 → End Call结束呼叫的流程图节点之间用路径pathway连接。点开任意节点就能编辑它的 Prompt 提示词还有几个高频开关值得了解Allow Interruption是否允许用户打断 AI 说话Add Global Prompt附加全局指令语气、异议处理等作用于整个流程Detect Voicemail检测到语音信箱自动挂断Delayed Start开场前加入延迟你不需要现在就理解所有节点类型——生成的 Agent 开箱即能跑通先听它说话再回头微调提示词。第四步在浏览器里实测你的 AI 电话助手这是最快验证效果的方式Web Call网页通话。无需电话号码、无需配置任何电话线路直接在浏览器中通过麦克风完成完整链路语音识别STT→ LLM 推理 → 语音合成TTS体验与真实电话一致。通话过程中你可以实时观察✅实时转写文本对话逐句上屏✅节点跳转Agent 在工作流图中移动的过程✅工具调用Agent 调用外部工具的全过程不满意直接打开对应节点修改提示词保存后重新发起 Web Call 即可听到变化——无需重新部署、无需重启。想快速迭代文本逻辑还可以用Test Chat以文字模式对话甚至编辑/重放某一轮用户发言让 Agent 重新生成后续回复。进阶接入真实电话线路 浏览器测试满意后下一步就是接真实号码。以接入最快的 Twilio 为例在 Twilio 注册账号并购买一个号码试用账户自带免费测试额度复制Account SID和Auth Token在 Dograh 中打开Telephony → Add Configuration选择 Twilio 提供商粘贴凭据务必勾选「Set as default for outbound calls」否则 API 触发呼叫会报错添加你购买的电话号码并指定呼入时路由到的工作流之后就可以从你的后端通过 API 触发外呼电话响起、AI 接听、实时对话——呼入方向同理经 Twilio Webhook 反向路由到 Dograh 工作流。此外平台还支持 Vonage、Telnyx、Plivo、Vobiz、Cloudonix 及 Asterisk ARI 等提供商。可选优化换用自己的模型或嵌入网站BYOK 模型配置在Models页面可以切换「Dograh 托管 / BYOK / Speech-to-Speech」三种模式填入自己的 API Key 后选择模型、音色、语速并保存嵌入网站不想走电话线路在 Agent 设置页找到Add to Website开启嵌入、选择 Floating Widget 等模式复制一段脚本标签贴到任意网页访客即可点击按钮直接与语音 AI 通话常见问题速查 ️问题解决方法端口被占用lsof -i :3010找到进程后kill -9 PID或docker stop $(docker ps -q)停止所有容器通话接通但没声音 /iceConnectionState: failed网络 NAT 较严格需启用 TURN 中继用scripts/setup_local.sh重新初始化选启用 coturn再执行docker compose --profile local-turn up停止/清理所有数据docker compose down加-v同时删除数据卷更多排查细节参考仓库中的docs/getting-started/troubleshooting.mdx。下一步学什么部署成功只是起点按官方文档路径继续深入 docs/getting-started/first-agent.mdx5 分钟构建第一个 Agent 的完整步骤docs/voice-agent/introduction工作流图模型与全部节点类型docs/voice-agent/api-trigger从后端 API 触发外呼docs/getting-started/add-tools-and-knowledge-base给 Agent 加工具和知识库api/mcp_server/MCP 服务器源码可让 Claude Code、Cursor 等编程助手直接在你的工作区创建和编辑工作流至此你已经从一条 Docker Compose 命令走到了能接真实电话的开源 AI 语音助手。剩下的就是让它为你干活了。【免费下载链接】dograhOpen source voice AI platform. Self-hosted alternative to Vapi and Retell. On Prem, BYOK across Speech to Speech or LLM/STT/TTS, with a visual workflow builder, MCP native and telephony support.项目地址: https://gitcode.com/GitHub_Trending/do/dograh创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考