Dograh
开源可自托管的语音Agent平台
可视化构建语音工作流,支持STT-LLM-TTS级联与语音到语音双模式,MCP原生支持,数据完全自留。

核心功能
可视化工作流构建器
拖拽式设计语音对话流程,支持开始节点、Agent节点、工具调用和条件分支,零代码完成复杂对话配置。
灵活的语音技术栈
自由选择STT、LLM、TTS服务商组合成级联管线,或一键切换至语音到语音模型实现实时音频交互。
MCP原生Agent管理
通过Claude Code、Cursor等MCP客户端直接在IDE中创建、修改和部署语音Agent。
自托管与VPC部署
在自己的服务器或云VPC中运行,通话、录音、提示词和客户数据完全由自己掌控。
服务商自由选择
接入OpenAI、Gemini、Deepgram、ElevenLabs、Twilio等数十家主流模型与电话服务商。
产品特色
- 01
开源透明,无厂商锁定
开源代码,审计透明。不受任何商业平台绑定,随时可迁移或自行维护。
- 02
数据主权与合规内置
支持本地部署或VPC内运行,AI模型也可部署在自有边界内,满足HIPAA、GDPR、SOC2等合规要求。
- 03
混合语音输出更自然
将预录真人语音与TTS合成在同一音色中无缝混合,延迟更低,成本最高可降3倍,听感更自然。
- 04
语音到语音实时交互
音频直接进直接出,跳过转录文本的中间环节,支持自然的轮替对话和实时打断,延迟极低。
- 05
两分钟从零到可用
从零开始到第一个可工作的语音Bot,严格控制在2分钟以内,大幅降低语音AI的上手门槛。
应用场景
✅ 呼入客户支持
构建能回答常见问题、收集信息、路由请求,并将复杂案例转接给人工的语音客服Agent。
✅ 外呼营销与催收
自动化完成提醒、跟进、销售线索筛选、催收等结构化外呼任务,支持批量发起。
✅ 受监管行业自动化
在私有基础设施内部署,处理涉及医疗、金融、法律等敏感数据的语音工作流,满足合规要求。
✅ 预约与信息采集
通过可配置的语音对话完成排期、确认、初步接洽和信息收集,替代人工重复劳动。
✅ 开发者自建语音产品
为工程团队提供开放可定制的基础平台,将语音Agent能力嵌入自有应用和服务中。
常见问题
解答您关于"Dograh"的常见疑问,让您更好地使用这款AI工具
-
Dograh是100%开源的自托管替代方案。代码完全透明,数据自主可控,不会被任何商业平台锁定。
-
可以。Dograh支持接入OpenAI、Gemini、Deepgram、ElevenLabs、Twilio等数十家主流服务商,也支持自托管模型。
-
Dograh支持本地部署或VPC内运行,通话、录音、转录、提示词和客户数据从不离开你的网络边界。
-
音频直接进直接出,跳过先转录成文本再生成回复的中间环节,延迟更低,支持自然的轮替对话和实时打断。
-
将预录的真人语音片段与TTS合成在同一音色中混合使用,适合重复性回答,延迟更低、成本更低、听感更自然。
-
Dograh提供MCP(Model Context Protocol)服务器。开发者可以在Claude Code、Cursor等AI编程助手中直接创建和修改语音Agent,无需离开IDE。
立即体验 Dograh
Dograh是一个开源语音Agent基础设施,可作为Vapi和Retell的自托管替代方案。提供可视化工作流构建器,支持STT-LLM-TTS级联管线与语音到语音实时交互双模式。支持自托管部署、MCP原生集成、混合语音输出,数据可完全留在自有边界内。适用于呼叫中心、外呼营销、受监管行业自动化等场景。