跳转到正文
分享一个业务流程。DRING 两分钟内给您回电,梳理具体需求。 两分钟内接到回电
2 分钟内接到回电 查看 Agent Factory
语音核心

语音进来,做出决定,语音出去。

流式语音转文字、智能体推理、话轮管理和文字转语音,在每通电话背后作为一条链路运行,经过测试,可以替换,又不拖慢对话。

一轮对话,从头到尾

同一条链路,每一通电话

左边是进来的渠道,中间是语音核心在回应,记忆和工具就在旁边,右边是输出的结果。整条路径每次发布都经过测试和监控。

渠道 电话PSTN · SIP WhatsApp企业消息 邮件确认通知 语音到语音核心 记忆 工具 STT语音输入 LLM智能体大脑 TTS语音输出 实时音频链路 安全护栏实时校验策略 Agent Factory 每个版本持续改进 输出 结果记录每通电话都有评分 工作流Webhook · CRM 您的系统报表 来电客户 DRING AI 员工 全部渠道 同一个智能体 每通电话都有评分 测试 发布 监控

看看一个版本在走上这条路径前如何测试

核心内部

语音核心到底做什么

来电者的每一轮话,都要经过五个步骤,从线路到回应。有两项保障贯穿全部五步。

  1. 电话接通

    SIP、虚拟总机和已接入的电话路由把通话送进核心,外呼规则在拨号之前就已生效。

    电话线路详解
  2. 语音变成文字

    通话被实时转写,并在智能体推理之前完成纠错和规范化,口音、插话或说到一半的停顿,都不会扭曲原意。

  3. 智能体推理

    它结合之前几轮对话和其他渠道的记忆理解意图,在开口或操作之前核对安全护栏和政策,并在通话中调用所需的工具。

  4. 话轮自然衔接

    由一个专门的模型负责插话处理,让来电者可以在智能体说到一半时打断;以及话轮结束检测,让智能体既不在停顿时抢话,也不在对方说完后干等。

  5. 文字变成声音

    每个品牌从声音库中挑选精选声音,并设定语速、正式程度和语气的人设,配合口音纠正,以及针对人名、地名和产品术语的发音词典。

每一轮都如此

回应快,不冷场

工具或模型耗时较长时,一句取自 DRING 审批集合的简短自然的过渡语,让对话继续推进。

  • 无论背后是哪家供应商,回应都保持自然的节奏
  • 过渡语绝不出现在道歉、数字或结束语中

模型路由与故障切换

语音识别、语言和语音合成模型按智能体和语言分别选择,业务流程可以路由到另一个模型,无需迁移平台。

  • 某家供应商出现问题时,通话可以切换到正常工作的供应商
  • 更强的服务必须先通过整个技术栈都要跑的回归测试集,才会上线
查看运营数据快照
与文字对话共用

同一个智能体,能说也能写

语音和文字对话不是两套系统。底层的记忆、安全护栏和结果记录都是同一套。

同一份记忆

在电话里认出的人,在消息里也能认出;从电话开始的对话,可以在 WhatsApp 上接着聊,客户不用重复。

同样的安全护栏

提示词防护、事实核查和数据遮蔽,在口头回应上的执行方式与书面回应完全一样,不是一套打了折扣的规则。

同样的结果记录

一通电话结束时,留下的结构化记录和一段文字对话一样:结果、评分和您团队定义的字段,写入您的 CRM。

了解共用同一智能体的对话引擎

常见问题

语音核心常见问题。

语音核心和文字对话共用记忆和安全护栏吗?+

是的。关于同一位客户的一通电话和一条消息,共用同一个事项和同一份记忆;提示词防护、事实核查和数据遮蔽在两者上的执行方式也一样。

回应生成得慢怎么办?+

一句取自 DRING 审批集合的简短自然的过渡语会让对话继续推进,回应在后台同时完成;过渡语绝不用在道歉、数字或结束语中。

语音转文字和文字转语音的模型可以更换吗?+

可以。语音转文字、语言和文字转语音的供应商都可以按智能体和语言分别替换,业务流程可以路由到另一个模型,无需迁移平台。

智能体怎么知道来电者说完了?+

由一个专门的话轮管理模型负责:插话功能让来电者可以在智能体说到一半时打断,话轮结束检测让智能体知道来电者什么时候真的说完了,既不在停顿时抢话,也不在对方说完后干等。

声音从哪里来?+

来自一个精选声音库,按品牌和语言挑选,设定语速、正式程度和语气的人设,对声音做口音纠正,并配有针对人名、地名和产品术语的发音词典。

查看完整常见问题

用您自己的通话流程看看语音核心

授权同意后提交您的背景信息,DRING 会给您打电话,表明身份,并了解语音核心会如何处理您最繁忙的线路。