语音AI不再一停顿就抢话:Tavus推出Sparrow-2
发布时间:2026-08-31
动察 Beating AI 快讯,AI 数字人公司 Tavus 推出实时对话理解模型 Sparrow-2,专门判断语音 Agent 现在该听、该等、该说,还是继续说。它不再先把背景声音全部滤掉,而是把说话内容、语气、停顿、说话人、旁人声音和环境噪音一起判断,每 10ms 更新一次对话状态。这让它能处理很多传统语音 AI 容易翻车的场景。你停几秒想下一句话,它可以继续等;你说一句「嗯哼」,它能判断是在鼓励 AI 继续说,不会立刻停下;旁边有人讲话,也不一定会被当成你在抢话。声音实在听不清,它会要求重说,而不是硬猜。Tavus 在 575 个真实对话节点中测试 AI 会不会抢话或漏答。Sparrow-2 的对话时机失败率只有 2.1%,约为最佳对照模型的四分之一。遇到用户停顿 1 秒以上思考时,它有 97% 的情况会继续等,不会误以为用户已经说完。这种「耐心」也不是靠单纯延迟回答换来的。Sparrow-2 和两个对照系统成功接话时,中位回复时间都是 680ms。Sparrow-2 主要是更会判断什么时候该等、什么时候真的该开口。----------缘辉旺盾网量化工具温馨提示:数字货币投资有风险,入市需谨慎;本文章不作为投资依据,仅供参考----------交流群:https://t.me/dunwangyuanhuiwang

动察 Beating AI 快讯,AI 数字人公司 Tavus 推出实时对话理解模型 Sparrow-2,专门判断语音 Agent 现在该听、该等、该说,还是继续说。它不再先把背景声音全部滤掉,而是把说话内容、语气、停顿、说话人、旁人声音和环境噪音一起判断,每 10ms 更新一次对话状态。


这让它能处理很多传统语音 AI 容易翻车的场景。你停几秒想下一句话,它可以继续等;你说一句「嗯哼」,它能判断是在鼓励 AI 继续说,不会立刻停下;旁边有人讲话,也不一定会被当成你在抢话。声音实在听不清,它会要求重说,而不是硬猜。


Tavus 在 575 个真实对话节点中测试 AI 会不会抢话或漏答。Sparrow-2 的对话时机失败率只有 2.1%,约为最佳对照模型的四分之一。遇到用户停顿 1 秒以上思考时,它有 97% 的情况会继续等,不会误以为用户已经说完。


这种「耐心」也不是靠单纯延迟回答换来的。Sparrow-2 和两个对照系统成功接话时,中位回复时间都是 680ms。Sparrow-2 主要是更会判断什么时候该等、什么时候真的该开口。

----------缘辉旺盾网量化工具温馨提示:数字货币投资有风险,入市需谨慎;本文章不作为投资依据,仅供参考 ----------交流群:https://t.me/dunwangyuanhuiwang