开发完语音智能体后,我们可以通过 Agent 模拟器快速验证语音功能是否正常,包括播放能力、参数是否符合预期,以及交互体验是否达标。
1) 如何启动模拟器
你可以通过以下两种方式进入 Agent 模拟器:

2) 模拟器支持哪些语音调试能力
结合当前界面,模拟器支持以下语音调试能力:
- 语音参数可视化(胶囊信息):在音频卡片下方会展示
model
、voice
、format
、chars
等关键信息。
这可以帮助你快速确认“当前实际生效的模型和音色”是否与代码配置一致,也方便定位“为什么声音效果与预期不一致”这类问题。

- 播放/暂停控制:每条语音消息都支持独立播放与暂停。
你可以逐条检查不同回复的可播放性,验证智能体在多轮对话中是否都稳定返回了可用音频。

- 音量调节:播放器支持音量调整。
调试时可以快速判断是“音频生成异常”还是“播放音量过低”等体验问题,减少误判。

- 倍速播放与下载:支持倍速播放和音频下载。
倍速适合快速回听长语音;也支持对生成音频进行下载。

3) 总结
对于 TTS 智能体,Agent 模拟器可以覆盖“能否播、播得对不对、播放体验是否可用”的核心验证需求。
建议每次改动模型、音色或合成参数后,都可以在模拟器里做一轮快速测试。