VoiceBot 调试控制台
麦克风 → ASR → LLM/知识库 流式回复 → 流式合成播报;支持 VAD 自动打断 / 手动打断 / 按住说话。上游配置与密钥均在服务端。
机器人界面 →
设置
自动保存到本地
访问
访问码(服务端设置了 APP_ACCESS_TOKEN 时必填)
-
语音合成
Voice
(默认)
加载 voices
Instructions(可选)
播放模式
流式(首音快;起播缓冲越大越不卡)
整段(先合成完再播,绝不卡,首音最慢)
起播缓冲(秒,流式:0=来了就播/首音最快但易卡,越大越不卡)
语音识别
Language(可选,如 zh)
对话
System prompt(普通模式)
你是一个语音对话助手。回复要口语化、简短,一般不超过三句话,不要用列表和 markdown。
知识库
知识库模式
(勾选后对话走知识库;也可说「问知识库」切换)
System prompt(可选,留空则用知识库自带)
VAD / 打断
麦克风(启动对话授权后可见设备名)
(系统默认)
灵敏度阈值(能量 RMS,当前
0.015
)
打断音量倍数(当前
1.8
x — 打断需比断句阈值响这么多倍,防旁人误触发)
断句静音时长(ms)
播放中检测到说话自动打断
按住说话模式(关闭 VAD 自动断句)
外放容易自触发时:调高阈值,或戴耳机。打断需持续说话约 0.2s 才触发,防止杂音误判。旁边有人说话误触发打断时,调高「打断音量倍数」(旁人离麦克风远、能量低,够不到门槛)。设置同样作用于机器人界面。
对话
未开始
ASR 耗时
-
LLM 首字
-
TTS 首音
-
端到端
-
开始对话
打断
清空对话
下载上轮音频
按住说话(或长按空格)
发送
日志
清空