Avatar Stream Demo

按住说话:麦克风的声音会实时送给数字人,由它复述并对口型。上传音频:整段一次性送入(像一个快速的 TTS)。
对话模式:麦克风常开送给豆包端到端语音模型,模型的回答由数字人说出来;说话会自动打断数字人。请戴耳机或依赖浏览器回声消除。