Loading...
Techub News 消息,法国 AI 研究实验室 Kyutai 发布开源语音原生模型 Voice of Reason。该模型基于 GLM-4-Voice-9B,通过监督微调与强化学习训练,无需转录步骤或独立文本大模型即可直接解决口语数学问题。在口语 GSM8K 测试集上,其准确率从基线的 27.3% 提升至 77.1%。 模型包含两个版本:直接回答的 glm-4-voice-of-reason-9b 以及采用静默推理块的 Stitch 版本。研究团队称这是强化学习首次应用于语音原生模型的数学推理任务。模型权重继承 GLM-4-Voice 许可协议,可在单张 H100 GPU 上部署。(MarkTechPost)