首页 > 生活分享 > 免费教学 > 智源研究院开源原生全双工语音大模型RoboBrain-Audio

智源研究院开源原生全双工语音大模型RoboBrain-Audio

发布时间:2025-09-25 21:49:33

语音交互作为人机通信的关键接口,长期以来受限于高延迟、低自然度的交替式对话架构。为突破这一瓶颈,北京智源人工智能研究院联合 Spin Matrix 与新加坡南洋理工大学,正式发布RoboBrain-Audio(FLM-Audio)首个支持 “自然独白 + 双训练范式” 的原生全双工语音对话大模型。



RoboBrain-Audio 采用原生全双工 (Native Full-duplex) 架构,相比传统的 TDM(时分复用)模型在响应延迟、对话自然度上实现飞跃式提升,同时语言理解能力显著强于其他原生全双工模型,标志着具身智能体从 “能听会说” 向 “边听边说” 的交互能力跃迁。

根据公开数据,当前业界训练音频基座模型时使用的数据量已达到上千万乃至上亿小时,这些模型在音色克隆和长回复生成上更具优势,而 RoboBrain-Audio 仅使用 100 万小时 (业界数据量的 1%) 数据训练,不但回复质量满足日常交互需求,而且具有响应模式更为敏捷自然等优势,尤其适配具身场景。RoboBrain-Audio(FLM-Audio)相关论文已公开发布,模型与代码均已开源。

免费教学更多>>

Intel大小核梦开始的地方:12代酷睿处理器停产在即! 宏碁推Acer Chromebook (Spin) 311:采Kompanio 540,面向教育 苹果胜诉:美国加州iPhone隐私收集案指控被驳回 vivo五连冠,小米创新高,OPPO三合一 ColorOS 16一月体验升级内容推送:支持iPhone通信互联 年货消费“变天”了!AI正在改写电商的底层逻辑 百度文心5.0正式版上线,模型参数达2.4万亿 一键复制 10 年工作经验,Coze 2.0 Skill 实测|AI 上新 OpenWrt One路由器装Debian系统,摇身变轻量级服务器! 今年Pro Max旗舰扎堆亮相:国产TOP5厂商集体跟进 对标苹果 联想moto X70 Air Pro官宣支持中国国家地理山河四季联合影像 OpenAI正式进军脑机接口,投了自家CEO阿尔特曼的新公司 民企纳税百万可买原价飞天,自营店:满足条件即可,茅台销售公司:仅针对原有客户 OpenAI想造“AI耳机”,但可能闹了个笑话 钱不白花!老主板升级50显卡带不动?实测解除你的焦虑 REDMI Turbo 5 Max跑分曝光 天玑新款旗舰芯片 网传小米阔折叠9月发布,拥有自研AP芯片、折叠OS等卖点 阿里千问发布会在即 神州数码蹭上阿里云热度 库克退意已决!新CEO候补是个「硬件控」 王自如放话安卓做不出好Air?荣耀李坤:你远离圈子太久了 真我Neo8真机亮相!赛博紫+觉醒光环,这波设计我直接跪了 2026开年王炸!TCL把旗舰级Mini LED价格打下来了 苹果Vision Pro邀你“坐”在场边看湖人队比赛:150Mbps码率 华为余承东带队前往广汽集团交流共建鸿蒙生态 vivo X300系列:双芯加持+影像续航双革新,1月底换机别错过! 华为和北汽的合作项目享界,结果余承东跑来看了,改成旅行车。 传长安汽车因2025年销量未达目标而取消员工年终奖引发不满! 丰田凯美瑞VS星海S7,到底谁才是真正的“家用王炸”? 现代起亚2025全球销售727.39万辆!坐稳全球TOP3 别克至境SUV预告图发布 延续概念车设计2026年内上市