新浪科技讯 4月30日上午消息 ,小米开源首个为推理(Reasoning)而生的大模型‘Xiaomi MiMo’,联动预训练到后训练,全面提升推理能力 。
据介绍 ,在数学推理(AIME 24-25)和 代码竞赛(LiveCodeBench v5)公开测评集上,MiMo 仅用 7B 的参数规模,超越了 OpenAI 的闭源推理模型 o1-mini 和阿里 Qwen 更大规模的开源推理模型 QwQ-32B-Preview。
随着DeepSeek-R1引发业界强化学习(RL)共创潮,DeepSeek-R1-Distill-7B和Qwen2.5-32B已成为广泛使用的强化学习起步模型。在相同RL训练数据情况下 ,MiMo-7B 的数学&代码领域的强化学习潜力显著领先 。
值得注意的是,MiMo-7B全系列模型均已开源。据了解,MiMo 来自小米全新成立不久的“小米大模型Core团队 ”的初步尝试。(闫妍)
本文来自作者[520dpj]投稿,不代表单片通立场,如若转载,请注明出处:https://520dpj.com/zuozhezx/202504-3791.html
评论列表(4条)
我是单片通的签约作者“520dpj”!
希望本篇文章《小米开源首个推理大模型Xiaomi MiMo》能对你有所帮助!
本站[单片通]内容主要涵盖:单片通,生活百科,小常识,生活小窍门,百科大全,经验网,游戏攻略,新游上市,游戏信息,端游技巧,角色特征,游戏资讯,游戏测试,页游H5,手游攻略,游戏测试,大学志愿,娱乐资讯,新闻八卦,科技生活,校园墙报
本文概览: 新浪科技讯4月30日上午消息,小米开源首个为推理(Reasoning)而生的大模型‘XiaomiMiMo’,...