经过六天的激烈竞争,小米的“炼丹直播”圆满结束,期间烧掉超过2000万元人民币。小米将大模型强化学习训练过程搬入直播,为此投入350万美元(约合人民币2344万元),成功完成了MiMo-V2.6的Pro和Flash版本的30个训练步。MiMo-V2.6-Pro设置了1.02万亿个参数并获得了46分,荣登开源模型排行榜的首位。Hugging Face的首席执行官对此表示赞赏,并指出Pro在与Claude Opus 5和GPT-5.6 Sol的对比中接近顶尖水平。
小米MiMo团队的负责人表示,这次训练的规模和技术挑战是前所未有的。在这次直播的最终结果中,Pro和Flash均完成了各自的训练步骤,Pro耗时5天3小时,而Flash耗时3天10小时,分别花费了260万美元和90万美元。每个步骤都生成了大量数据,最终呈现了明显的提升效果。Flash的平均通过率提高了25%,Pro则提升了12%。
在针对真实开源代码库的DeepSWE v1.1测试中,两款模型的分数也都有显著提升。MiMo-V2.6-Pro在全球开源领域的排名进一步提高,且费用依然保持与V2.5相同,成本大幅低于其他国际领先模型。MiMo-V2.6-Pro在执行智能任务时,每项任务的平均成本仅为0.13美元,确保了其在相同智能水平中具备更高的性价比。 龙8头号玩家
小米也同时开放了Pro和Flash的模型权重、技术报告和丰富的训练环境,旨在推动开源社区的发展。
Copyright © 头号玩家(龙8)唯一官网 版权所有 网站地图
留言框-