大模型江湖又出大事了。就在刚刚,小米向开源社区交出了一份"诚意满满"的作业——这一次,它搬出的不只是一个大模型,而是这个模型如何一步步变强的全过程。带队交卷的,正是被雷军重金挖来的95后"AI天才"罗福莉,她的评价也相当直接:这项技术难度,超过了DeepSeek R1。

交出"训练秘籍",诚意拉满
过去很多厂商开源模型,往往只把训练好的模型放出来,骨架有了,但"怎么做出来的"还是藏着掖着。小米这次的操作不太一样——它把模型获得能力的过程和工具也一并公开了,相当于不仅给你一条鱼,还把钓鱼的方法也讲了。在业内看来,这种"教学式开源"的诚意,属实少见。

罗福莉这位"卷王"又回来了
说起罗福莉,很多关注AI的人都不陌生。这个出身农村普通家庭的姑娘,曾是DeepSeek的关键开发者,深度参与过DeepSeek-V2的研发。后来被雷军以高额年薪挖进小米,负责带队做大模型。加入小米短短一个多月,她就完成了自己的AI首秀,放话"国内外模型代差从三年缩短至数月"。

她此前带出的MiMo大模型,总参数达到3090亿、活跃参数仅150亿,采用专家混合架构,推理速度提升了2.6倍,被业内称为国产模型跻身开源第一梯队。
难度超过DeepSeek R1,凭什么这么说
罗福莉敢这么"放卫星",底气在哪?这得先理解DeepSeek R1的分量。作为业界公认的最先进大语言模型之一,R1最大的亮点在于它开创性地提出了"不用监督微调、直接上强化学习也能训练好"的思路,还大幅开放了思考全过程,可以说是给整个行业立了新的技术标杆。

而小米这次公开的,恰恰是比"用模型"更难的一层——如何复现甚至超越这一水平的技术路径。如果说DeepSeek R1是"端上了一道好菜",那小米这次是"把后厨的配方和火候一起晒了出来"。难度自然上了不止一个台阶。
不只是秀肌肉,更是布局"人车家"
小米这么做,绝不只是为了炫技。业内普遍认为,小米打的是"人车家"全生态的算盘——让旗下的手机、汽车、家电全都"聪明起来"。此前小米的语音助手"超级小爱"就已经接入了DeepSeek R1大模型。把核心技术捏在自己手里,才能让生态里的每台设备都跑出自己的水平。

可以说,小米这次的"斩杀线"一役,既是对自身技术实力的正名,也是给整个开源社区的一份厚礼。大模型的天花板,正在被一家家中国企业不断抬升。
4001102288 欢迎批评指正
All Rights Reserved 新浪公司 版权所有
