|
今天一大早,科技圈就炸了锅。 小米搞了个大动作,把自家MiMo-V2.5系列模型正式开源了。最关键的是,这模型不光能力能打,首日就适配了一大波国产芯片。 你没看错,就是首日。 咱们干了这么多年半导体观察,见过太多“开源即画饼”的事儿。代码是放出来了,可你要真想在国产芯片上跑起来?等吧,少则几周,多则半年。可这一次,小米和几家国产芯片厂商的动作,快得有点不像话。 阿里平头哥、百度昆仑芯,都在名单里先看看这次都适配了谁。 阿里平头哥,用的是真武810E芯片。他们靠全栈自研的AI软件栈,直接深度搞定了适配。 百度昆仑芯也没落下,靠着自研架构,底层算子一优化,模型跑得又稳又快。 除了这两家,还有燧原科技、沐曦、天数智芯。燧原在自家L600上已经全量适配完毕,长文本场景下表现不错。沐曦的曦云C系列,能原生支持Triton语法到自家GPU指令集。天数智芯也是Day 0级适配。 说实话,看到这个名单,第一反应是:国产芯片的软件栈,真比以前强太多了。 做过AI芯片的人都知道,硬件是一回事,软件适配是另一回事。以前大家总觉得国产芯片“卡脖子”卡在制造上,其实生态才是更难啃的骨头。你芯片算力再高,主流模型跑不起来,或者跑起来效率低得吓人,谁用啊? 可这次,小米MiMo-V2.5一开源,平头哥和昆仑芯当天就能跟上。这说明什么?说明咱们国产芯片的软件栈,已经不是“等米下锅”的状态了,而是随时准备着。 为什么这次适配这么快?这里面有两个关键点。 第一,小米这次用的MIT协议,非常开放。允许商用、允许二次训练、允许微调,不用额外授权。厂商没有法律包袱,敢直接上手干。 第二,也是我更想说的,国产芯片厂商这两年真的被“逼”出来了。从训练到推理,从框架到算子库,大家都在拼命补课。以前总说“适配难”,现在你去看,平头哥、昆仑芯、燧原,哪个不是把自研软件栈当命根子在做? 就拿推理框架来说,这次小米模型同步适配了SGLang和vLLM,这两个是目前主流的高性能推理框架。能在这俩框架上首日跑通,说明模型本身的设计就没给芯片厂商挖坑,同时也说明芯片厂商的反应速度真的上来了。 模型本身到底牛在哪?说完芯片,咱也得看看这模型到底值不值得这么兴师动众。 小米MiMo-V2.5有两个版本:V2.5通用版和V2.5-Pro旗舰版。Pro版在权威榜单上,综合智能指数已经是全球开源并列第一了,Agent专项指数直接开源第一。所有大模型(包括闭源的)总榜里,它排第五,跟Claude Opus 4.6、GPT-5.4这些大佬站一块了。 主打能力是两个:智能体(Agent)和百万级长文本。 简单说,Agent就是让模型自己能“动手干活”,不光会聊天。长文本就是一次性能处理超长内容,比如一整本小说或者几十页财报。这两个方向,恰恰是目前大模型从“玩具”走向“工具”的关键。 一个值得深思的问题看到这里,我其实在想一个问题。 以前我们说“模型生态”,基本上默认就是英伟达CUDA的生态。国产芯片想要分一杯羹,得等模型厂商专门给你做适配,优先级永远排在后面。 可现在,小米带头把模型开源了,而且主动把适配工作做在前头。再加上平头哥、昆仑芯这些国产芯片厂商,已经有了能快速跟上的能力。这是不是意味着,咱们自己的“模型+芯片”闭环,正在加速形成? 以后会不会出现这种情况:一个新的国产大模型出来,首日适配的国产芯片数量,比国际大厂还多? 这个问题的答案,可能不用等太久。
版权声明
“特别声明:以上作品内容(包括在内的视频、图片或音频)为用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user , the platform merely provides information storage space services.”
本文地址: https://www.amtbbs.org/thread-18184-1-1.html
|