|
7月17日凌晨,月之暗面正式发布新一代大模型Kimi K3。这款模型参数规模达到2.8万亿,拥有100万token上下文窗口,原生支持视觉理解。月之暗面称其为“迄今能力最强的模型”。 2.8万亿参数什么概念? 这是目前全球开源模型中参数规模最高的纪录。月之暗面有关负责人打了个比方:参数就像人脑里的神经连接,近3万亿参数意味着模型能把更多知识和规律装进“脑子”,懂得更多、想得更深、答得更准。 Kimi K3基于自研的KDA混合线性注意力机制和注意力残差技术构建。在MoE层面,模型设置了896个专家,单次推理只激活16个。这套架构让K3相比前代整体扩展效率提升了约2.5倍。 在第三方独立评测中,Kimi K3综合智能评分57分,位列全球第三,仅次于Claude Fable 5和GPT-5.6 Sol。在Frontend Code Arena编程榜单上,K3以1679分登顶榜首,超越了Claude Fable 5的1631分和GPT-5.6 Sol的1618分。这是开源模型首次在编程榜单上超越头部闭源模型。 发布后不到48小时,用户请求量就大幅超出预估,逼近现有集群的承载极限。月之暗面不得不暂停消费端新用户订阅,全力推进算力扩容。 真正让硅谷震惊的,是另一件事。 月之暗面团队公开了一组测试结果:在连续48小时的自主智能体运行中,Kimi K3完全基于开源EDA工具和Nangate 45nm工艺库,全程没有引入任何人工干预,独立完成了一款芯片从架构构建、性能优化到功能验证的全流程开发。 这款芯片面积4mm²,集成了146万个标准单元、0.277 MB SRAM以及带融合反量化的INT4 MAC阵列。在100MHz频率下完成时序收敛,仿真解码吞吐量超过每秒8700个token。 虽然这颗45nm工艺的芯片规格不算高,目前还属于概念验证阶段。但这是第一次有开源大模型独立完成完整的芯片设计流程,而且只用了48小时。 消息传回资本市场,直接引发了连锁反应。 全球EDA行业的两大巨头——新思科技和铿腾电子,盘中股价一度大跌超12%。新思科技最终收跌7.85%,铿腾电子收跌9.47%。费城半导体指数当日跌1.63%,较6月22日创下的历史高点下跌20.2%,进入技术性熊市。美股AI板块在72小时内蒸发了约4700亿美元。 EDA被业内称为“半导体之母”,是所有高端芯片研发绕不开的底层工具。长期以来,这个赛道被新思科技和铿腾电子两家美国公司垄断。Kimi K3用开源EDA工具跑通了芯片设计全流程,直接动摇了这两家公司的技术护城河。 投行Needham随后发布报告,认为市场反应过度,称两家EDA巨头的股价属于“错杀”。但市场已经在重新评估EDA赛道的竞争格局。 比股价波动更让硅谷紧张的,是中美AI差距的快速收窄。 就在Kimi K3发布前不久,一位匿名的Anthropic高管还公开表示,Claude系列技术大约领先中国竞争对手6到12个月。美国AI企业普遍默认自己在这个领域保持着稳定的领先优势。 加州大学伯克利分校计算机科学教授伊恩·斯托卡此前也认为,中国的开源模型大概落后美国前沿模型6到9个月。 但Kimi K3发布后,斯托卡改口了:“现在,他们可能只落后2到3个月。” 彭博社在报道中指出,中国AI与美国最前沿模型之间的差距可能正在快速缩小,从不久前被认为的“半年到一年”,缩短至数月级别。有业内分析认为,Claude Fable 5今年6月初才发布,距今不到两个月。如果Kimi K3的综合能力已经仅次于Fable 5和GPT-5.6,那所谓的“代差”实际上已经微乎其微。 曾走访过月之暗面的美国AI研究者内森·兰伯特判断,中美模型差距已从之前的6到9个月缩短到3到5个月。 硅谷的反应可以用两个字概括:撕裂。 Box公司CEO亚伦·列维透露,Kimi K3发布后硅谷“所有人都在讨论这件事”。他把K3称为开源模型的“一个巨大的突破”。 Axios直言,Kimi K3“让开发者们眼前一亮,也震惊了硅谷,让人工智能领域的竞争局势在一夜之间发生了改变”。 特斯拉CEO马斯克在相关评测下留言:“Impressive(令人印象深刻)”。但两天后他又宣布,xAI即将发布的2万亿参数新模型“可能超越Kimi”。月之暗面回了一句:“欢迎加入‘2万亿+’俱乐部。” 更值得关注的是另一条消息。据The Information报道,微软正在内部测试Kimi K3,评估将其部分接入Copilot。微软内部估算,如果完成切换,每年最多可节省约6亿美元的推理成本。目前Copilot主要依赖OpenAI的GPT和Anthropic的Claude模型。 一家中国AI公司的大模型,正在被美国最大的科技公司之一认真评估能否替代OpenAI和Anthropic的产品。这个信号比任何榜单排名都更有说服力。 与此同时,OpenAI和Anthropic已向监管机构表达了对开源中国模型的担忧。部分人士向白宫呼吁“封杀”。美国国内围绕是否应该封禁中国开源模型,正在展开一场激烈的大辩论。 Kimi K3走的路线也跟之前的国产模型不太一样。 去年DeepSeek引发全球关注,靠的是低成本、高性价比。Kimi K3的定价更高——每百万token输入20元、输出100元。美国开发者西蒙·威利森评价它是“迄今为止中国AI实验室发布的最昂贵模型”。 月之暗面似乎正在押注:高性能模型能撑起更高定价,尤其是在代码开发这类高价值任务上。瑞银分析师熊玮指出,不少投资者将K3视为第二个“DeepSeek时刻”,其定价高端体现了模型的溢价权。 从“便宜能用”到“贵得有道理”,中国AI的商业逻辑正在发生变化。 回到那个48小时跑通芯片设计的实验。这颗芯片本身并不先进——45nm工艺、100MHz频率,跟目前最前沿的制程差了好几个代际。但它的意义不在于芯片本身,而在于证明了一件事:一个大语言模型已经具备了跨领域的复杂推理和长程任务执行能力。 EDA工具链极其复杂,涉及电路仿真、逻辑综合、布局布线、时序验证等十几个环节。一个模型能在没有任何人工干预的情况下从头跑到尾,本身就是对AI能力边界的重新定义。 月之暗面在庆功活动上喊出了“冲上月球”的口号。现场标语写着“K3扩容升级”“K4给我狠狠干到极致”。下一代的K4已经在路上。 从DeepSeek到Kimi K3,中国AI用了一年多时间把跟美国的差距从“6到9个月”压缩到“2到3个月”。这个速度超出了几乎所有海外从业者的预期。 留给硅谷思考的问题不少:当一个开源模型在编程能力上已经登顶全球第一,闭源模型的“技术护城河”还剩多深?当微软这样的巨头开始认真考虑用中国模型替代OpenAI的产品,美国AI企业的定价权和市场份额还能撑多久?当中国AI不再只打价格战、开始冲击高端市场,美国“高投入、高定价”的模式还跑得通吗? 评论区聊聊:你觉得Kimi K3对EDA行业的冲击是短期情绪波动,还是长期趋势的开端?微软如果真把Kimi K3接入Copilot,对OpenAI意味着什么?
版权声明
“特别声明:以上作品内容(包括在内的视频、图片或音频)为用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user , the platform merely provides information storage space services.”
本文地址: https://www.amtbbs.org/thread-18374-1-1.html
|