AMT|智造云|世界先进制造技术论坛,领先的高科技先进制造产业服务平台

发表于 4 天前 | 显示全部楼层 |阅读模式
7月17日凌晨,月之暗面正式发布新一代大模型Kimi K3。这款模型参数规模达到2.8万亿,拥有100万token上下文窗口,原生支持视觉理解。月之暗面称其为“迄今能力最强的模型”。
image.png
2.8万亿参数什么概念?
这是目前全球开源模型中参数规模最高的纪录。月之暗面有关负责人打了个比方:参数就像人脑里的神经连接,近3万亿参数意味着模型能把更多知识和规律装进“脑子”,懂得更多、想得更深、答得更准。
Kimi K3基于自研的KDA混合线性注意力机制和注意力残差技术构建。在MoE层面,模型设置了896个专家,单次推理只激活16个。这套架构让K3相比前代整体扩展效率提升了约2.5倍。
image.png
在第三方独立评测中,Kimi K3综合智能评分57分,位列全球第三,仅次于Claude Fable 5和GPT-5.6 Sol。在Frontend Code Arena编程榜单上,K3以1679分登顶榜首,超越了Claude Fable 5的1631分和GPT-5.6 Sol的1618分。这是开源模型首次在编程榜单上超越头部闭源模型。
发布后不到48小时,用户请求量就大幅超出预估,逼近现有集群的承载极限。月之暗面不得不暂停消费端新用户订阅,全力推进算力扩容。
真正让硅谷震惊的,是另一件事。
月之暗面团队公开了一组测试结果:在连续48小时的自主智能体运行中,Kimi K3完全基于开源EDA工具和Nangate 45nm工艺库,全程没有引入任何人工干预,独立完成了一款芯片从架构构建、性能优化到功能验证的全流程开发。
这款芯片面积4mm²,集成了146万个标准单元、0.277 MB SRAM以及带融合反量化的INT4 MAC阵列。在100MHz频率下完成时序收敛,仿真解码吞吐量超过每秒8700个token。
虽然这颗45nm工艺的芯片规格不算高,目前还属于概念验证阶段。但这是第一次有开源大模型独立完成完整的芯片设计流程,而且只用了48小时。
消息传回资本市场,直接引发了连锁反应。
全球EDA行业的两大巨头——新思科技和铿腾电子,盘中股价一度大跌超12%。新思科技最终收跌7.85%,铿腾电子收跌9.47%。费城半导体指数当日跌1.63%,较6月22日创下的历史高点下跌20.2%,进入技术性熊市。美股AI板块在72小时内蒸发了约4700亿美元。
image.png
EDA被业内称为“半导体之母”,是所有高端芯片研发绕不开的底层工具。长期以来,这个赛道被新思科技和铿腾电子两家美国公司垄断。Kimi K3用开源EDA工具跑通了芯片设计全流程,直接动摇了这两家公司的技术护城河。
投行Needham随后发布报告,认为市场反应过度,称两家EDA巨头的股价属于“错杀”。但市场已经在重新评估EDA赛道的竞争格局。
比股价波动更让硅谷紧张的,是中美AI差距的快速收窄。
就在Kimi K3发布前不久,一位匿名的Anthropic高管还公开表示,Claude系列技术大约领先中国竞争对手6到12个月。美国AI企业普遍默认自己在这个领域保持着稳定的领先优势。
加州大学伯克利分校计算机科学教授伊恩·斯托卡此前也认为,中国的开源模型大概落后美国前沿模型6到9个月。
但Kimi K3发布后,斯托卡改口了:“现在,他们可能只落后2到3个月。”
彭博社在报道中指出,中国AI与美国最前沿模型之间的差距可能正在快速缩小,从不久前被认为的“半年到一年”,缩短至数月级别。有业内分析认为,Claude Fable 5今年6月初才发布,距今不到两个月。如果Kimi K3的综合能力已经仅次于Fable 5和GPT-5.6,那所谓的“代差”实际上已经微乎其微。
曾走访过月之暗面的美国AI研究者内森·兰伯特判断,中美模型差距已从之前的6到9个月缩短到3到5个月。
硅谷的反应可以用两个字概括:撕裂。
Box公司CEO亚伦·列维透露,Kimi K3发布后硅谷“所有人都在讨论这件事”。他把K3称为开源模型的“一个巨大的突破”。
Axios直言,Kimi K3“让开发者们眼前一亮,也震惊了硅谷,让人工智能领域的竞争局势在一夜之间发生了改变”。
特斯拉CEO马斯克在相关评测下留言:“Impressive(令人印象深刻)”。但两天后他又宣布,xAI即将发布的2万亿参数新模型“可能超越Kimi”。月之暗面回了一句:“欢迎加入‘2万亿+’俱乐部。”
更值得关注的是另一条消息。据The Information报道,微软正在内部测试Kimi K3,评估将其部分接入Copilot。微软内部估算,如果完成切换,每年最多可节省约6亿美元的推理成本。目前Copilot主要依赖OpenAI的GPT和Anthropic的Claude模型。
一家中国AI公司的大模型,正在被美国最大的科技公司之一认真评估能否替代OpenAI和Anthropic的产品。这个信号比任何榜单排名都更有说服力。
与此同时,OpenAI和Anthropic已向监管机构表达了对开源中国模型的担忧。部分人士向白宫呼吁“封杀”。美国国内围绕是否应该封禁中国开源模型,正在展开一场激烈的大辩论。
Kimi K3走的路线也跟之前的国产模型不太一样。
去年DeepSeek引发全球关注,靠的是低成本、高性价比。Kimi K3的定价更高——每百万token输入20元、输出100元。美国开发者西蒙·威利森评价它是“迄今为止中国AI实验室发布的最昂贵模型”。
image.png
月之暗面似乎正在押注:高性能模型能撑起更高定价,尤其是在代码开发这类高价值任务上。瑞银分析师熊玮指出,不少投资者将K3视为第二个“DeepSeek时刻”,其定价高端体现了模型的溢价权。
从“便宜能用”到“贵得有道理”,中国AI的商业逻辑正在发生变化。
回到那个48小时跑通芯片设计的实验。这颗芯片本身并不先进——45nm工艺、100MHz频率,跟目前最前沿的制程差了好几个代际。但它的意义不在于芯片本身,而在于证明了一件事:一个大语言模型已经具备了跨领域的复杂推理和长程任务执行能力。
EDA工具链极其复杂,涉及电路仿真、逻辑综合、布局布线、时序验证等十几个环节。一个模型能在没有任何人工干预的情况下从头跑到尾,本身就是对AI能力边界的重新定义。
月之暗面在庆功活动上喊出了“冲上月球”的口号。现场标语写着“K3扩容升级”“K4给我狠狠干到极致”。下一代的K4已经在路上。
从DeepSeek到Kimi K3,中国AI用了一年多时间把跟美国的差距从“6到9个月”压缩到“2到3个月”。这个速度超出了几乎所有海外从业者的预期。
留给硅谷思考的问题不少:当一个开源模型在编程能力上已经登顶全球第一,闭源模型的“技术护城河”还剩多深?当微软这样的巨头开始认真考虑用中国模型替代OpenAI的产品,美国AI企业的定价权和市场份额还能撑多久?当中国AI不再只打价格战、开始冲击高端市场,美国“高投入、高定价”的模式还跑得通吗?
评论区聊聊:你觉得Kimi K3对EDA行业的冲击是短期情绪波动,还是长期趋势的开端?微软如果真把Kimi K3接入Copilot,对OpenAI意味着什么?

回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册 |

本版积分规则

主题 53 | 回复: 54

QQ|联系我们|法律声明|用户协议|AMT咨询|商务合作|会员入驻|积分充值|积分商城|积分奖励规则|TradEx全球购|加入QQ技术群|添加企业微信|加入微信技术群|智造号| 世界先进制造技术论坛™(简称AMT™, 智造云™) ( 沪ICP备12020441号-3 ) |Sitemap

GMT+8, 2026-7-31 09:34 , Processed in 8.696240 second(s), 49 queries .

论坛声明:AMT-智造云(世界先进制造技术论坛) 属纯技术性论坛,我们严格遵守《中华人民共和国网络安全法》、《个人信息保护法》等国家相关法律法规,请勿发布非法言论、非法广告等信息,多谢合作。
本论坛言论纯属发表者个人意见且会员单独承担发表内容的法律责任,与本论坛立场无关;会员参与本论坛讨论必须遵守中华人民共和国法律法规,凡涉及政治言论、色情、毒品、违法枪支销售等信息一律删除,并将积极配合和协助有关执法机关的调查,请所有会员注意!
本论坛资源由会员在本论坛发布,版权属于原作者;论坛所有资源为会员个人学习使用,请勿涉及商业用途并请在下载后24小时删除;如有侵犯原作者的版权和知识产权,请来信告知,我们将立即做出处理和回复,谢谢合作!

合作联系: 双日QQ客服:3419347041    单日QQ客服:3500763653    电话021-37709287    合作问题投诉:QQ:2969954637    邮箱:info@amtbbs.org    微信公众号:AMTBBS

 

快速回复 返回顶部 返回列表