中国大模型如何跨入全球第一梯队 打破美国领先优势
中国大模型如何跨入全球第一梯队 打破美国领先优势。7月17日凌晨,月之暗面发布了一款名为Kimi K3的开源模型。这款模型拥有2.8万亿参数,是全球参数最大的开源模型。发布后仅数小时,Kimi K3在AI代码能力评测平台Arena的Frontend Code Arena榜单上以1679分超越了Anthropic的Claude Fable 5和OpenAI的GPT-5.6 Sol,登顶全球第一。这是中国大模型首次在这个权威榜单上拿下榜首。

发布当天,纳斯达克指数跌了1.4%,费城半导体指数一度重挫5.7%。美国媒体对此反应强烈。Axios的标题是《中国刚刚抹去了美国在AI领域的领先地位》,彭博社则称Kimi K3正在打破“美国领先中国”的固有认知。一个中国大模型让整个美国科技股市场动荡不安。

2.8万亿参数是什么概念?这是全球首个超2万亿级别的开源模型。上一代Kimi K2是1万亿参数,K3直接翻了近三倍。但参数大不是全部,K3真正让硅谷震惊的是其在编程能力上的表现。K3不仅登顶榜单,还在前端开发的全部7个分类中有6个排名第一,在前端代码竞技场中以76%的胜率超过Claude Fable 5的63%和GPT-5.6 Sol的58%。

架构上,K3采用了自研的KDA混合线性注意力机制和注意力残差结构,配合MoE架构(896个专家中激活16个),扩展效率相比前代提升了约2.5倍。原生支持视觉理解,拥有100万token上下文窗口。更夸张的是,在早期概念验证中,K3曾自主运行48小时,仅靠开源EDA工具和45nm工艺库,独立完成了一款芯片的构建、优化与验证。
所有文章未经授权禁止转载、摘编、复制或建立镜像,违规转载法律必究。
举报邮箱:1002263188@qq.com