2026年世界人工智能大会开幕前夕,月之暗面于7月16日正式发布了新一代大模型Kimi K3.总参数规模达到2.8万亿,这是目前全球参数最大的开源模型,也是首个超2万亿级别的开源模型。对比来看,此前发布的DeepSeek V4总参数为1.6万亿,文心大模型5.0参数为2.4万亿。月之暗面方面用了一个通俗的比喻:参数就像人脑里的神经连接,近3万亿参数意味着这个模型能把更多的知识和规律装进“脑子”,懂得更多、想得更深、答得更准。从K2系列的1万亿参数到K3的2.8万亿,两代之间的性能差距显著。从“千亿”到“万亿”再到“近3万亿”,Kimi K3的发布不仅是一次参数规模的跃升,更标志着开源大模型正式迈入了3万亿级别的全新赛道。

不止于大,三项核心技术撑起“最强大脑”
大模型的竞争早已不是单纯的参数堆砌。Kimi K3之所以能被称为“迄今能力最强的模型”,关键在于其底层架构的多项创新。模型采用了混合专家(MoE)架构,在896个专家中高效激活16个,结合Stable Latent MoE框架,让算力更加精准地集中在关键任务上。在此基础上,Kimi K3基于自研的KDA混合线性注意力机制和注意力残差技术构建。这两项架构更新的核心目标是一致的——让信息在更长序列和更深模型中流动得更顺畅。原生支持视觉理解,100万token的超长上下文窗口,这些能力叠加在一起,让Kimi K3在处理复杂任务时拥有了更全面的“感官”和更持久的“记忆力”。从芯片设计到游戏开发,从代码生成到行业研究,K3正在用技术实力证明:大模型的能力上限,正在被系统性拉高。

代码竞技场登顶,编程能力成为最强王牌
在众多能力维度中,编程是Kimi K3最突出的标签。在Arena.AI的前端代码竞技场(Frontend Code Arena)中,Kimi K3以1679分的成绩超越Claude Fable 5.位居第一。从K2.6的第18名跃升至榜首,足足跨越了17个名次。在前端领域的7个子项中,K3在品牌与营销、基于参考的设计、数据与分析、消费产品、模拟以及内容创建工具等6个领域均排名第一,仅在游戏领域位列第二。
更令人印象深刻的是K3在真实任务中的表现。月之暗面展示了一项概念验证:Kimi K3在48小时的连续自主运行中,独立使用开源电子设计自动化工具完成了一颗4平方毫米芯片的完整设计流程,从架构设计到优化验证,最终实现了100MHz的时序收敛。在软件工程领域,K3能在少量人工监督下持续执行长时间工程任务,理解大型代码库,协调使用终端等工具。结合视觉推理能力,它还能根据运行结果和截图实现“看见输出、即时优化”的视觉闭环。这些能力让K3尤其适合游戏开发、前端工程、CAD工作流和基础设施优化等场景。在发布之前,一个代号为“Kivine”的匿名模型就已在技术社区引发热议。有开发者用一句话就生成了一个类似“我的世界”的像素风游戏;还有人用它生成了包含完整3D引擎的沙漠集市模拟器;甚至有人让它还原了达芬奇扑翼机的历史工坊。这些来自真实用户的实测反馈,让K3的编程能力得到了最直接的验证。

开源生态的“群体突破”,K3的商业化路径逐渐清晰
Kimi K3的完整模型权重预计于7月27日正式向社区开放。在此之前,用户已可通过kimi.com官网、手机App、Kimi Work桌面客户端、Kimi Code及Kimi API等多端体验该模型。API调用采用按量计费模式:输入每百万token为2元(缓存命中)或20元(缓存未命中),输出每百万token为100元。得益于Mooncake分离式推理架构,编程场景的高缓存命中率使得实际输入成本大幅降低。
在商业化落地方面,Kimi K3也展现出了清晰的路径。在衡量44个职业和9大行业实际任务的GDPval-AA v2基准上,K3以1687分位列第三,仅次于Claude Fable 5 Max和GPT-5.6 Sol Max。在Artificial Analysis的私有代理基准AA-Briefcase上,K3以1527分攀升至第二位。在长周期高难度信息检索基准BrowseComp上,K3取得了91.2分的最高成绩。月之暗面坦言,K3的整体表现仍落后于最强的闭源模型Claude Fable 5和GPT-5.6 Sol,但在其内部评测中已稳定超过其他所有模型。有行业人士指出,一批中国开源大模型正从“单点亮相”走向“群体突破”。Kimi K3的发布,不仅是月之暗面这家公司的一次能力跃迁,更是整个开源大模型生态向世界前沿水平发起的一次集体冲锋。当2.8万亿参数的模型权重向全球开发者敞开,这场由开源驱动的AI变革,才刚刚进入最精彩的章节。
猜你喜欢
2026年阿尔巴尼亚科孚海峡小众海岸徒步路线规划
2026年尼加拉瓜奥梅特佩岛小众火山徒步攻略
2026年斯洛文尼亚特里格拉夫国家公园小众徒步路线