[AINews] Kimi K3 2.8T-A50B:迄今最大开源模型发布,性能达到 Opus 4.8 级别,定价与 Sonnet 5 看齐
最近Z.ai GLM有点风头过盛,是时候让Kimi K3反击了!今天这个开源模型的规模大到让人难以直观感受,幸好月之暗面(Moonshot AI)帮我们做了展示——他们发布了一支完全由Kimi K3剪辑完成的宣传短片,值得一看:
你可以去SimonW和Arena看常规评测和排名。考虑到模型体量,结果不会太出人意料,但下面这张图最能体现从K2.5到K3的飞跃:
AI News for 7/15/2026-7/16/2026。我们查看了12个子版块、544条推文,没有再去Discord。AINews官网可以搜索往期内容。提醒一下,AINews现在是Latent Space的一个栏目。你可以订阅/退订邮件推送!
AI推特摘要
月之暗面发布了Kimi K3,这是一款前沿级的开源权重模型。官方声称其性能接近顶尖闭源模型,并超越之前的开源竞品。
[AINews] Kimi K3 2.8T-A50B:迄今最大开源模型,Opus 4.8 级别性能,Sonnet 5 定价
Moonshot 正式推出 Kimi K3,定位为“开放前沿智能”(Open Frontier Intelligence)。该模型拥有 2.8万亿 总参数、100万 token 上下文窗口、原生多模态输入,以及 Kimi Delta Attention (KDA) 和 Attention Residuals 两项技术。Moonshot 表示,模型已上线 Kimi.com、Kimi Work、Kimi Code 和 API,开源权重承诺于 2026年7月27日 发布。
Moonshot 还强调了产品的定位方向:面向长周期自主编程与自进化工作流,并支持“视觉驱动”的编码与游戏构建流程,在代码与截图之间循环迭代,实现闭环开发。
正式发布前,多个账号已泄露或通过 App 获取了细节信息:K3 拥有 2.8万亿参数,若权重如期开源,它将是有史以来最大的开源模型。
官方 Kimi 博客随后上线,被广泛转发为主要技术来源。
Moonshot 在表述中也承认了局限:尽管 K3 整体竞争力很强,但与 Claude Fable 5 和 GPT-5.6 Sol 相比,在“用户体验上仍存在明显差距”。
Arena 宣布 Kimi K3 已进入 Agent Arena,同时进入 Text、Vision、Document 和 Frontend Code Arena,社区评测即将展开。
随后 Arena 报告了一项重大早期结果:Kimi K3 在 Frontend Code Arena 中以 1679 分成为第一,超越 Claude Fable 5,从第18名(K2.6)跃升至第1名,在 7 个前端子领域中的 6 个排名第一,在游戏领域排名第二。
Arena 进一步补充,K3 在 Frontend Code Arena 的 pairwise 胜率高达 76%,而 Fable 5 为 63%,GPT-5.6 Sol 为 58%。
在 Text Arena 中,K3 以 1486 分排名第9,从第38名跃升而来,在创意写作、编程和指令遵循方面进入前十,并在多个职业细分领域排名第一。