← 回總覽

Kimi K3 不是中国的 Fable 5

📅 2026-07-17 21:17 腾讯科技 人工智能 2 分鐘 1325 字 評分: 86
大语言模型 开源模型 模型评测与基准 上下文工程 模型训练与推理
📌 一句话摘要 文章报道月之暗面 Kimi K3 以 2.8 万亿参数和开源权重在编程基准上超越顶级闭源模型,分析其 KDA 架构及“双线战争”策略,指出中美 AI 差距加速缩小。 📝 详细摘要 2026 年 7 月 17 日,月之暗面发布旗舰模型 Kimi K3,总参数 2.8 万亿,成为全球首个开放权重的 3T 级模型。其采用自研 KDA 混合线性注意力和 AttnRes 残差连接,结合 Stable LatentMoE,以廉价的长上下文窗口和 Agent Swarm 能力形成独特定位。在 CodeArena 编程基准中以 76%胜率超越 Claude Fable 5 和 GPT-5.

📌 一句话摘要

文章报道月之暗面 Kimi K3 以 2.8 万亿参数和开源权重在编程基准上超越顶级闭源模型,分析其 KDA 架构及“双线战争”策略,指出中美 AI 差距加速缩小。

📝 详细摘要

2026 年 7 月 17 日,月之暗面发布旗舰模型 Kimi K3,总参数 2.8 万亿,成为全球首个开放权重的 3T 级模型。其采用自研 KDA 混合线性注意力和 AttnRes 残差连接,结合 Stable LatentMoE,以廉价的长上下文窗口和 Agent Swarm 能力形成独特定位。在 CodeArena 编程基准中以 76%胜率超越 Claude Fable 5 和 GPT-5.6 Sol,在 nextjs.org/evals 也首次领先所有闭源模型。业界反应强烈,马斯克点赞,分析师指出 K3 以开源逼近闭源性能,使美国实验室面临“双线战争”。文章认为 K3 的效率定位而非单纯参数竞赛是核心优势,并指出中国开源模型与闭源差距正在加速缩小。

💡 主要观点

- Kimi K3 在 CodeArena 以 76%胜率超越 Fable 5 和 Sol,登顶开源模型榜首。 采用双盲对战机制,确保公平,同时文章指出整体仍落后最强闭源模型,但特定任务领先已属突破。

K3 的核心竞争力在于自研 KDA 与 AttnRes 架构,实现长上下文和低成本推理。 KDA 线性化注意力降低长序列计算,AttnRes 选择性跨深度传递信息,使百万 token 窗口实用化。
K3 定位为低成本长上下文基础设施,驱动 Agent Swarm,而非单轮推理最优。 分析师认为这构成“双线战争”,以开源免费侵蚀闭源溢价,迫使美国实验室应对。
K3 的发布显示中美 AI 差距加速缩小,提前实现马斯克的预测。 从“DeepSeek 2.0 时刻”到 K3,开源模型在某些基准上首次超越闭源,改变全球 AI 竞争格局。

💬 文章金句

- 当开源模型以免费权重逼近闭源性能时,闭源模型的在溢价能力将从内部被侵蚀,所以美国实验室面临封闭对开源、溢价对免费的'双线战争'。

  • 进步的速度才是更重要的信号,差距开始以超出预期的速度缩小。

📊 文章信息

AI 初评:86

来源:腾讯科技

作者:腾讯科技

分类:人工智能

语言:中文

阅读时间:18 分钟

字数:4373

标签: 大语言模型, 开源模型, 模型评测与基准, 上下文工程, 模型训练与推理

阅读完整文章

查看原文 → 發佈: 2026-07-17 21:17:00 收錄: 2026-07-18 10:00:50

🤖 問 AI

針對這篇文章提問,AI 會根據文章內容回答。按 Ctrl+Enter 送出。