月之暗面发布 Kimi K3 开放权重模型
2.8T 参数 MoE 架构,1M 上下文与原生视觉,国内外十余平台 Day-0 支持。中国首个 3T 级开源模型正式诞生。
7 月 27 日,月之暗面(Moonshot AI)正式发布 Kimi K3 模型并宣布即将开源权重。K3 采用 2.8T 参数混合专家(MoE)架构,活跃参数 104B,支持 1M token 超长上下文和原生视觉能力。发布当日,HuggingFace CEO Clement Delangue 称其在 30 分钟内获得 4000+ 点赞,为平台史上增长最快的模型。vLLM、SGLang、Ollama、Together Compute、Fireworks、Modal、Baseten、Vercel、Cursor、Nebius、DigitalOcean 等十余家平台与工具链宣布 Day-0 支持。技术报告揭示了多项创新:Kim Delta Attention(KDA)与注意力残差机制替代传统 Transformer 注意力,FlashKDA 内核在 H20 上实现 1.72×–2.22× 预填充加速。月之暗面同步开源了 MoonEP 高性能 MoE 通信库、AgentENV 分布式环境系统和 FlashKDA 内核。模型许可证受 MIT 启发但限制商业使用——年营收超 2000 万美元的企业需另签商业协议。Nathan Lambert、teortaxesTex 等研究者迅速发布深度解读,前者详析许可条款,后者估计训练计算量超 2×10²⁵ FLOPs。K3 的发布标志着中国 AI 首次在开源模型参数规模上跻身国际最前列。
Anthropic CEO 详述开放权重立场
Dario Amodei 罕见发文正面回应外界猜测,明确 Anthropic 从未主张禁止开放权重模型。他认为无危险能力的开放权重模型是公共产品,但保护主义禁令无助于解决国家安全问题。Amodei 提出三项核心措施:防止强大芯片落入威权国家、制止工业规模蒸馏、要求对所有足够强大的模型(开放与封闭)进行安全测试。他不同意开放信关于开放权重必然有利于安全开发的论断,指出存在攻击者-防御者不对称,应通过严格预发布实证评估。Nathan Lambert 评论该文只是重申既有立场,并再次批评禁止蒸馏的做法。李开复则指出,未签署开放权重联署信的企业比签署者更值得关注。同日,NVIDIA 发起的开放权重联署信获 Vercel、Mistral、Sakana AI、SGLang 社区等数十家机构签署。
Ilya Sutskever 暗示 SSI 即将扩展
Ilya Sutskever 发布推文「Time to scale that SSI」,暗示其创办的 Safe Superintelligence(SSI)即将进入扩张阶段。据多方消息源确认,NVIDIA 已向 SSI 进行了新一轮重大投资,未来 12 个月内算力将提升 10 倍。SSI 团队已完成内部基础验证,即将启动大规模 scaling。截至目前,SSI 成立至今尚未发布任何公开模型,但其路线图正逐渐清晰——Ilya 被中文社区称为「最有希望的新 AI Lab」。有趣的是,黄仁勋在同日也独立开源了一款 Agent 客户端。外界解读此举与 NVIDIA 力推开放权重的整体策略一脉相承。分析师指出,K3 的发布恰与 SSI 信号形成对照:前者是开源路线的极限展示,后者则是闭源安全路线的神秘布局。
「开放模型和工具对于防御至关重要,而封闭模型安全的说法只是监管捕获。」
吴恩达(Andrew Ng)
月之暗面发布 PerceptionBench 视觉基准
基于前沿模型在 42 个基准上的失败模式,月之暗面提取了 10 项原子视觉能力,发布全新视觉感知基准 PerceptionBench。该基准采用自发现式设计,从模型实际失败中反推能力维度,而非预先定义。同时,研究者援引 Kimi 论文强调 Agent 安全边界——容器级隔离不足以防 Agent 崩溃宿主机内核,Firecracker 微型虚拟机才是安全的隔离方案。
Kimi K3 已接入 Cursor 编辑器
在 CursorBench 上接近前缘水平,通过 Fireworks、Together 和 Baseten 提供美国本土推理,支持零数据留存。
Grok 4.5 成最具性价比安全 AI
在 deepsec 基准测试中,Grok 4.5 成本比 Sol 低 10 倍、比 Opus 5 低 5.7 倍,性能接近 Kimi K3。Sol 仍是前沿模型。
HuggingFace 加入开放安全 AI 联盟
联手 NVIDIA 等行业领袖组建联盟,通过开源协作解决软件漏洞,强化 AI 关键基础设施安全。Adobe 同期加入。
月之暗面开源 MoonEP 通信库
面向分布式 MoE 工作负载的高性能通信库,显著减少大规模训练和推理的通信开销。
开源 AgentENV 分布式系统
与 kvcache-ai 合作开源,支持大规模并行 Agent 工作流的快速快照、恢复和派生,用于 K3 的 Agent RL 训练。
开源 FlashKDA 加速内核
基于 CUTLASS 实现,在 H20 上比 flash-linear-attention 基线预填充速度快 1.72×–2.22×。
「科学要求报告失败的实验,而非仅发表成功的那部分。AI 领域亦是如此。」
François Chollet
vLLM 发布 K3 部署指南
完整覆盖架构、内核和产品化参数,为 Day-0 生产部署提供规范参考。
Lambert 评 Anthropic 文章:毫无新意
Nathan Lambert 认为 Anthropic 的开放权重文章只是重申旧立场,再次批评禁止蒸馏的做法。
几乎所有欧美 AI 公司签署开放权重协议
知名 AI 公司悉数签署,仅一家未签引发讨论。
HF CEO:K3 为史上增长最快模型
Clement Delangue 称发布 30 分钟内 4000+ 点赞,增速前所未有。
teortaxesTex 分析 K3 训练规模
推测 2026 H1 月之暗面已能预训练 104B 激活 MoE,可能使用至少 40T token。
K3 效用至少达 Opus 4.6 水平
拥有约 500 万美元 GPU 即可每秒运行数千 token。
Claude Design 被誉最被低估 AI 产品
用户称配合 Opus 5 使用后完全改变了构建方式,应比当前流行 100 倍。
前 Anthropic 员工:黑客偏爱补贴 API
Amjad Masad 引用前员工观点,黑客更爱用被大幅补贴的实验室 API 进行攻击。
NVIDIA 用 AI 翻译平台降本 25%
基于 Nemotron Speech 的内部平台减少处理时间 70%,年成本降低约 25%。
teortaxesTex 称 K3 是规模最大主义胜利
K3 极大地扩展了一切,是 scaling maximalism 的典范之作。
Cohere 推出 North Automations
用自然语言设计自动化工作流,无需技术背景即可使用 AI。
Chollet 赞赏真实经济互动评估 Agent
用外部市场作为奖励信号改变优化问题本质,是有趣概念。
K3 非完全开放
受 MIT 启发,但年营收超 2000 万美元需商业许可。
迄今最佳线性注意力实现
teortaxesTex 称 K3 的线性注意力为历史最佳实现。
Dario 新文引争议
被指原文开头不实,中国落后两年被描绘为噩梦情景引发批评。
谁没签更值得关注
指未签署者的缺席本身比签署者名单更具信号价值。
组织是已有超智能
已拥有统治地球的超智能:我们称之为"组织"。
2035 将超乎想象
iPhone 2007,ChatGPT 2022,2035 将无法理解。
科幻未预见当前 AI
无论科幻小说何等想象,从未预测到当前统计语言模型的能力形态。
看基准与用模型是两群人
MillionInt 指出二者可能永远无法互相理解。