2026年7月28日 · 星期二

月之暗面发布 Kimi K3 开放权重模型

2.8T 参数 MoE 架构,1M 上下文与原生视觉,国内外十余平台 Day-0 支持。中国首个 3T 级开源模型正式诞生。

Kimi K3 发布当日即登上 HuggingFace 趋势第一,30 分钟内获 4000+ 点赞。

7 月 27 日,月之暗面(Moonshot AI)正式发布 Kimi K3 模型并宣布即将开源权重。K3 采用 2.8T 参数混合专家(MoE)架构,活跃参数 104B,支持 1M token 超长上下文和原生视觉能力。发布当日,HuggingFace CEO Clement Delangue 称其在 30 分钟内获得 4000+ 点赞,为平台史上增长最快的模型。vLLM、SGLang、Ollama、Together Compute、Fireworks、Modal、Baseten、Vercel、Cursor、Nebius、DigitalOcean 等十余家平台与工具链宣布 Day-0 支持。技术报告揭示了多项创新:Kim Delta Attention(KDA)与注意力残差机制替代传统 Transformer 注意力,FlashKDA 内核在 H20 上实现 1.72×–2.22× 预填充加速。月之暗面同步开源了 MoonEP 高性能 MoE 通信库、AgentENV 分布式环境系统和 FlashKDA 内核。模型许可证受 MIT 启发但限制商业使用——年营收超 2000 万美元的企业需另签商业协议。Nathan Lambert、teortaxesTex 等研究者迅速发布深度解读,前者详析许可条款,后者估计训练计算量超 2×10²⁵ FLOPs。K3 的发布标志着中国 AI 首次在开源模型参数规模上跻身国际最前列。

Anthropic CEO 详述开放权重立场

Dario Amodei 罕见发文正面回应外界猜测,明确 Anthropic 从未主张禁止开放权重模型。他认为无危险能力的开放权重模型是公共产品,但保护主义禁令无助于解决国家安全问题。Amodei 提出三项核心措施:防止强大芯片落入威权国家、制止工业规模蒸馏、要求对所有足够强大的模型(开放与封闭)进行安全测试。他不同意开放信关于开放权重必然有利于安全开发的论断,指出存在攻击者-防御者不对称,应通过严格预发布实证评估。Nathan Lambert 评论该文只是重申既有立场,并再次批评禁止蒸馏的做法。李开复则指出,未签署开放权重联署信的企业比签署者更值得关注。同日,NVIDIA 发起的开放权重联署信获 Vercel、Mistral、Sakana AI、SGLang 社区等数十家机构签署。

Ilya Sutskever 暗示 SSI 即将扩展

Ilya Sutskever 发布推文「Time to scale that SSI」,暗示其创办的 Safe Superintelligence(SSI)即将进入扩张阶段。据多方消息源确认,NVIDIA 已向 SSI 进行了新一轮重大投资,未来 12 个月内算力将提升 10 倍。SSI 团队已完成内部基础验证,即将启动大规模 scaling。截至目前,SSI 成立至今尚未发布任何公开模型,但其路线图正逐渐清晰——Ilya 被中文社区称为「最有希望的新 AI Lab」。有趣的是,黄仁勋在同日也独立开源了一款 Agent 客户端。外界解读此举与 NVIDIA 力推开放权重的整体策略一脉相承。分析师指出,K3 的发布恰与 SSI 信号形成对照:前者是开源路线的极限展示,后者则是闭源安全路线的神秘布局。

「开放模型和工具对于防御至关重要,而封闭模型安全的说法只是监管捕获。」

吴恩达(Andrew Ng)

月之暗面发布 PerceptionBench 视觉基准

基于前沿模型在 42 个基准上的失败模式,月之暗面提取了 10 项原子视觉能力,发布全新视觉感知基准 PerceptionBench。该基准采用自发现式设计,从模型实际失败中反推能力维度,而非预先定义。同时,研究者援引 Kimi 论文强调 Agent 安全边界——容器级隔离不足以防 Agent 崩溃宿主机内核,Firecracker 微型虚拟机才是安全的隔离方案。

K3 生态速报

「科学要求报告失败的实验,而非仅发表成功的那部分。AI 领域亦是如此。」

François Chollet
观点与观察

© 2026 FAV0 · AI Daily