2026年9月22日 · 星期二

Grok 4.7 正式发布:同价同速,Agent 编码跻身三甲

SpaceXAI 今日正式上线 Grok 4.7。在价格与速度完全不变的前提下,它对 4.6 完成了一次显著升级——编码、知识工作与长时任务全面跃升,第三方评测将其列为 Agent 编码全球第三,仅次于 Anthropic 与 OpenAI。

SpaceXAI 官方发布的 Grok 4.7 发布公告。

SpaceXAI 在今日凌晨正式上线 Grok 4.7。与上一代 4.6 相比,价格与速度完全一致,但能力曲线出现明显跳升:据其模型卡,Terminal-Bench 从 20.3% 跃升至 38.0%,长时办公、多文件工程任务均创下新高。埃隆·马斯克表示,在 Agent 编码领域,Grok 4.7 已把 SpaceXAI 带到全球第三的位置,仅落后于 Anthropic 与 OpenAI,而考虑到它在速度与成本上的显著优势,这套模型被视为日常编码与知识工作的实用之选。英伟达亦在第一时间发文致贺,称其为「有史以来最强的编码与知识工作模型」。

小米 MiMo-V2.6 开源:全模态双规格登顶开源榜

Pro 1.02T 总参 / 42B 激活,Flash 310B / 15B,MIT 协议。

MiMo-V2.6 在 Artificial Analysis 开源模型指数登顶。

小米正式开源 MiMo-V2.6 的 Pro 与 Flash 两款原生全模态模型。Pro 总参 1.02T、激活 42B,Flash 总参 310B、激活 15B,单一检查点同时支持文本、图像、视频与音频,具备 1M 上下文、原生 FP8 权重。上线即获 vLLM 与 SGLang 的 Day-0 推理支持,并在 Artificial Analysis 开源模型指数上登顶(46 分)。Tim Dettmers 评价称,Flash 版本手感出色,是 300B—550B 级别中最强的一档,自动压缩后可在超 300 万 token 的会话中保持稳定表现。

OpenAI 携手数学家顾问组,谨慎分享数学突破

破解纳维-斯托克斯千禧难题之后,如何负责任地发布新证明成为焦点。

OpenAI 宣布与一个独立的数学家顾问小组合作,以更负责任的方式分享 AI 在数学领域的最新进展。该小组将就如何评估与沟通新的数学成果、如何维护学术与专业标准提供建议。此前有消息称,一个 8 月 28 日才开始训练的内部模型已解决纳维-斯托克斯方程这一千禧年大奖难题,并在数学各领域攻克了逾 100 个长期未解的公开问题,一度在数学圈引发焦虑与存在性危机。业内观察者指出,这种「少一点颠覆式抛成果、多一点循序沟通」的做法,或将同样出现在法律、医疗等更多专业领域。

委托编码,但绝不要委托理解。如果代码曾是你管理认知的真相来源,那你就需要一个全新的真相来源。

— François Chollet
eidon_ai 开源的第一人称机器人数据片段。

一家公司倒闭了,却把 1274 小时机器人数据留给了社区

13,451 段人类执行日常任务的第一人称记录,CC-BY-4.0 协议公开。

大多数倒闭的公司会选择放弃它们的影响力,但机器人初创公司 eidon_ai 做出了更有价值的决定:把 1,274 小时的第一人称自我中心视频、7 路 IMU 手臂追踪数据,以 CC-BY-4.0 协议完整开源。这批数据包含 13,451 段人类执行日常任务的记录,作为礼物赠予整个机器人社区。Hugging Face 联合创始人 Clément Delangue 撰文致谢,称开源在此刻展现出了它真正的意义。

● 今日信号 · TODAY'S SIGNALS 09 · 22
● 短讯 · WIRE 09 · 22

© 2026 FAV0 · AI Daily · 由 AI 编排