ChatGPT Images 2.5 发布:更快、更清晰、更可控
新版图像生成模型全面提速,光影与纹理更自然,人物面部特征保持更好,多轮编辑之间的细节保持一致,并首次支持基于评论的修改指令。OpenAI 称每周图像生成量已突破 30 亿张,速度、真实感与可控性成为此次升级的三条主线。
Mistral 完成 30 亿欧元 D 轮融资
欧洲科技公司史上最大股权轮,公司成立仅三年。
Mistral 宣布完成 30 亿欧元 D 轮融资,成为欧洲科技公司有史以来规模最大的一笔股权融资。资金将用于扩大训练与推理算力,加速下一代通用模型的研发,进一步巩固其开源与「主权 AI」路线。
此次融资在 AI 圈引发广泛祝贺,被视为欧洲在本土大模型上的一次标志性加注。
Meta 发布个人 AI 代理 Muse
Muse 可理解用户目标,代为处理财务、健康、购物与关心亲友等日常任务,并随相处时间增长持续积累关于用户的上下文。Meta 同步公开了其安全构建方式的技术深解。
OpenAI 将 Astra 全面推向 Codex 与 ChatGPT Work
Astra 已向 Plus、Pro、Business 与 Enterprise 用户的 Codex 和 ChatGPT Work 全量开放,用户可直接在编码与工作流场景中调用该模型,边看边改、即时产出。
本周 OpenAI 连续铺开 Astra 与 Images 2.5,产品节奏明显提速。
Runway 插件正式进入 Adobe
Premiere Pro 与 After Effects 用户可在时间线内直接调用 Runway 模型,完成生成、编辑与放大,无需离开剪辑工作流。
Cohere 发布基于 decode megakernel 的服务系统
Cohere 推出首款围绕 decode megakernel 构建的 LLM 服务系统,面向 North Mini Code 完全开源,速度最高比 vLLM 快 1.58 倍。
OpenAI API 发布 GPT-Image-2.5 Flare 与 Sunburst
API 新增 Flare 与 Sunburst 两档图像模型,主打更锐利的细节、更强的风格遵循与更精细的编辑控制。
vLLM 发布 Agent 负载优化新博客
vLLM 详解面向真实 Agentic 服务负载的架构、框架与运行时全栈优化,直指 Agent 流量对服务栈每一层的压力。
Recraft 上线阿里 Wan 3.0 视频模型
Wan 3.0 可一次生成最长 30 秒、1080p 含声音的视频,支持从 16:9 到 9:16 的多种宽高比。
HuggingChat 上线 ML Intern 功能
Hugging Face 推出 ML Intern,让非 ML 专家也能从自然语言的想法出发,直接完成机器学习实验。
Synthesia 推出聊天式视频制作助手
Synthesia Assistant 可从提示、文档或链接生成视频,自动完成规划、品牌内容与数字人呈现,无需拼接多个工具。
OpenAI 否认用特定用户数据解决数学难题
OpenAI 祝贺相关数学家,并表示其研究者与 Agent 在成果公开发布前未接触对方工作,也未访问特定用户数据。
「聊天已经赢了。从这一刻起,一切都将是聊天 + 计算机。」
Guillermo Rauch · Vercel 创始人
Anthropic 用 Claude Agent 值守 CI 告警
Claude Tag 可读告警、指标与日志,自动写 SITREP 并维护 lessons.md,模板已开源。
Meta Muse Spark 1.3 上线 Cursor
Cursor 宣布支持 Meta Muse Spark 1.3,可在编辑器内直接调用该模型。
SGLang 首发支持蚂蚁 Ling-3.0-flash-VL
124B MoE 多模态模型,具备原生图像视频理解与 1M 上下文窗口。
Runway 吸纳 Kinetix 团队加速机器人研究
巴黎研究实验室团队加入 Runway,强化机器人与具身视频生成研究。
ChatGPT Images 2.5 升级拆解
延迟约降 50%,光影纹理更自然,编辑只改指定部分,其余细节不动。
OpenAI 回应纳维-斯托克斯争议
官方称拿到更强成果,论文与 Lean 证明已公开,回应 Buckmaster 的声明。
离散扩散实现 LLM 无损加速
扩散增强模型 Uno 并行采样多 token,8B 版超越 26B DiffusionGemma 与 Mercury 2。
fx:用 Zig 写的最小编码代理 CLI
配套 libfx 在 Node.js 与 Bun 中冷启动不到 2 毫秒,对照纯 JS 约 400 毫秒。
Schulman:用户数据训练远非单一问题
预训练、后训练等不同用途的隐私与知识产权影响差异极大,但 AI 公司普遍不愿披露自己在做什么。
Sam Altman 还原周末经过
他与团队长谈,称 Seb 等人全程正直慷慨;起初以为对方也解出了问题,曾想合作联合发布,后来才得知实情。
弱通用 AI 比预测提前一年达成
按 2020 年设定的标准,Loebner、Winograd、SAT 与 Montezuma's Revenge 均已先后被跨过。
拟人化的真正危险被低估
危险不再是我们高估了 AI 的能力,而是低估了它认知与元认知的能力。
广播式软件正在眼前化为尘埃
近期未来是按用户本地生成的 AI 软件,构成更稳定、异构且抗攻击的生态。
最小到最多:最早的 Agent 雏形
2022 年的 least-to-most prompting 就是早期 agent harness:把复杂任务拆小,再反复调用 LLM 逐个求解。
期待看到 Agent 数量的缩放定律
若 swarm 中 Agent 数量如同 CoT 推理时间般关键,将深刻影响 AI 未来讨论。
WaveNet 问世十周年
早于 Transformer 一年的长上下文自回归,如今回看依然令人感慨。
Perplexity 转向 NVLink Blackwell
大量推理已在 NVLink Blackwell 上服务,下一步是 Vera Rubins。
为 Mistral 喝彩:开源与主权 AI
Mistral 推出可在浏览器中运行的多模态 AI,支持语音生成与实时转写,值得借鉴。