Jeff Dean 离开 Google 创办
Discovery Loop
27 年 Google 元老与 Sanjay Ghemawat、Oriol Vinyals、Quoc Le 共同创立公益性公司,使命是自动化机器学习研究以加速科学发现
Google 元老 Jeff Dean 在服务 27 年后正式告别。他与长期合作伙伴 Sanjay Ghemawat、Oriol Vinyals 和 Quoc Le 共同宣布创立 Discovery Loop——一家公益性公司,使命是自动化机器学习研究流程,加速跨科学、工程领域的发现。这是本周 AI 圈最大的人事震动。
Google DeepMind 高层大调整
Demis Hassabis 升任 Chair 兼 Alphabet 首席科学家,Jeff Dean 同日宣布离职
Sundar Pichai 宣布对 Google DeepMind 团队进行重大调整:Demis Hassabis 将升任 Google DeepMind 主席兼 Alphabet 首席科学家,同时继续领导 Isomorphic Labs。这是继 Jeff Dean 宣布离职后,Google AI 部门一日之内第二次人事巨震。Pichai 在推文中称 Hassabis 将"专注于塑造 AGI 的未来"。
人类历史漫长岁月里,我们一直默认智力是稀缺资源。如今,每个人都能像拧开水龙头一样召唤永不枯竭的 IQ 机器。这场变革之深,深到我们自己的大脑几乎无法理解。
— @rauchg · Vercel CEO
Meta 发布 Muse Code 编程智能体
基于全新 Muse Spark 1.2 模型的终端编程代理,面向长期软件工程任务
Muse Code (beta) 是 Meta 推出的终端编程智能体,由新模型 Muse Spark 1.2 驱动。它通过持久化子代理在大型代码库中规划、实现和验证复杂的多文件变更。@alexandr_wang 称其为"MSL 的首个编程代理"。
Nemotron 3 Ultra 零后训练超越前沿模型
Palantir 用 NVIDIA Nemotron 3 Ultra 在 24 小时内完成客户任务,无需任何后训练
NVIDIA 透露,Palantir 将 Nemotron 3 Ultra 在无后训练的情况下投入测试,24 小时后即在客户需要解决的任务上超越了前沿模型。这一结果来自 Palantir 企业 AI 副总裁在主权训练营上的分享,展示了 Nemotron 开放模型在企业安全 AI 中的潜力。
Qwen-Image-3.0-Pro 正式上线 Qwen Cloud
通义千问全新图像生成模型支持 4.5k token 输入、图中图密集布局、12 种语言及 20+ 字体,可精确渲染小至 10px 的文字
Qwen-Image-3.0-Pro 已在 Qwen Cloud 上线。该模型支持最长 4.5k token 输入和图中图等密集信息布局,可一次生成报纸、分镜脚本、菜单、试卷等复杂排版。它能精确渲染小至 10px 的文字,并还原微表情、毛孔、发丝等细节,接近照片效果。模型还原生支持 12 种语言和 20 多种字体,可模拟网页、游戏、直播等主流界面,并融合外部知识。
Runway Seedance 2.5 即将发布
单次生成支持 50 个参考素材、最长 30 秒片段,Higgsfield 同步宣布多项演示
Runway 宣布 Seedance 2.5 即将上线。新版本支持将最多 50 个参考素材融入单次生成,可创建最长 30 秒片段。同步消息中,Higgsfield 展示了 Seedance 2.5 在微表情控制、照片级 VFX 插入、身份保持风格转换、逐帧视频到视频转换等方面的能力,并宣布将作为第二届全球电影节的底层引擎。
Grok Build 接入 Grok 4.5 模型
新增原生子代理视图、计划模式、鼠标支持和全屏终端,通过 CLI 安装
Elon Musk 宣布 Grok Build 现已由 Grok 4.5 驱动,并新增原生子代理视图、计划模式集成、鼠标支持及全屏终端界面。Musk 同时呼吁社区对 Grok Build harness、Grok 基础模型和 Imagine 提供反馈。安装方式:curl -fsSL https://x.ai/cli/install.sh | bash。
v0 API 正式上线
Vercel 发布新版 v0 API,提供对 v0 应用构建智能体的程序化访问。用户发送提示词后,v0 会生成应用、在 Vercel Sandbox 中启动开发服务器,并返回可嵌入的预览 URL。可用于构建自定义应用生成器或通过 CI 任务生成应用。
Next.js 16.3 Vercel 性能大幅提升
Next.js 16.3 应用在 Vercel 上的预取请求减少 45%,静态资源减少 17%,路径元数据服务速度提升至原来的 2 倍。@rauchg 称该版本在服务和构建效率上实现了"激进的成本下降"。
RTX Spark 开启个人计算新纪元
NVIDIA 发布 RTX Spark,定位为个人计算的新时代起点。详情视频已在官方账号发布,展示了该产品如何将高性能 AI 算力带入个人设备。
NVIDIA Cosmos 教机器人做梦
NVIDIA Cosmos 帮助物理 AI 推理真实世界交互并在行动前模拟可能未来。官方用一句话总结:"教你如何向兄弟姐妹解释世界模型——它教机器人做梦。"
Replit 构建中实时安全扫描
Replit 与 Semgrep 合作,将安全扫描移到构建过程中进行,无需等待构建完成。用户反馈"We heard you"驱动了此次改进。
OpenAI Codex 语音编程新升级
Builders 正在探索用语音在 Codex 中构建的新方式:口头讨论想法、在想法成型时启动新 Codex 会话、过程中随时检查其他线程。
MiniMax H3 开源引爆社区 48 小时
视频模型 H3 开源后社区迅速适配 ComfyUI、Magnific、OpenRouter,Pika API Club 同步上线 H3 接入
MiniMax 开源 H3 视频模型权重后,48 小时内社区爆发出惊人创造力。ComfyUI、Magnific 和 OpenRouter 率先支持,Pika API Club 以低于市场 50% 的价格提供 H3 调用。MiniMax 表示:"开源权重是火花,但社区燃起了大火。"Hailuo_AI 同步宣传称"H3 为构建者而生"。
Flux 3 登陆 Pika API Club
Flux 3 现已通过 Pika API Club 提供接入。Pika 推出 API Club 会员计划,月费 10 美元,首月赠送 10 美元额度,通过统一 API 接入 100 多个生成式媒体模型,价格比其他聚合平台低至多 88%。
Chunky Post-Training: LLM 的隐秘故障模式
John Schulman 关注一篇新论文,揭示 LLM 后训练中数据集的"块状"模式如何导致意外的泛化失败——例如模型因格式关联而拒绝特定格式下的真实事实。论文提出黑盒工具 SURF 在运行时发现这些问题,及 TURF 将故障追溯到具体训练数据。该工作在 Claude 4.5、GPT-5.1 等模型上验证。
Clement Delangue 论 API 与开放权重的监管差异
Hugging Face CEO Clement Delangue 解释了为什么新的 AI 模型框架中 API 和开放权重受到不同对待——"模型权重、API 和应用是三个完全不同的东西"。他认为区分处理"实际上是非常好的政策"。他还表示,Google 本可以通过开源 Gemini 和 Veo 成为 AI 主导力量。
Black Hat 大会聚焦 OpenAI-Hugging Face 安全事件
Black Hat 大会上座无虚席,与会者挤满会场聆听关于 OpenAI 与 Hugging Face 安全事件的专题演讲。现场照片显示热度远超预期,反映业界对 AI 供应链安全的关注已达到新高。
Hy3 登陆 WorkBuddy 全球免费开放
Hy3 已在 WorkBuddy 全球上线,2026年8月31日前向全球用户免费开放。支持研究、数据分析、文档和演示文稿创建,以及职场通讯处理,无需任何设置。
Qwen3.8-Max 图像到 Web 开发排行第二
Qwen3.8-Max 在 Image-to-WebDev Arena 中升至第 2 名。"它看得见,它构建得出来"——阿里团队用一句话总结。
DeepSeek V4 Flash 成 Ollama 增长最快模型
DeepSeek V4 Flash 在 Ollama 上创下 token 用量增长最快纪录,同时在 OpenRouter 上成为本周最受欢迎模型。
SGLang 首发支持 Shieldstral 安全分类器
Mistral 发布 3B 开源安全分类器 Shieldstral,性能匹敌 7 倍大小的护栏模型。SGLang 提供 Day 0 支持,支持文本、图像和多模态输入。
Sakana AI 与大和证券进入全规模生产
Sakana AI 与大和证券的联合 AI 项目进入全面生产阶段,将其智能体 AI 系统引入大和证券财富管理团队,加速复杂市场分析。
Runway AI Summit 九月旧金山举办
Runway AI Summit 将于九月在旧金山举行,涵盖机器人、自动驾驶、生命科学和基础设施领域,探讨 AI 如何重塑智能与世界的交汇方式。
Higgsfield 百万美元全球电影节公布幕后教程
作为 Higgsfield 百万美元全球电影节的一部分,AI 长片《Hell Grind》发布了完整的 19 分钟制作教程,展示 50 万美元的制作分解过程,包括角色设计、人群规模和战斗场景的真实提示词。影片全长 95 分钟。
Chime 用 Runway 将电视广告成本降低 85%
Chime 利用 Runway 将约 100 位真实会员的照片制作成全国电视广告,制作成本从 30 万美元降至不到 3 万美元,节省约 85%。
小米机器人数据集上线 Hugging Face
用 10 万+小时真实世界数据扩展视觉-语言-行动模型,多个子集合覆盖不同机器人场景。
OCR 并非"被吃掉"——数据说话
跨越三代 GPT 测试,解析准确率提升约 24 分,但每页成本涨了 4 倍。最新前沿模型仍落后于专用解析器。
Nemotron 开放模型护航企业 AI 主权
Palantir 主权训练营上 NVIDIA 副总裁讨论 Nemotron 开放模型如何实现安全、面向特定任务的 AI。
吴恩达祝贺 Jeff Dean 团队
吴恩达公开祝贺 Jeff Dean、Sanjay Ghemawat、Oriol Vinyals 和 Quoc Le 的新旅程。
Gemini 大重组:拥有所有优势的巨头为何跑不起来
行业观察者指出 Dean 离开、Hassabis 不再担任 CEO 标志着 Gemini 深层重组,这个故事将被作为"拥有所有先发优势的巨头却无法起跑"的经典案例研究。
MerchantBench: 电商运营 LLM 代理基准
基于 9.8 万条真实商品记录,365 天订单级模拟,最佳 LLM 配置仅达到人类平均净资产的 27.3%。
Nathan Lambert 发布评估讲座系列
从 GPT-3 提示词时代到今日复杂智能体沙箱,深度讲解 LLM 评估的演变历史。
Vercel 成为后端的 Vercel
@rauchg 称 Vercel 是"后端的 Vercel",FactoryAI 使用 Fluid compute 驱动其 API 服务,月请求量达数十亿。