六周三连发,Gemini 3.8 Flash 与 Flash Cyber 同步亮相
谷歌再度提速:面向代理式工作流的新 Flash 模型,与专攻网络安全的 Flash Cyber 变体同日上线。

谷歌今天发布 Gemini 3.8 Flash 与 3.8 Flash Cyber,这是六周内的第三次 Flash 更新。前者在软件工程、代理式任务与多步推理上再下一城,在 DeepSWE v1.1 基准上甚至超过多数更大规模的前沿模型;后者则在漏洞发现与大规模自动修补上达到前沿水平,官方称其在 CyberGym 行业基准上取得 86.2% 的成绩。
Meta 发布 Muse Spark 1.3,四个月内第四次迭代

官方称新模型在代理式与编码任务上进一步提升,更强调真实场景可用性:可在单一线程中维持更长时距的跨工作流执行,并更主动地与用户协作。发布仅数小时后,Meta 已开始冲击各家基准排行榜,DeepSWE 上甚至力压 Fable 5。
2.4T 参数的 Qwen3.8-Max-0902 登顶 Code Arena

阿里发布 Qwen3.8-Max-0902,2.4 万亿参数、100 万上下文,专为真实世界复杂度打造。它在 CodeArena WebDev 榜从 1669 跃至 1691 创下纪录,并在 Code Arena 总榜登顶,同时站上 5 美元/百万 token 的帕累托前沿。
「我们造 H3 是为了生成视频,但团队在它里面发现了一个『世界』。」
Claude Fable 5.1 与 Mythos 5.1 发布,缓存价格降 75%
昨晚 Anthropic 发布 Fable 5.1 与 Mythos 5.1,两者权重相同。输入输出价格与 Fable 5 持平,缓存价格直降 75%;按 token 计费,典型负载约便宜 25%,重度 Agent 负载约便宜 45%。不过时间线上普遍反馈订阅额度消耗得飞快。
李飞飞 World Labs 发布世界模型 Atlas

一张图片即可生成完整可漫游的 3D 空间场景,还能理解时间的演化规律,比上一代强出不少。多位研究者盛赞这是 World Labs 团队的又一力作。

Perplexity 开源 Lily:为 Apple Silicon 而生的本地推理引擎
Lily 是 Perplexity 为其 Mac 端「混合计算」特性打造的本地推理引擎,专为 Qwen3.6-35B-A3B 在 Apple Silicon 上优化,让端侧计算不再成为瓶颈。Perplexity Computer 也已在 DGX Spark 上完整本地运行。
开源 Claude Commerce Agents
构建购物与商家代理的蓝图,提供零售、出行、电信与娱乐等场景的参考实现。
Runway 推出 Dev MCP
开发者可直接在编码代理内接入 Runway 平台,配置 Model Router、查询任务、调试与管理,无需离开代理。
云代理跑在你自己的基础设施上
支持可随需求自动扩缩容的机器池,让代理访问内网服务或专用硬件,代理循环仍留在 Cursor。
「Astra」会是循环深度 Transformer?
围绕 OpenAI Astra 的热议来自 The Information 的一篇报道,称其为「循环深度/循环 Transformer」。rasbt 提醒,不同架构的尝试值得关注,但仍需谨慎对待二手报道。
手机变虚拟摄影机
用 Higgsfield 插件在 Blender 里布景,你的手机就能成为 AI 视频的虚拟摄影机,从 Blender 场景直接渲染。
H3-World:把 H3 本身变成世界模型
不另训动作头,直接把 MiniMax-H3 预训练好的语言理解转成对世界的控制,仅需约 8K 样本与 0.199% 可训练参数。
Roleplay:高风险对话的 AI 教练
与交互式头像练习真实对话、获得实时辅导并量化技能提升,面向销售、客服与管理者培训。
Firefly AI 视频放大,老影像升到 4K
可将老家庭视频提升至最高 4K 分辨率,支持 1080p 或 4K 输出,恢复细节与画质。
伦敦开办公室,携手 OpenAI 办炉边谈
9 月 10 日,Replit 首个国际办公室落地伦敦,含现场演示、开发者交流与 Paul Graham 炉边谈话。
AI Gateway 限时五折
统一端点接入文本、图像、视频、语音、转录与向量重排序;供应商降级可自动故障转移,日常请求路由至低成本开源模型。
在 IBC2026 驱动 30+ 媒体娱乐方案
聚焦代理式创意、体育智能与内容真实性,与 30 余家合作伙伴同台展示。
与 Baseten、NVIDIA Dynamo 共话 RL 基础设施
9 月 10 日晚,聚焦强化学习后训练的底层基础设施,展示 SGLang 与 Miles 的最新进展。
DreamX-Creator:单帧 + 文本,一步生成同步 2K 音画
基于 Wan2.2,含口型同步、拟音与模态感知 RL,无级联、一次完成。
MCP Elements 维持角色一致性
教程演示如何在多个镜头间保持角色身份,生成更连贯的 AI 故事。
H3 Max 降价
levelsio 算账:$0.0125/s 意味着月成本约 $32,940,若能做出永续 AI 直播即可盈利。