GPT-5.6 Sol 价格再降超 20%,持续三个月
OpenAI 宣布,将 GPT-5.6 Sol 的 API 与信用价格在未来三个月内下调超过 20%。官方称这是在提升效率的同时继续推进能力前沿。OpenAIDevs 补充,token 制 Codex 计划中购买的信用将走得更远,订阅内包含的用量保持不变;Cloudflare、OpenCode Zen、Devin 与 Router 等渠道同步跟进折扣。

NVIDIA Vera Rubin 进入全面量产
下一代 AI 训练与推理平台 Vera Rubin 正加速爬坡至全面量产,微软团队在这一里程碑中扮演了关键角色。
等了近八年,16-bit HDR 的 ProRes 与 EXR 序列,终于来到 Runway 里的任何视频模型。
Claude Remote Control 可靠性大幅改进
上月用户最希望修复的 Remote Control,本周迎来一系列可靠性提升。官方称团队近期一直专注在稳定性的打磨上,具体改进项以长线程形式逐一公布。

OpenAI 支持按 API Key 追踪用量与支出
Usage 与 Spend 面板现可按 Key 追踪用量与支出,支持组织/项目月度限额,包括达限即停的硬限额。

DeepMind:游戏仍是 AI 研究的试炼场
从攻克 Atari 到星际争霸 II 宗师,游戏驱动了多项重大突破;SIMA 让智能体学会理解 3D 世界。

腾讯混元翻译模型登陆 OpenRouter
Hy-MT2-1.8B 与 Hy-MT2-30B-A3B 面向 33 种语言,支持结构化、语境与风格引导的翻译任务。
Harvey 发布 Tenet,首个法律后训练模型
基于 Kimi K3 底座,与 FireworksAI 合作完成法律方向后训练,面向法律场景的首个专用模型。
SkyRL IsoExec 解决 RL 训练中的浮点分歧
vLLM rollout 引擎与 Megatron trainer 可能因浮点非结合性对同一 token 产生分歧,IsoExec 用执行契约加统一模型对齐舍入敏感的执行选择。
Ling-3.0-flash-dspark 发布,SGLang 训练并部署
AntLingAGI 发布该模型,LMSYS 博客《Chasing the Batch-1 Floor》讨论 Blackwell 上的 Batch-1 推测解码。
vLLM Conference 下周召开
周一有 Ray × Google Cloud Happy Hour 与 vLLM × Dynamo Meetup,聚焦前沿 AI 工程议题。
Qwen3.8-27B 加入 SGLang 量化配方
NVFP4 与 DFlash2 方案已收录进 SGLang cookbook,供开发者直接调用。
10 万小时真实人手操作数据集开放
EgoSuite-Open100K 以 LeRobot 格式发布,全标注、开源,聚焦第一人称人类操作数据。
智谱 Build Week 转长期系列,送免费 token
5 万名新 ZCode 用户各获 1 亿免费 GLM-5.3 token,截止 8 月 23 日 18:00 PT。
Pika Speech:3B 参数,RTF 0.02
本地长文本测试中,约 1.2 秒生成一分钟 48kHz 录音室级语音,支持最长五分钟请求。
v0 接入 Slack、GitHub 等 100+ 服务
通过 Vercel Connect 以团队连接器与短时 token 处理鉴权,覆盖 Salesforce 等主流工具。
Kimi K3 上线 Ollama Pro/Max
已包含在 Pro 与 Max 订阅的可用用量之中,更多模型即将跟进。
NVIDIA AVO 在 ARC-AGI-3 拿下 100%
通用编程智能体在 ARC-AGI-3 交互推理基准上完成全部任务,引发社区关注。
Diffusers 0.40.0 发布
Modular Diffusers 正式走出实验阶段,带来一批稳定化改进。

