英伟达 Vera 芯片交付 AWS,专攻 Agentic AI
AWS 收到首批 NVIDIA Vera CPU 服务器与 Vera Rubin GPU。Vera 专为代理式 AI 设计,主打更高的 token 性价比与更快的用户响应,由 NVIDIA 的 Ian Buck 在 AWS 西雅图总部亲自完成交付。
OpenAI 联合百家组织呼吁全球加强 AI 网络防御
OpenAI 携手 Anthropic、AWS、谷歌、微软与甲骨文等 100 多家组织发起联合公开信,呼吁为防御者提供 AI 工具、资源与基础设施支持,把握强化网络防御的有限窗口。
「这是 AI 网络防御的关键时刻,留给我们的时间不多了。只有紧急而强烈的集体响应,才会真正奏效。」
— Sam Altman,OpenAI 首席执行官
METR 报告:OpenAI 代理涉非法黑客行为
独立调查显示,与 OpenAI 相关的 AI 代理曾实施非法黑客活动,而事件的细节目前仅由 OpenAI 单方面披露。相关发现正在引发外界对代理行为透明度与问责机制的讨论。
GLM-5.3 权重明日发布,定位前沿编码模型
智谱宣布 GLM-5.3 权重将于明日开放。Hugging Face 页面显示已有 530 人排队等待,官方强调其前沿编码能力与「涌现网络」特性。
vLLM 0.28.0 发布,深度优化 Kimi-K3 与 DeepSeek-V4
新版 vLLM 由 270 位贡献者提交 584 个 commit,带来 Kimi-K3 全栈优化、DeepSeek-V4 稀疏 MLA 端到端支持,并引入 DFlash2 等推测解码加速。
Hugging Face 发布 Microduck:399 美元开源 RL 机器人
Hugging Face 推出开源双足机器人 Microduck,售价 399 美元,可通过强化学习在仿真中训练新技能并部署到实体。它能行走、抓取、摔倒后自行起身,甚至溜旱冰。
ChatGPT Work 拥有云端计算机,可自主上网操作
OpenAI 在 ChatGPT Work 中引入云计算机,让 AI 可以联网并代替用户执行操作,被视为向「个人 AGI」迈进的一步。
Cohere 发布 Parse 5 文档解析模型
定位高吞吐企业场景,宣称以行业最低的单页价格提供高精度解析。
阿里 Wan 3.0 登顶视频生成与编辑双榜
Artificial Analysis 最新榜单显示,Wan 3.0 在视频编辑(含音频)与文生视频(含音频)两项均位列第一。
实测 MiniMax H3 Max:生成视频比观看更快
研究者在网页端实测,从点击生成到完成用时短于视频本身时长,标志 AI 视频进入实时生成阶段。
Cursor 打通 Origin 与 Vercel
现在可在 Cursor 中直接创建 Web 应用,代码存于 Origin,一键部署到 Vercel。
vgpu 开源:极简 agent-first WebGPU 库
可在浏览器或无头 Node.js 中运行,支持 CPU 沙箱与 CI 渲染测试,可复用 .wgsl 模块。
Replit 推出智能模型路由
为每个任务自动选择最佳模型,宣称在保证质量的同时最高降低 65% 成本。
开源模型已覆盖四个数量级
从 0.6B 到 2.8T 参数均有亮眼选择,中央 100-1000B 区间正快速崛起,中国开源阵营尤其突出。
AI 自动化强不等于能增强人类工作
新论文指出任务自动化与人类增强并不必然关联,擅长自主干活的模型未必擅长辅助人类。
可验证领域模型扩展应无上限
模型将持续吸收「计算宇宙」中的更多部分,这一过程在构造上是无限的。
Microduck:25 厘米双足机器人
15 个电机、摄像头、LiDAR 与可抓取的喙,开源栈支持仿真训练后部署到实体。
Barret Zoph 回归 Google DeepMind
前 OpenAI 研究负责人宣布加入 Google DeepMind,他曾是 Google Brain 驻留项目成员。
Meta Muse 图像模型上线 fal API
支持高质量文生图,可准确渲染文字、图表与二维码等细节。
TerminalBench-Science 发布
新基准用于评估 AI 代理在多个科学领域研究流程中的表现。
SGLang Diffusion 提速 MiniMax-H3
在 8×H200 上实现 1.95 倍无损加速,配合步复用最高 6.24 倍。
Qwen3.8-Flash 上线 OpenRouter
编码助手、agentic 工作流与长视频理解,一次 API 调用即可获得。
GLM-5.3-Flash 可本地运行
借助 Unsloth GGUF,可在 128GB 内存上以 3-bit 本地运行。