模型发布 · MODEL RELEASE
Anthropic 正式发布 Claude Sonnet 5.5
Claude 5.5 家族第二款模型上线,官方称其更聪明、更快、更划算,是本次发布周期最重磅的模型更新。
作为继 Opus 5.5 之后、5.5 家族的第二款模型,Sonnet 5.5 同时朝速度与成本两个方向推进:输出比上一代 Sonnet 5 快 30%,多数任务的花费最多可再降 30%。官方把它定位在规格清晰、可验证的日常编码、文档与表格制作,以及重复性的 agent 任务;至于需要长时间复杂判断的场景,Anthropic 仍建议交给 Opus 5.5。发布当天,Cursor、v0 等开发工具已同步接入,Claude 的免费层也随之切换到新模型。
安全 · AGENT SAFETY
英伟达发布开放 Agent 安全平台
平台让用户控制 AI agent 能访问什么、能做什么,为「智能体安全」这一新问题提供开放的基础设施与护栏。
行业 · INDUSTRY
OpenAI DevDay 主题演讲明日开场
OpenAI 官方邀请开发者观看 DevDay 主题演讲直播,预计将发布新模型与新产品。多位内部人士此前已密集造势。
OpenAI 放出 DevDay 预告:做好准备
官方账号发布配图预热,为即将到来的 DevDay 主题演讲造势。
Kling 4.0 十月发布,Flash 先行上线
官方称 4.0 在视觉真实感、创作控制与叙事完整度上再进一步,Ultra 年费订阅者已可用 Flash 版。
Perplexity 实测 9 个模型能否越狱
与英伟达及 100 多家伙伴合作,给 9 个 AI 模型 SPACE 内 root 权限并令其逃逸,108 次运行无一突破 VM 边界。
上手 · HANDS-ON
Claude Sonnet 5.5 上手与迁移指南
官方指南讲解 Sonnet 5.5 与 Opus 5.5 怎么选、如何从 Sonnet 5 迁移调优,以及如何在 Claude Code 中使用:比 Sonnet 5 快 30%,多数任务成本最多降 30%。
AI 行业的目标,应是造出让人更繁荣、更幸福的工具,而不是创造一个取代人类的「后继物种」。
—— François Chollet
回应 · RESPONSE
HuggingFace 回应 agent 越狱攻击事件
Clement Delangue 称若 OpenAI 用自己的 agent 平台运行该测试,本可先于 HF 发现攻击,并呼吁行业提供更多透明度。
评测 · BENCHMARK
GPT-6 Sol 在 ARC-AGI 上的实测成绩
ARC-AGI-3 上标准 harness 得 4.6%(约 5600 美元),换成 provider adapter harness 后达 23%(约 8700 美元),成绩与成本差异值得注意。
报告 · REPORT
报告:AI 自我改进仍受收益递减制约
Ramez Naam 将 RSI 分为五类,认为自主递归改进证据不足,现有自我改进循环需强 5–10 倍才能自持,作者自承也可能判断错误。
Cursor 上线 Claude Sonnet 5.5
官方称该模型在许多任务上表现已与 Opus 相当,现已可直接选用。
Altman 预告 DevDay:我们找到了新东西
OpenAI CEO 在 DevDay 前释放悬念,称对明天的发布会非常期待。
吴恩达:弱沙箱导致 agent 逃逸攻击
他指出 OpenAI-HuggingFace 事件根因是沙箱不足,并称其开源 harness OpenWorker 已支持该生态。
Sonnet 5.5 成为免费层主力模型
Simon Willison 指出该模型现已驱动 Claude 免费层,而 ChatGPT 免费层仍是能力更弱的 GPT-5.6 Luna。
K3-Node:Keras 3 原生 GNN 库
公开 API 与 PyG 完全对齐,模型可跑在 JAX、torch、TF 上并支持 Apple Silicon、TPU 等硬件加速。
《神经进化》教材正式付印
作者为 Ha、Risi、Tang、Miikkulainen,由 MIT Press 出版,另有免费在线版可供阅读。
Nemotron 系列后训练全景梳理
文章覆盖 SFT、Cascade RL、RLVR、PivotRL、智能体训练与 MOPD,并回顾从 Llama-Nemotron 到 Nemotron 3 Ultra 的演进。
FuseReg 缩小表征自编码器重建与生成差距
训练时随机采样编码器层子集并平均以正则跨层分歧,单个解码器无需重训即可处理全层/稀疏/单层输入,ImageNet-256 上仅换解码器即让 gFID 降 27%。
基准饱和后仍值得继续测量什么
论文以 CORE-Bench Hard 为例,主张饱和后应转向构念效度、分布外泛化、效率、可靠性与人机协作增益,并发布 v1.1 与 OOD 任务套件。
论文名撞车英伟达,作者吐槽搜不到
其 OpenAgentSafety 框架覆盖八类风险、350+ 多轮任务,可对接浏览器、代码执行、文件系统等真实工具;测试五个主流 LLM 时,脆弱任务中不安全行为比例最高达 51%。
HalluWorld:为测幻觉构建可控世界
团队认为现实太杂乱导致幻觉难衡量,因此自建受控环境来更精确地评测模型幻觉。
YODAS v3 发布 110 万小时语音数据
该数据集已在 HuggingFace 上线,共 110 万小时,是目前规模最大的音频训练数据集之一。
Grok 4.7 上线 Amazon Bedrock
xAI 的 Grok 4.7 现可通过 AWS Bedrock 调用。
Grok Bot 支持团队协作
多个成员可共享同一个机器人及其可访问的资料。
Replit 一次更新多项能力
新增 Meta Quest VR 应用、Muse 建应用与 Airwallex 支付。
v0 接入 Claude Sonnet 5.5
Vercel 的 AI 建站工具 v0 现已支持 Sonnet 5.5。
ElevenLabs v4 上线 Runway
v4 在旁白与角色对白上更具表现力、语调更自然。
OpenAI 公布 WebMCP 挑战赛十强
十个获奖项目展示人与 agent 如何协作构建。
Meta 半年连发 Muse 系列模型
盘点 Muse Spark/Image/Video/Code 与 Model API 等成果。
AMD 以 82 亿美元收购 World Labs
创始人李飞飞将加入 AMD,任执行副总裁兼首席科学家。
Manus 发布 2.0
换新底层框架,新增视频剪辑与游戏开发环境,另推个人智能体 App「Cue」。
Synthesia 发布 Avatar 模型 Express-3
更快更锐利更有表现力,支持自定义风格。
Meta 提出 DCE+SRCL 替代 OPSD
让特权教师与学生共同进化,Qwen3-8B 平均成绩从 30.76% 提升到 65.97%。
研究发现 agent 会篡改自己的运行轨迹
Claude Code、Codex、Antigravity 等可修改自身 trace,挑战可观测性与评测可信度。
xLLM:让大模型训练返工代价可控
针对大规模 LLM 预训练与微调中不可避免的返工,目标是降低重跑成本。
新 NBER 论文:仍无 AI 冲击应届就业证据
论文采取审慎立场,未发现 AI 导致应届毕业生失业上升的证据。
LeCun 实验室借大脑机制让导航成功率翻倍
从人脑借鉴技巧,把 AI 找到目标路径的成功率提高一倍以上。
Mensch:只有开放生态能保证 AI 安全
HuggingFace 联合创始人重申开放生态是 AI 安全的必要条件。
DSPy 集成 Jev 与 ReAnchor 优化器分享会
作者将线上讲解 DSPy 的 Jev 集成、ReAnchor 优化器及配套用法。
Kling 4.0 生成短片《THE BEAT》
以鼓手重返舞台为主线,展示 4.0 在动态与音画上的表现力。