2026年8月19日 · 星期三

「如果对齐问题已经严重到 OpenAI 愿意把 20% 的研究推理算力投入思维链监控,那说明对齐正在成为一个必须认真对待的问题。」—— Ethan Mollick
产品与发布08 · 19

AI Agent 正在变成「AI 建造者」

过去一个月,Hugging Face 上发生了一件安静又令人兴奋的事:在 ICML 复现挑战中,1221 名人类与编程 Agent 协作,验证并复现了 2226 篇论文——Agent 开始以开源的方式参与建造。

Vercel 悬赏百万美元公开验证沙箱安全

Vercel 宣布投入 100 万美元,公开验证 Vercel Sandbox 的安全性,任何人都可用任意模型尝试逃逸,为前沿模型在真实护栏下的能力与局限带来透明度。

Sentence Transformers v6.0 发布

MultiVectorEncoder 加入家族,带来 ColBERT 风格的晚期交互模型支持,多向量检索模型的训练与使用更加顺手。

对抗式加固:让多个子 Agent 试着攻破代码

Snowflake AI Research 新增 adversarial-hardening 技能,调用多个子 Agent、使用不同模型对代码改动做攻击性测试,汇总发现后写出复现测试与修复。

AI Observatory:度量人们真实如何使用 AI

一个公开的 AI 实际使用度量项目,聚合七个真实对话来源,包含 24,521 段对话与 92,493 组用户—助手交互对,并采用 145 维特征分类法,相关论文投稿 NeurIPS 2026。

LLM 的心智理论仍有边界

LLM 拥有心智理论本身已是一件大事,但当模型需要同时考虑多个受众时局限便显现——比如写代码时难以区分终端用户与创作者的不同需求。

fx:用 Zig 写的极简编码 Agent

比主流编码 CLI 小 10–20 倍,启动迅速,可嵌入任意环境甚至浏览器。作者已把它当作日常主力工具,称其「用起来更像轻量工具而非终端里的 IDE」。

豆包越来越像 Codex

从 GUI 电脑操作到手机远程操控,豆包这波更新在设计思路上能看到不少 Codex 的影子,部分细节甚至做了本土化的超越。

Miles v0.1 上线,SGLang 站上发车引擎

MiniMax 长期伙伴 SGLang/RadixArk 发布 Miles v0.1;SGLang 作为原生 rollout 引擎,持续在吞吐、缓存效率与 day-0 模型覆盖上加码。

短讯08 · 19

© 2026 FAV0 · AI Daily · 自动编排