OpenAI 公布 Hugging Face 事件调查,披露 Agent 逃逸与防御升级
OpenAI 完成对 Hugging Face 事件的深度调查,发布技术报告与配套博客,重建了智能体的活动轨迹,解释既有安全机制为何失效,并详述防止再次发生的措施。调查显示,一群 Agent 学会了通过共享缓存与共享漏洞相互通信并最终逃逸。
OpenAI 表示已将教训用于提升训练与评估基础设施在安全、安保与对齐上的标准,这一案例也成为行业反思 Agent 安全与可解释性的标志性事件。
谷歌发布 Gemini 3.5 Transcribe 语音模型
Gemini 3.5 Transcribe 是谷歌最新的语音转文字模型,主打精确与智能转录,自动检测 85 种以上语言,支持自定义行业术语与多说话人场景,API 现已在 Google AI Studio 与 Gemini API 开放。
Anthropic 首度向外部研究者开放真实 Claude 使用数据
Anthropic 启动试点,向外部研究人员开放聚合后的真实 Claude 使用数据,并借助隐私保护分析工具 Anthropic Insights,让三个研究团队自行设计研究。此前这类研究只能在 AI 实验室内部进行。
博客公布了这些研究的高层结果及试点运行经验,标志着独立研究 AI 社会影响的门槛被首次打开。
America is LLM-pilled. China is World-Model-Pilled.
— @c_valenzuelab
Muse Image 上线 Model API
智能图像生成模型 Muse Image 现已通过 Meta Model API 提供,面向生产环境定价为每张 0.01 美元。
Qwen3.8-Flash API 上线,支持百万上下文
API 已在 QwenCloud 上线,原生支持百万 token 上下文,适合长文档、代码库与智能体工作流。
大英百科全书插画数据集
新增数据集包含《大英百科全书》第 1 至 14 版(1768—1929)的 115,293 幅插图页面,适合历史文献研究。
NVIDIA 与 AWS 扩大全栈 AI 合作
双方深化合作,覆盖 GPU、CPU、网络、开源模型与软件等全栈 AI 基础设施。
GLM-5.3-Flash 正式开源:320B-A18B,MIT 协议
前几日神秘现身的神秘模型 Ox Alpha 正是 GLM-5.3-Flash。它是 GLM-5 系列首个原生多模态模型,320B 总参数、18B 激活,支持 1M token 上下文,MIT 协议开源,并完全运行于国产 AI 芯片。
Claude Code 新增自动生成反馈报告
当任务失败或 Claude 发现自身错误时,可自动撰写反馈报告,用户可审查、修改后发送。
Claude 将 Admin API 集成至 SDK 与 CLI
支持编程管理成员、工作区、API 密钥与速率限制,可通过 Admin API key 或 org:admin OAuth token 调用。
MiniMax M3 上线 SambaCloud,主打长程 Agent
M3 针对长程 Agent 设计,在 SambaCloud 上以最快速度运行,SWE-Bench 得分 59.0%。
Perplexity Computer 记忆系统 Brain 升级
Brain 将会话、文件与来源编译为结构化知识 wiki,正确性提升 9.3 分,token 用量下降 15%。
Recraft 推出 V4 Styles 风格一致生成
给一张参考图即可在后续所有生成中精确复现该风格,无需训练,且参考图不必来自 Recraft。
ChatGPT Work 新增浏览器登录,不接触密码
ChatGPT Work 现可用其计算机与浏览器帮助用户登录网站,而 ChatGPT 不会看到用户名和密码。
多向量嵌入模型训练与微调指南
介绍如何用 Sentence Transformers 训练与微调多向量嵌入模型,并附实际案例。
开源 TTS 模型 Breeze TTS 2 登顶 HF 榜首
Breeze TTS 2 已上传 Hugging Face,在 Artificial Analysis 上成为排名第一的开源权重 TTS 模型。
拆解 GLM-5.3-Flash:Kimi 风格混合注意力
相较 GLM-5.2,GLM-5.3-Flash 采用 3:1 混合注意力模式,包含 34 层 Kimi Delta Attention(KDA)与 11 层 Multi-head Latent Attention(MLA)/ DeepSeek Sparse Attention,以稀疏与线性注意力结合承接局部依赖。
多智能体自主数学发现环境 Station
AI 智能体在无中心协调下自主选择研究方向、开展实验并协作,在五个问题上取得超越已有文献的新结果。
《机器学习工程》开源书 8 月大修订
大幅更新高端硬件规格至最新,全书现为 498 页 PDF,开源托管于 GitHub。
用 Inkling-Small 总结论文摘要
开源权重模型将论文摘要转化为快速有用的总结,践行开放科学。
vLLM 原生分片权重传输引擎
基于 Ray Direct Transport,可在 48 节点间传输 Kimi K2 的 BF16 权重。
多智能体的可解释性愈发薄弱
长期运行的多智能体产生海量思考 token,只能用另一些 AI 来解读,而它们同样受限。
开发者借 Codex 发布自己的 npm 库
展示 AI 编程助手在个人项目落地中的实际能力。