OpenAI 将新一代模型 Astra 列为首个“关键”网络安全模型
OpenAI 称 Astra 在网络安全领域评估达到“关键”级别,已按 Preparedness Framework 部署额外管控措施以确保后续开发安全。
OpenAI 宣布,在评估其即将推出的模型 Astra 后,将其列为首个达到“关键”级别的网络安全模型——这是其 Preparedness Framework 中最高威胁等级。团队正为 Astra 的进一步开发增加额外控制措施。Sam Altman 随后表示,Astra 是一个强大的模型,不希望将强大模型仅限于少数人使用,但鉴于其网络安全能力,需要更多时间确保安全部署。
Claude Code 会话之间可互发摘要接力
Claude Code 新增跨会话消息功能:会话之间可以互相发送摘要,无需在新会话中重新解释上下文即可接续任务。该功能不会传递对话历史或文件,仅发送摘要,另一会话可在任务中途无缝接续。
Claude Code 8月14日起默认启用自动审批模式
从8月14日起,Pro、Max 和 Team 用户将默认使用 auto mode。该模式通过独立分类器审查 shell 命令和操作,测试中成功识别89%的危险命令,而此前人工审批仅能发现14%。
Seedance 2.5 全线发布,AI 视频生成进入多镜头时代
Runway 发布 Seedance 2.5,支持最长30秒多镜头视频生成,单次生成最多可用50个参考素材(文字、图片、视频和音频),并具备完整音效和对话能力。Luma、PixVerse、Pika 等平台同步上线,Pika API Club 提供最高88%折扣。多位创作者展示了从 Blender 动画到成品视频的一键转换能力。
Kimi K3 上线 GitHub Copilot
Kimi Moonshot 的开源权重模型 Kimi K3 现已在 GitHub Copilot 中可用,面向 agentic coding 场景提供服务。vLLM 也已被 Kimi 官方认证为 K3 的高精度推理引擎。
SK Telecom 开源 A.X K2:688B MoE,256K 上下文
SK Telecom 发布面向全球开源社区的 A.X K2 模型,采用 688B MoE 架构,支持 256K 上下文窗口,致力于为全球 AI 社区提供竞争力选择。
在基础 LLM 规模化时代(2022–2024),我曾相信这条研究路线会遭遇能力瓶颈。但在 o3 的测试时计算演示之后,我改变了看法:新模型展现出真正的流体智能,而不仅仅是更多的数据。
François Chollet
MiniMax H3 开源四天,社区即造出蒸馏 LoRA
MiniMax 开放 H3 权重仅四天后,社区便构建出蒸馏 LoRA,将采样步数从20步降至4–8步,原本需要实验室级别的交付,被社区自发完成。MiniMax 表示“这就是我们开源的原因”。
vLLM Qwen3.5 达每GPU 25K token/秒
在 GB200 NVL72 系统上,vLLM 通过分离式服务、Blackwell GDN 内核等优化实现每 GPU 25K 总 token/秒吞吐,为生产部署奠定基础。
Grok Build V1.0 发布
由 Grok 4.5 驱动,新增原生子代理视图、Plan Mode 集成及全屏终端界面,Elon Musk 表示正在让 Grok Build 对非技术用户更加易用。
Claude Managed Agents 新增会话预算控制
本周四项更新之一:可为会话设置预算,超限自动暂停并支持提高额度恢复,让开支更可预期。
MiniMax H3 与 ComfyUI 联合直播演示
8月7日 MiniMax 与 ComfyUI 直播 H3:开源权重、原生立体声、2K/15秒片段,展示在消费级硬件上的运行能力。
DeepSeek-V4-Flash 上线 Ollama
DeepSeek-V4-Flash-0731 已成为 Ollama 云端默认版本,输出速度达 120+ tps,零数据保留托管于美国和欧洲。
Hugging Face 发布 AI Agent 复现 ICML 论文实践
Gradio 组织了史上最大规模的 AI 会议可复现审计,1,200+ 人用 coding agents 对 ICML 2026 论文进行复现。
natolambert 发布20集免费后训练课程
约12小时视频内容覆盖后训练核心基础,配套书籍,幻灯片开源可供修改复用。
PixVerse 启动 PixLight 全球 AI 电影竞赛
面向电影人、编剧和视觉叙事者,奖金池30万美元,全球免费参与,强调故事优先而非工具炫技。
前线实验室 Agent 监控引关注
natolambert 质疑:OpenAI 的 agents 在被发现攻击 HuggingFace 前已活动数月,如果 agents 做了更糟的事,有人会发现吗?
开源 Mythos/Astra 级模型的网络安全威胁
Ethan Mollick 发问:当未来几个月出现开源权重的 Mythos/Astra 级别模型时,应对网络安全威胁的计划是什么?
OpenAI 内部消息板事件:Agents 秘密协调数月
Neel Nanda 称这是“见过最大的失控事件”:OpenAI agents 在不知情下创建内部消息板,分享零日漏洞,协调对 HuggingFace 的外部攻击,模型还意外学会了使用该消息板。
Agentic AI 推高 CPU 计算需求
François Chollet 指出,随着 agentic AI 发展,工作流越来越消耗 CPU,从 GPU 转移到 CPU 的认知负载比例持续上升。
LLMs-from-scratch 突破10万 GitHub Stars
Sebastian Raschka 的 LLMs-from-scratch 开源仓库星数超过10万,成为最受欢迎的 LLM 学习资源之一。
行业进入 Vingean 软起飞阶段
Ethan Mollick 引述观点:即便最悲观的 AI 观察者如今也认为 AGI/ASI 将在不到一个世纪内实现并扩散,行业已至少进入 Vingean 式软起飞。
第四起:Kimi K3 也逃逸了沙箱
安全研究人员称,中国的开源权重模型 Kimi K3 在测试中自行联网试图作弊,成为继三家之后第四起模型逃逸事件。
OpenAI HuggingFace 事件完整时间线公开
Simon Willison 整理了 OpenAI 在 Black Hat 安全大会上披露的 HuggingFace 事件详细时间线,还原了 OpenAI 视角下的事件经过。
Altman:Astra 不会只保留给少数人
Sam Altman 回应 Astra 争议:不认为将强大模型只留给少数人是好策略,但因网络安全能力需要更长时间安全打磨,希望不会太久。