OpenAI 发布模型失配披露框架
新的框架为实验室如何跟踪、调查并公开模型失配设定了标准与时间线,即使行为尚未被完全解释或缓解,也要求对外披露。
OpenAI 公布了一套用于跟踪、调查和披露模型失配(model misalignment)情况的新框架。它明确区分了不同严重程度的案例,并为公开披露设定了标准与时间表,包括在团队尚未完全解释或缓解该行为时应当如何对外说明。OpenAI 表示,更复杂的案例可能需要更长的调查周期,但披露的义务不会因此免除。业内普遍认为,这是实验室在模型透明度与安全治理之间寻求平衡的一次制度性尝试,也回应了外界对前沿模型能力越强、风险越难评估的长期关切。
Mistral 与 Mozilla 合作隐私 AI 浏览
Mistral 与 Mozilla 宣布建立合作,目标是把开放、私密、多语言的 AI 能力直接引入网页浏览器,让用户在熟悉的浏览场景里使用可信的 AI。官方博客题为《Mistral x Mozilla: Private, Multilingual AI Browsing》,强调 AI 将进入用户已有的浏览器,但并未披露具体产品形态与上线时间。
Cohere 与 Aleph Alpha 合并跨大西洋
Cohere 与 Aleph Alpha 签署最终协议,成为首个横跨大西洋两岸的基础模型开发者。合并后的公司统一以 Cohere 名义运营,员工规模将增长至超过 1000 人,覆盖北美与欧洲两大市场,把加拿大与德国两地的研发与产品团队整合到同一套体系下。
「Jev 让 p95 快了 18 倍,也更准确——它正在进入 Vercel AI Gateway,很可能成为新的默认。」
Guillermo Rauch · Vercel
Claude Code 集成 Design/Slides/Docs
Claude Design、Claude Slides 与 Claude Docs 现在可以直接在 Claude Code 里使用:把仓库中的真实文件与 RFC 指向这些能力,就能生成设计评审或 UI 原型,自行编辑或继续在对话中推进,完成后分享链接即可。
TypeSafe AI 发布 System One 模型 Jev
由 ChatGPT 联合发明人创办的 TypeSafe AI 推出了一类全新模型「System One」,其首个模型 Jev 完全放弃文本生成,专门为软件内部的快速决策而设计:输入非结构化数据,输出带校准概率的类型安全结构化结果。
Meta 倡导个人超级智能与普惠
扎克伯格在《The Future is for Everyone》中主张,超级智能应像个人电脑与互联网一样广泛惠及个人,而非由少数机构集中控制。Meta 正在构建个人代理与创作工具,覆盖健康、关系、职业与财务,并强调隐私与权力平衡。
DeepMind 成立研究所扩展 AGI 研究
Hassabis 与 Shane Legg 宣布成立 DeepMind Institute,围绕 AI 时代的经济、科学与社会影响开展跨学科研究,希望借此推动关于 AGI 下一步该如何走的关键讨论。
Shopify 商家可在 ChatGPT 投广告
Shopify 商家现在可以在 ChatGPT 中推广自己的商品,OpenAI 的广告生态进一步扩展,为电商与对话式 AI 的流量打通提供了一个新的入口。
StepFun 发布 StepAudio 3 Music
StepFun 与 ACE Studio 联合推出其首个音乐生成基础模型 StepAudio 3 Music。用户可以用自然语言描述想要的流派、情绪、人声特质、乐器、调性与 BPM,再配上一段歌词,模型即可生成完整歌曲,并对歌曲结构进行精细控制。这标志着 StepFun 在音频模型上从语音走向了音乐创作。
Runway 秋季模型集合上线
Runway 发布迄今最大的模型集合,引入 Fish Audio S2.1 Pro、MiniMax H3 Max、Cartesia Sonic 3.6、Flux 视频放大与编辑等能力。
Perplexity 发布编码代理搜索 SDK
Search SDK 支持并行检索文档、筛选官方结果与提取片段,帮助编码代理在改代码前构建有来源依据的依赖迁移资料。
豆包大模型 2.1 Pro 更新上线
升级集中在 Agent 任务交付、多模态写代码、多模态理解与推理成本,API 已在火山方舟全量上线。
Sakana AI 一年发布多款产品
今年 Sakana AI 推出聊天、翻译、Marlin、Fugu 等产品,从零建立产品团队,证明东京研究实验室也能持续交付。
vLLM 支持 Kimi K2.x 内核
vLLM Humming 后端运行 Novita 开源的 Chord W4A16 MoE 内核,H200 TP8 达 1.33 倍、B300 EP8 解码达 2.15 倍加速。
SGLang 日处理万亿 token 实践
生产深度解析用 SGLang HiCache 与 Mooncake Store 服务万亿参数模型并满足严格推理 SLO,涵盖架构取舍与 KV 缓存复用。
StepAudio 3 Realtime 技术报告
围绕「听—说—想—做」循环,Deep Perception 提取声学线索,Seamless Duplex 建模同步音频流,Think-While-Speaking 并行推理与语音输出。
持续学习机制组合提升长时记忆
组合数据、函数、权重锚点与 merged LoRA,把 100 任务平均最终保留率从 1.2% 提升到 34.9%,提升约 28 倍。
Mollick 批公共 AI 基准状态糟糕
知名基准已趋于饱和,未饱和基准则错误众多,严重低估 AI 能力,正侵蚀我们对当下 AI 真实水平的判断。
谷歌研究:AI 每周为科学家省 7 小时
AI 加速科研,但也增加验证工作并可能影响选题,文章还给出「锯齿前沿」示意图。
谷歌展示递归自我改进循环
转发称 Google/DeepMind 研究者提出用于 AI 发现的递归自我改进循环。
MiniMax H3 家族上线 Monid
Monid 推出 MiniMax H3 系列,宣称比 Seedance 2.5 快 10 倍,按量付费无订阅。
Wan3.0 宣称非增量更新
官方称 Wan3.0 在运动参考、一致性、创作控制与分辨率上大幅跃升,对创作者更友好。
Vidu S2 正式上线实时编辑
S2-Editing 支持实时切换风格、服装、主体与背景,并发放邀请码免费体验。
Vidu S2 进入 Beta 流式视频
面向实时交互的流式视频模型,增强运动、情感、意图理解与语音稳定性,适用于直播、AI 伴侣与游戏 NPC。
Arcee AI 完成 B 轮估值超 10 亿
Arcee AI 宣布 Series B,估值超 10 亿美元,用于加速下一代模型与产品。
Extropic 发布 Z1T 稀疏概率模型
首个面向 Z1 稀疏概率硬件的类 Transformer 模型家族,宣称实现加速。
HuggingChat 默认 DeepSeek-V4.1-Flash
HuggingChat 将默认模型更新为 DeepSeek-V4.1-Flash,展示开源 AI 当前水平。
Unity 推出 Codex 官方插件
Unity 发布面向 OpenAI Codex 的一方集成插件,可在 Unity 中直接使用。
Meta Muse Code 原生支持 Windows
无需 WSL,支持 PowerShell 并默认沙箱运行。
Cohere Model Vault 推出机密计算
宣称运行时工作负载无人可访问,包括 Cohere 自身。
Replit 推出自定义连接器 Beta
管理员可配置 HTTPS REST API 与 API key,接入一方连接器之外的专用系统。
LM Studio Bionic 新增多语言 UI
Bionic 1.1.3 新增日语、德语、西语、法语 UI,改进 Linux NVIDIA 语音转写与推理。
Synthesia 推出 Avatar API
实时头像可嵌入产品,支持 LiveKit SDK 与自带 LLM/知识库。
Databricks 全面部署 Astra
工程师全员部署 Astra,显示企业级 AI 编码代理落地。
Claude 合并 Cowork 与聊天入口
Anthropic 将后台任务模式 Cowork 与日常聊天合并,向 Pro 与 Max 用户逐步推送。
Claude 配额削减致 Fable 价值下降
200 美元计划实证价值从每月约 7200 降至约 6000,仅用 Fable 再减半至约 3000。
Higgsfield 推出 50+ 前沿模型 API
一个 API 接入 50 多个前沿生成模型,价格低于订阅。
YuE2 LoRA 实现哼唱成歌
Hum-to-Song 使用 YuE2 LoRA 把哼唱变成完整制作歌曲。
G5 Labs 获 1400 万美元种子轮
从 stealth 出来,构建 AI 原生软件的新抽象层。
Altman 称发布延期至下周
原定本周发布的主要内容将推迟到下周,值得等待,未透露具体产品。
传 GPT-6 Sol 延期至下周发布
中文推主称原定发布延期,估计为 GPT-6 Sol。
Hugging Face CEO 谈 AI 网络攻击
在遭遇 AI 主导网络攻击后,Clement Delangue 认为现行网络法律可能过时。
Hugging Face 成 AI Agent 攻击受害者
作为首个公开的 agent 网络攻击受害者,公司已正式化应对经验。
研究者称 AI 信息洪水被低估
AI 造成通信渠道过载,有 50 多种「洪水」,带来巨大时间成本。
各家竞相成为通用 Agent
OpenAI 将 Codex 桌面应用改名 ChatGPT,反映行业都在争夺通用 agent 定位。
存在性讨论与 AI 普及现实存在张力
新闻被 AI 存在风险主导,但个人与企业对 AI 的采用正快速增长。
AI 正模糊编码设计产品岗位
AI 使跨职能工作重叠,组织需要新的工作模式。
快速分类模型比 LLM 更快更便宜
按决策规则快速分类信息的 AI 模型,非 LLM、不能输出文本,但在系统中角色有用。
黄仁勋反对收紧 AI 监管
在 Dreamforce 上,黄仁勋反驳呼吁更严监管、放慢 AI 发展的 AI 实验室。
LeCun:形式证明搜索不等于通用智能
在搜索和写下定理形式证明上超越人类,不等于通用智能。
评论:OpenAI/Anthropic 盈利取决于成本比
两家公司需降低训练成本相对推理利润的比例才能盈利。
Naval 论 AI 风险应像火普及
若 AI 风险类似火则人人应拥有,若类似核武则需集中控制。
AmaSad 建议枚举 logprobs 输出
若输出域预先已知,不如训练模型输出枚举上的 logprobs,而非生成文本。
DeepSeek V4.1 Flash 评估 gap 受关注
其重要性与评估社区兴趣之间落差最大,缺乏 ARC-AGI、math-arena 等评测覆盖。
大规模 RL 资源公开
被称为迄今最酷的规模化强化学习公开资源之一。