2026年9月17日 · 星期四

行业 · 模型治理

OpenAI 发布模型失配披露框架

新的框架为实验室如何跟踪、调查并公开模型失配设定了标准与时间线,即使行为尚未被完全解释或缓解,也要求对外披露。

OpenAI 公布了一套用于跟踪、调查和披露模型失配(model misalignment)情况的新框架。它明确区分了不同严重程度的案例,并为公开披露设定了标准与时间表,包括在团队尚未完全解释或缓解该行为时应当如何对外说明。OpenAI 表示,更复杂的案例可能需要更长的调查周期,但披露的义务不会因此免除。业内普遍认为,这是实验室在模型透明度与安全治理之间寻求平衡的一次制度性尝试,也回应了外界对前沿模型能力越强、风险越难评估的长期关切。


「Jev 让 p95 快了 18 倍,也更准确——它正在进入 Vercel AI Gateway,很可能成为新的默认。」

Guillermo Rauch · Vercel
模型发布 · 音乐生成

StepFun 发布 StepAudio 3 Music

StepFun 与 ACE Studio 推出首个音乐生成基础模型,可从提示与歌词生成完整歌曲。

StepFun 与 ACE Studio 联合推出其首个音乐生成基础模型 StepAudio 3 Music。用户可以用自然语言描述想要的流派、情绪、人声特质、乐器、调性与 BPM,再配上一段歌词,模型即可生成完整歌曲,并对歌曲结构进行精细控制。这标志着 StepFun 在音频模型上从语音走向了音乐创作。

业界动态INDUSTRY
模型与研究MODELS & RESEARCH
@_akhaliq

StepAudio 3 Realtime 技术报告

围绕「听—说—想—做」循环,Deep Perception 提取声学线索,Seamless Duplex 建模同步音频流,Think-While-Speaking 并行推理与语音输出。

@_akhaliq

持续学习机制组合提升长时记忆

组合数据、函数、权重锚点与 merged LoRA,把 100 任务平均最终保留率从 1.2% 提升到 34.9%,提升约 28 倍。

@emollick

Mollick 批公共 AI 基准状态糟糕

知名基准已趋于饱和,未饱和基准则错误众多,严重低估 AI 能力,正侵蚀我们对当下 AI 真实水平的判断。

@emollick

谷歌研究:AI 每周为科学家省 7 小时

AI 加速科研,但也增加验证工作并可能影响选题,文章还给出「锯齿前沿」示意图。

@CoffeeVectors

谷歌展示递归自我改进循环

转发称 Google/DeepMind 研究者提出用于 AI 发现的递归自我改进循环。

@MiniMax_AI

MiniMax H3 家族上线 Monid

Monid 推出 MiniMax H3 系列,宣称比 Seedance 2.5 快 10 倍,按量付费无订阅。

@Alibaba_Wan

Wan3.0 宣称非增量更新

官方称 Wan3.0 在运动参考、一致性、创作控制与分辨率上大幅跃升,对创作者更友好。

@ViduAI_official

Vidu S2 正式上线实时编辑

S2-Editing 支持实时切换风格、服装、主体与背景,并发放邀请码免费体验。

@ViduAI_official

Vidu S2 进入 Beta 流式视频

面向实时交互的流式视频模型,增强运动、情感、意图理解与语音稳定性,适用于直播、AI 伴侣与游戏 NPC。

@clementdelangue

Arcee AI 完成 B 轮估值超 10 亿

Arcee AI 宣布 Series B,估值超 10 亿美元,用于加速下一代模型与产品。

@hardmaru

Extropic 发布 Z1T 稀疏概率模型

首个面向 Z1 稀疏概率硬件的类 Transformer 模型家族,宣称实现加速。

@_akhaliq

HuggingChat 默认 DeepSeek-V4.1-Flash

HuggingChat 将默认模型更新为 DeepSeek-V4.1-Flash,展示开源 AI 当前水平。

产品速览PRODUCT
观点与评论OPINION
@sama

Altman 称发布延期至下周

原定本周发布的主要内容将推迟到下周,值得等待,未透露具体产品。

@dotey

传 GPT-6 Sol 延期至下周发布

中文推主称原定发布延期,估计为 GPT-6 Sol。

@clementdelangue

Hugging Face CEO 谈 AI 网络攻击

在遭遇 AI 主导网络攻击后,Clement Delangue 认为现行网络法律可能过时。

@ylecun

Hugging Face 成 AI Agent 攻击受害者

作为首个公开的 agent 网络攻击受害者,公司已正式化应对经验。

@random_walker

研究者称 AI 信息洪水被低估

AI 造成通信渠道过载,有 50 多种「洪水」,带来巨大时间成本。

@simonw

各家竞相成为通用 Agent

OpenAI 将 Codex 桌面应用改名 ChatGPT,反映行业都在争夺通用 agent 定位。

@emollick

存在性讨论与 AI 普及现实存在张力

新闻被 AI 存在风险主导,但个人与企业对 AI 的采用正快速增长。

@emollick

AI 正模糊编码设计产品岗位

AI 使跨职能工作重叠,组织需要新的工作模式。

@emollick

快速分类模型比 LLM 更快更便宜

按决策规则快速分类信息的 AI 模型,非 LLM、不能输出文本,但在系统中角色有用。

@ylecun

黄仁勋反对收紧 AI 监管

在 Dreamforce 上,黄仁勋反驳呼吁更严监管、放慢 AI 发展的 AI 实验室。

@ylecun

LeCun:形式证明搜索不等于通用智能

在搜索和写下定理形式证明上超越人类,不等于通用智能。

@ylecun

评论:OpenAI/Anthropic 盈利取决于成本比

两家公司需降低训练成本相对推理利润的比例才能盈利。

@clementdelangue

Naval 论 AI 风险应像火普及

若 AI 风险类似火则人人应拥有,若类似核武则需集中控制。

@amasad

AmaSad 建议枚举 logprobs 输出

若输出域预先已知,不如训练模型输出枚举上的 logprobs,而非生成文本。

@teortaxesTex

DeepSeek V4.1 Flash 评估 gap 受关注

其重要性与评估社区兴趣之间落差最大,缺乏 ARC-AGI、math-arena 等评测覆盖。

@natolambert

大规模 RL 资源公开

被称为迄今最酷的规模化强化学习公开资源之一。

短讯BRIEFS

© 2026 FAV0 · AI Daily