MiniMax M3.1 Flash 预览版上线 Token Plan
更快更轻,面向高并发与低延迟负载;现有 Token Plan 订阅用户无需额外配置即可直接调用。
MiniMax 官方宣布,M3.1 Flash 预览版已在其 Token Plan 计费方案中上线。新模型主打速度与轻量,专为需要高并发、低延迟推理的团队设计,可在既有订阅下直接调用,无需迁移或额外配置。官方称这一版本「更快、更轻、开箱即用」,面向高吞吐、对时延敏感的生产负载,是企业级文本推理的一次务实补位。
OpenAI 修复 GPT-6 Sol/Luna 图像理解缺陷

OpenAI 表示已修复一个导致 GPT-6 Sol 与 GPT-6 Luna 图像理解能力下降的 bug。官方称 API 与 Codex(含 computer use)上的视觉任务表现应已恢复,用户在视觉类任务上应能看到更稳定的结果。此次修复覆盖了此前被指「看图不准」的核心路径,对依赖多模态输入的开发者而言也是一次体验回稳。
「开源与闭源模型的能力差距,正处在一段时期以来的最大点。」
Ethan Mollick · 行业观察

Cohere 发布 Parse 5:企业文档解析的性价比之选
Cohere 推出 Parse 5,针对常见企业文档格式,可返回表格、图片、边界框、流程图等结构化结果。官方将性价比作为核心卖点,试图在文档智能解析这条拥挤赛道上,用更低的成本覆盖更多标准格式场景,让企业级文档接入不再是昂贵的选择。
新加坡团队称近乎自主训练 309B 模型

转述称,该团队宣称已近乎自主地训练出 309B 参数模型,采用 SWA-DSA 的 DeepSeek 式架构路线。
Rasbt 点评 Ember-1:后训练路线的范本

Sebastian Raschka 重申:今天做前沿模型应基于现成模型、把预算投入后训练,Ember-1 是很好的例子。
NVIDIA Nemotron 后训练报告解读预告

Cameron Wolfe 预告将解读 NVIDIA Nemotron 系列技术报告,重点是开源权重、数据与代码下的后训练方法趋势。
用 Opus 5.5 加 JS Canvas 实现图标设计自由

宝玉分享用 Opus 5.5 以 JavaScript + Canvas 逐帧生成矢量 App Icon 的工作流,摆脱只能用图像模型出位图的限制。
Astra 质疑 DeepSeek 用华为硬件的回本周期

转述 Astra 的测算:按华为硬件成本,DeepSeek 很难在合理周期内盈利,遑论 10 个月回本,关键变量是加速器成本。
Opus 5.5 游戏动效提示词公开

op7418 分享了用 Opus 5.5 制作游戏结算动画与抽卡动画的提示词,此前演示已获得较高关注。
Sakana AI 的 SAIL 上下文模仿学习被 IROS 接收
Sakana AI Labs 公布 Scaling In-Context Imitation Learning(SAIL),研究上下文模仿学习的规模化,将亮相 IROS2026。
Spatial-Interactor:通过交互学习空间推理
新工作 Spatial-Interactor 通过与环境的交互学习空间推理,并据此构建空间记忆。
Imp 发布:把 DSPy 移植到 Elixir/BEAM
Imp 项目将 DSPy 的思路带到 Elixir/BEAM 生态,用声明式方式实现可自我改进的语言模型编程。
DSPy 3.4.0 发布,原生支持新模型
DSPy 3.4.0 新增对 Jev 与 System One 模型的原生支持,可直接在 DSPy 流程中调用。
研究者:Tinker 可视为预训练栈的商业化
Thinking Machines 的 Horace He 认为 Tinker 在某种意义上已经在「售卖」其预训练栈,但对这类产品究竟有多大市场仍不确定。
Lambert 谈开源模型「通缩论」争议
Nathan Lambert 指出,Dean Ball 当初说开源模型带来通缩/减速时被群嘲,如今类似说法却无人质疑,评价标准并不一致。
Mollick:许多系统只是靠摩擦才成立
Ethan Mollick 提醒,很多系统今天能运转只是因为存在摩擦;当摩擦很快消失,我们会看清有多少系统其实依赖它。
Fleuret:软件公司市值首轮重估将至
François Fleuret 预测软件公司市值的第一次「核弹级」重估即将发生,并称过程不会好看。
Pieter Levels:Claude 视频的音效仍是短板
Pieter Levels 认为 Claude 在视频生成上唯一还差的是声音,其合成音色明显弱于现在产出的画面质量。
研究者:模型擅长量级,方向仍然很难
_arohan_ 提醒闭源实验室同样在从 arXiv 与 X 摄取新想法,并指出模型在把握「量级」上很强,但「方向」依然困难。
Aravind 实测 Opus 5.5 替代 Fable 5.1 编排
Aravind Srinivas 称把原先用 Fable 5.1 编排的 50-100 条工作流换到 Opus 5.5 上差异很小,但仍想弄清 Fable 5.1 在哪些任务上依然更强。
Alexandr Wang 撰文解释 Muse 的产品定位
宝玉总结 Alexandr Wang 短文《我为什么要做 Muse》:Muse 想解决多数人心里有想法却从未说出口、更没做成的问题,定位更主动的个人 agent。