2026年9月12日 · 星期六

GPT-Rosalind 上线 API 与 Codex,主打生物推理

OpenAI 开发者账号宣布,面向生物医学研究的专用模型 GPT-Rosalind 进入 API 与 Codex:可跨论文与实验结果串联证据、衡量生物靶点的证据强度,并据此规划下一步实验。

GPT-Rosalind 把散落在论文与实验数据中的证据串成一条可推理的链路。

把生物研究的推理能力再往前推一步。OpenAI 开发者账号宣布,面向生物医学研究的专用模型 GPT-Rosalind 正式上线 API 与 Codex,开发者与研究团队现在可以直接把它接入自己的科研工作流,在药物靶点发现、实验设计等环节里充当推理助手。

它的核心能力是跨来源串联证据:把散落在不同论文与实验结果中的发现连接起来,为某个生物靶点综合权衡证据强度,再据此规划下一步该测什么。这不再是单篇文献的问答,而是一整条从证据到实验设计的推理链路。

Runway 从「只租不卖」走向「可拥有、可定制」的前沿模型。

Runway 开放模型权重授权,企业可自训自托管

企业现在可以授权 Runway 的前沿模型权重,用自己的数据微调、部署在自有基础设施并自由商业化,配套白手套服务与驻场研究者。这意味着生成式视频与图像模型开始从「只租不卖」走向「可拥有、可定制」。

OpenAI 存储平台 Habitat 年增 10 倍,峰值 2000 万 QPS

Habitat 是支撑从 ChatGPT 到 Codex 的在线存储平台,年同比增长超 10 倍;在 Rust 重写之前,其 Python 服务峰值每秒处理超过 2000 万次请求。

OpenAI 建议为 GPT-6 Astra 清理旧脚手架与技能

模型变强后,过多旧脚手架反而有害:技能描述要短、触发条件具体,用渐进披露避免冲突;AGENTS.md 里「每次编辑前必读多份文档」「强制测试」等规则可删,但要先定义「完成」标准。

Claude Code 新增插件评测命令 plugin eval

claude plugin eval 支持建立测试用例、对插件或技能跑分,并对比无插件时的差异,量化插件带来的实际价值——让「这个插件到底有没有用」第一次有了可度量的答案。

「问 AI 灭绝风险,就像问空调师傅气候变化——不如听听生态内更完整的专业意见。」

—— Clement Delangue,Hugging Face 联合创始人兼 CEO
INDUSTRY · 自动驾驶

英伟达推模块化 Robotaxi 全栈:训练、仿真、车端

英伟达以「三计算机」架构覆盖 AI 训练、仿真与车载计算,称当前所有达到商业规模运营的主要 Robotaxi 项目都在使用其技术。

MODEL · 实时语音

GPT-Live-1 上线 API,Yelp 用它接订座电话

它边听边说,通话中可被打断、补充细节或改变方向;Yelp 用它让餐厅订座电话更自然。

MODEL · 开放推理

DeepSeek-V4.1-Flash 全面上线 Ollama 云端

Ollama 云端在美国与欧洲托管该模型,零数据留存、提示与回复不记录不训练,按 token 计费与 DeepSeek API 一致并含错峰价。

INFRA · 推理优化

SGLang:DeepSeek V4.1 Flash 4×GB300 上 873 tok/s

发布 24 小时内,团队通过 FP8 GEMM 快速路径、算子融合与重叠、DSpark 优化及 MoE TP4,在 BS=1 下把吞吐推到 873 tok/s。

MODEL · 多智能体

Sakana 发布 Fugu Ultra v2 与 Fugu Max

Ultra v2 称在 DeepSWE 等部分基准超过 GPT-6 Astra 与 Claude Fable 5.1;Max 主打性价比,输出价格比 GPT-5.6 Terra、Claude Sonnet 5、Kimi K3 低 40%–60%,两者同日通过 OpenAI 兼容 API 提供。

PRODUCT · 值班助手

Anthropic 展示 Claude Tag 值班:自动定位故障

告警触发后 Claude 自动拉取指标、对比部署、检查开关,给出可能原因与修复方案,团队可直接批准并合并。

PRODUCT

Codex 桌面端可配置使用 Ollama 本地模型

OPINION

吴恩达:AI 工程能力决定你如何塑造产品

MODEL

Cognition 发布 SWE-2,SGLang 的 SpecForge 参与其中

● 今日产品与工具09.12 · PRODUCTS
PRODUCT

MiniMax Design 大升级:接入 Astra 与 MCP 生态

GPT-6 Astra 上线,新增 Blender、Photoshop、AE 等 MCP 集成与协作项目:一句话生成 3D 模型,也能把 AI 片段直接转成可编辑 AE 工程。

PRODUCT

Runway 接入 ChatGPT:从产品图到成品动画

演示在 ChatGPT 中用 Astra 调用 Runway:Runway 做风格帧、Blender 做动画、Seedance 2.5 完成最终渲染。

PRODUCT

Tailscale 模型路由器 Aperture 基于 Vercel AI Gateway

Aperture 让 tailnet 内任意用户基于身份即时访问数百个模型,无需管理密钥;零数据留存、零加价、免费 BYOK,每次响应附带成本与用量。

PRODUCT

Replit 与 Databricks 集成 GA,原生支持 Lakebase

用 Replit Agent 构建的企业数据应用可直接部署到 Databricks,沿用既有安全与治理,并连接 Lakehouse 快速交付受治理应用。

DEMO

用 Astra 与真实路况数据优化红绿灯配时

Higgsfield 演示以真实交通摄像头数据模拟不同红绿灯配时,并用 Blender 重建街景可视化车流变化。

BENCHMARK

GPT Image 2.5 对比 Nano Banana Pro:360° 一致性

对比两个图像模型在仅给每场景一张参考图时,生成一致的 360° 角色与房间序列的能力。

PRODUCT

Synthesia 支持用提示词生成自定义数字人

可用文本提示或精细面板控制,生成写实主持人、品牌吉祥物或风格化角色,替代通用库存形象。

PAPER

Solaris:一种界面世界模型演示

作者展示 Solaris 界面世界模型,可实时生成并响应用户操作的交互画面。

INFRA

AMD 与 vLLM:MiniMax M3 在 MI355X 上提速 3–4 倍

AMD 与 EmbeddedLLM 复盘 MiniMax M3 在 Instinct MI355X 上的 vLLM 优化路径,从瓶颈出发取得 3–4 倍服务性能提升,并给出可复用的调优建议。

● 观点与行业09.12 · INDUSTRY
ACADEMIA

25 位菲尔兹奖得主:AI 以解题为基准推进,与数学共同体目标严重错位

陶哲轩等联署声明警告:数学首要目标是概念理解与洞察,解题只是工具;快速量产真/假结论并匆忙发布,会妨碍方法整理、引用与归属。

OPINION

Chollet:数学学生的动摇与创作者的代际断层

他称不少数学学生说不想再当数学家,并认为 2022 年前后入行的数字艺术家可能是最后一代,AI 未必在功能上取代他们,但目标感已被动摇。

PAPER

皇家学会专刊:自然与人工智能中的世界模型

专刊汇集 AI、生物学等领域学者,探讨大模型是否真正理解世界,以及这一点是否重要。

RESEARCH

DeepMind 用姿态控制模型复原未被拍摄的记忆

团队把修复后的档案照片与姿态控制模型结合,还原人物的举止与微表情,用于纪录片《Love, Rendered》。

RISK

专家预测:AI 大规模灾难概率 2030 年前约 0.47%

一个自动预测系统估计,AI 引发的群体性灾难在 2030 年前的概率为 0.47%,任意原因的大规模灾难概率为 1.1%。

BUSINESS

Replit 收购一家完全构建于 Replit 之上的公司

Replit CEO 宣布这笔收购,并预计这只是「AI 原生公司被收购」的第一例。

PRIVACY

Anthropic 报告坐实其可完整看到用户信息

有评论指出,Anthropic 的报告表明其可完整看到用户信息,且收集范围远超聊天记录本身,并公开了被认为可能违法的信息。

CAPACITY

OpenAI 暂停新增 Pro 用户订阅

OpenAI 确实暂停了新增 Pro 用户订阅,已订阅者不受影响;官方只说在资源可提供时恢复,未给出时间表。

SECURITY

Datasette 用多个模型完成首次编码代理安全审计

Datasette 发布 1.0a39 与 0.65.4 两个安全更新,用 Claude Fable 5.1、GPT-5.6 Sol 和 GPT-6 Astra 完成首次编码代理安全审计并修复多个问题。

© 2026 FAV0 · AI Daily