头版头条 · 科学发现
Claude 发现噬菌体 DNA 中未知酶系统
一个形态酷似 CRISPR 的重复序列旁,藏着一套此前从未被记录的酶机器——它或许指向一种全新的基因编辑机制。
Anthropic 团队今日宣布,Claude 在噬菌体的 DNA 中识别出一个此前从未被记录过的酶系统。最让研究者在意的是,编码这个酶的基因旁边,紧邻着一长串重复的 DNA 结构,形态与 CRISPR 高度相似,却并不属于已知的 CRISPR 家族。
目前团队尚不清楚这套系统究竟起什么作用。它可能是细菌抵御噬菌体的又一种天然防御机制,也可能是一种尚未被表征的基因编辑工具。无论属于哪一种,这条发现都把「AI 驱动的科学发现」从口号,变成了一件可以复核、可以继续下钻的实验对象。
Anthropic CEO Dario Amodei 在个人账号补充说,这套分子机器的精确功能、生物技术价值与重要性都还谈不上明确,但「至少,这是一项我会为之骄傲的工作」。这条消息在社交平台获得超过 1400 万次浏览,是当天 AI 圈热度最高的一条。
产品发布
ChatGPT Voice 大更新:插件与 GPT-6 系列
OpenAI 回应了用户长期以来的呼声:ChatGPT Voice 现在可以调用邮箱、日历与 Slack 等插件,并由 GPT-6 Astra、Sol 与 Luna 三款模型提供能力。与此同时,ChatGPT Work 在网页与移动端同步上线,用户可以在其中创建文档、演示文稿、站点与电子表格,或直接处理更复杂的多步任务。
模型发布
Google 发布 Gemini 3.8 Flash TTS 模型
一次性推出 Flash TTS 与 Flash-Lite TTS 两款模型,主打自定义音色、口音与规模化部署;其中 Flash TTS 可设计带有鲜明口音与特征的独特声音,Lite 版本则面向效率与成本敏感场景。
模型发布
Qwen 发布 Intelligence 与三款 SOTA Agent
阿里通义把「个人智能」作为新主线,一口气带来 Mobile Planner、Mobile-Use 等多款 Agent;其中 Mobile Planner Agent 在 MobilePA-Bench、MobilePA-Bench Business 与 Memory 三个榜单登顶。
研究
OpenAI 发布心理健康基准 MentalHealthBench
一个由 80 多位心理健康临床医生参与构建的开放基准,用来衡量前沿模型在真实心理对话中的表现,并已开放给其他研究者审查。
产品
Claude 团队两周让 claude.ai 提速 3 倍
团队用 Claude 做基准、调试与性能改进,通过 Slack 迭代与安全护栏上线约 3000 个变更,两周内把 claude.ai 的速度提升到原来的 3 倍。
行业
Claude 助力刚果埃博拉疫情应对
CEPI、WHO 非洲区域办事处与金沙萨国家生物医学研究所正用 Claude 加速应对一种罕见埃博拉毒株,目前该毒株尚无确认有效的疫苗。
模型发布
Qwen-Audio-3.1 发布:五模型音频栈
ASR、TTS 与实时交互全面升级,新增 TTS-Next 与 ASR-Next 两款模型,覆盖理解、生成、交互与创作,并在价格上大幅下调。
研究
TPU megakernel 让 Kimi K3 达 709 tokens/s
inferact 团队开源的 TPU megakernel,把 Kimi K3 全部 92 层 MoE 跑进单个 Pallas 内核,低并发解码达到 709 tokens/s,明显领先 GB200 基线的 450 tokens/s。
模型发布
Black Forest Labs 开源 FLUX 3 Action
一款 7B 世界动作模型,在 RoboLab 等榜单达到 SOTA;骨干与具身微调权重全部开放,团队称之为「令人骄傲」的一次发布。
模型发布
Claude Opus 5.5 发布:更便宜更快
Anthropic 新模型比 Opus 5 便宜约 40%、快 30% 以上;Higgsfield 借机展示其在 3D 与创作方向的能力。
「至少,这是一项我会为之骄傲的工作。」
Dario Amodei · Anthropic 联合创始人兼 CEO
GitHub Copilot 上线 GPT-6 Sol 等新模型
GPT-6 家族在 Copilot 中扩展,新增模型正式可用。
Claude Code 云会话正式可用
关闭笔记本后仍可继续工作;Pro 用户获 100 美元、Max 用户获 250 美元试用额度。
Qwen-Image-2.1 登顶开源图像双榜
在 Image Edit 与 Text-to-Image Arena 中成为第一开源模型。
NVIDIA 发布 Nemotron 3 说话人分离模型
多人同时说话时追踪发言者,适合语音应用。
GGUF 模型可直接在 Transformers 运行
ggml 的 Metal 内核进入 Transformers 生态,提升本地推理效率。
Cursor 推出 Rollouts 部署监控
自动写监控计划并观察部署变更,提前捕获回归。
Pika 上线 Seedance 2.5 草稿模式
低至每秒 10 美分快速生成片段,满意后再高清定稿。
Recraft V4.1 Flash:1.3 秒生成图像
号称市场最快图像模型,支持 Refine 细节清理。
DiffusionGemma-Jev 现已支持 vLLM
支持 yes/no、多选与评分问题,并在每个答案槽读取置信度。
NVIDIA 发布 SWE-Serve 服务路径基准
由 83 个 SGLang PR 蒸馏为 53 个仓库级任务,衡量本地检查到完整服务路径的差距。
ESA 与 Mistral 加强 AI 合作
探索安全可信的欧洲 AI 应用。
Hugging Face 在联合国谈 Agent 网络攻击
Clément 称其为首个披露 Agent 网络攻击的公司,呼吁透明与开源防御。
Apple 在 Hugging Face 发布 Qwen3.5-9B 微调模型
可将长文档转为小段落等,具体功能待确认。
Claude Opus 5.5 将对部分能力回退模型
传闻称其为首个在特定能力上回退到较弱模型的 Opus。
TPUv7 达 700 tok/s/user,性能领先
SemiAnalysis 称较基线提升 56%。
Tesseract:面向 GPT-6 的视频创作套件
第三方团队称其为 GPT-6 Astra 与 Sol 重建 After Effects / Premiere 的创作套件。
Claude Code Projects 支持本地运行
线程现可在用户自己的机器上运行。
混元 Hy Image3.5 预览版限时免费
在 OnSolo 免费两周,支持短剧角色表、游戏素材与关键帧。
Cursor 降低 7% token 成本
通过更紧提示、选择性工具加载、缓存与压缩文件读取实现。
Ollama 云模型支持按量付费
无需订阅即可为付费云模型添加使用额度。
Vidu S2 推出实时编辑功能
可实时切换风格、服装、主体与背景,免费邀请码试用。
成功 Agent 都有大脑、手和文件
rauchg 总结模型 / 编排、工具 / 计算机、记忆 / 技能 / 仓库三大组件。
Grok 4.7 排名上升
马斯克公布 Grok 4.7 在榜单中前进。
Muse Spark 长上下文工作分享
团队自 1.1 起持续研究长上下文。
HipKittens 在 AMD Helios MI455 上运行
分享在 AMD 新硬件上的 GEMM 教学与性能。
Arav:永远不要看空开源权重模型
一句话表达对开放权重路线的信心。
开源 Agent Harness 价值在可审查
不只是免费,而是能检查在电脑上运行的每一行行为。
rauchg:软件不会死,可自己生成部署
以 Google Reader 为例,认为用户可以永久自建替代品。
AINews 把 Claude Opus 5.5 设为默认模型
评测称其更简洁、更克制,比 Opus 5 少了很多「废话」。
模型成本在能力上升中快速坍缩
一张图显示硬数学与科学基准的达标成本正断崖式下降。
AI 变便宜的速度超过史上任何技术
Epoch AI 指出,在相同性能水平下,AI 成本下降最快。
Gemini 3.8 TTS Playground 上线
可编排单人旁白或多说话人对话,2000+ 声音且支持克隆。
Opus 5.5 与 GPT-6 Astra 3D 网页对决
同一提示词下制作日式樱花山谷 3D 网页,两者正面交锋。
SAM 3.1 开源图像与视频分割
可通过 Meta API 与 Hugging Face 获取。
蒸馏是 RL 前常见模型准备方式
从更强模型学习,再通过 RL 提升。
开放基准难以区分模型已知与能力
研究者抱怨很难拆解模型到底是知道还是推理。
用 DSPy 生成 JEV 决策训练数据
可从任意原始文本生成选择式决策数据。