Kimi K3 正式登陆 Databricks 平台
月之暗面 Kimi K3 现已在 Databricks 平台上线,面向企业用户提供部署服务,标志其商业化进程再进一步。
月之暗面宣布其旗舰推理模型 Kimi K3 已正式上线 Databricks 平台,企业用户可直接通过 Databricks 部署和调用该模型。Kimi K3 是月之暗面最新的长上下文推理模型,此前已在多个第三方评测中表现突出。此次登陆 Databricks 意味着 Kimi 系列模型正式进入企业级分发渠道,与 OpenAI、Anthropic 等厂商在同一基础设施平台上展开竞争。
腾讯混元发布 Hy3D WorldClaw:一句话生成可探索 3D 世界
腾讯混元推出 Hy3D WorldClaw,一个智能体驱动的工作流,可从文本提示直接生成大规模、可自由探索的 3D 开放世界,全部由可编辑的游戏级资产构建。
与传统视频生成或 Gaussian Splatting 方案不同,WorldClaw 生成的每个场景均可自由探索,且所有资产均为可编辑的游戏级 3D 模型。该工作流采用 agentic 架构,能够自动拆解文本指令、分配场景元素并生成完整的可交互环境,为游戏开发、影视预演和虚拟制片提供了全新的创作路径。
ChatGPT 桌面应用登陆 Linux
OpenAI 推出 Linux 版 ChatGPT 桌面应用预览,支持 ChatGPT、ChatGPT Work 和 Codex。
OpenAI 发布 ChatGPT 桌面应用的 Linux 预览版,将 ChatGPT、ChatGPT Work 和 Codex 带入 Linux 工作环境。开发者可在 Linux 系统上直接运行项目、管理浏览器工作流,无需离开已有的开发环境。这是 OpenAI 首次为 Linux 桌面提供完整的 ChatGPT 原生应用支持。
Mistral 发布欧洲 AI 自主路线图
Mistral 宣布整合推理基础设施、开放模型与长期承诺,帮助欧洲掌控 AI 未来。
Mistral 发布了一份覆盖推理基础设施、开放模型和长期投资承诺的综合路线图,旨在支撑欧洲的 AI 主权。该计划强调区域内推理部署和新一代欧洲计算基础设施的建设。Mistral 正在将开源模型、自建基础设施和政策倡导三者打通,为欧洲提供一个独立于美国和中国技术体系的 AI 发展路径。
Lightricks 发布 LTX-2.5 视频模型合集
LTX-2.5 包含基础模型、量化模型以及配套 LoRA 和 IC-LoRA,覆盖文本到视频与图像到视频场景。
LTX-2.5 是 Lightricks 发布的模型集合,包含基础模型、量化版本及配套的 LoRA 和 IC-LoRA。该集合下设多个子模型,如蒸馏后的两阶段图像到视频模型、19B 参数文本到视频模型以及图像到视频模型。相关模型和权重已在 Hugging Face 上线,并提供了社区共享与历史记录功能。
Meta Muse Glimmer 与 NVIDIA Nemotron 3.5:30B 开放模型双子星
Meta 发布 Muse Glimmer 30B 多模态 agentic 模型,NVIDIA 同期推出 Nemotron 3.5 Lightning 30B MoE,美国开源大模型迎来密集发布期。
Meta 发布 Muse Glimmer,一款 30B 参数的多模态 agentic 模型,支持本地部署,提供 BF16 权重、GGUF 量化、ExecuTorch 构建及 DFlash 草稿模型。NVIDIA 同期推出 Nemotron 3.5 Lightning,采用 30B MoE 架构、激活参数仅 3B,由 Nemotron 3 Ultra 蒸馏而来,面向高容量 agentic 场景和常驻代理,支持最长 1M 上下文窗口,可在本地 RTX、DGX 和边缘 Jetson 设备上运行。社区观察者 gneubig 评论道,两大美国公司接连发布 30B 开源模型标志着美国开放 AI 开发热潮的回归。
「我们被许诺了飞行汽车,结果每个人得到了无限的超级智能。」
— @rauchg,Vercel 创始人
Nemotron 3.5 登陆 LM Studio
Nemotron 3.5 登陆 Ollama
vLLM 适配吞吐提升 4 倍
SGLang 首发 Nemotron 支持
ChatGPT 桌面应用支持跨 Agent 导入同步
OpenAI 允许用户从其他 Agent 导入项目、聊天、技能和插件,并支持自动更新同步,现已在桌面应用可用。这一功能打破了不同 Agent 平台之间的数据孤岛,使开发者可以在统一界面下管理多个 AI 工作流。
阿里 Wan-Animate-2 开源角色动画模型升级
Wan-Animate-2 带来高保真角色动画、多角色动画支持、文本控制摄像机视角和实时流式生成等功能。权重、演示和文档已在 GitHub 开放,这是继 Wan 系列视频模型后的又一次重大更新。
Gemini 月活用户突破 10 亿
Sundar Pichai 宣布 Gemini App 月活用户已突破 10 亿,成为 Google 有史以来增长最快的产品,也是其第 14 个达到 10 亿用户的里程碑产品。Pichai 对 Gemini 团队表达祝贺,称这一增长离不开全球用户的支持。
LlamaIndex 发布 ExtractBench 信息提取基准
ExtractBench 是迄今最全面的企业文档信息提取基准,涵盖 14 套系统(前沿 VLM、编程 Agent、提取 API),在 370 份企业文档、4869 页、67 种文档类型上进行了测试。该基准旨在为复杂文档信息提取提供标准化评估体系。
Codex 随 ChatGPT Linux 桌面版发布
OpenAI 宣布 Codex 将登陆 Linux 版 ChatGPT 桌面应用预览,让开发者直接在代码所在之处构建和管理项目,将开发工作流和浏览器工具整合在同一界面下。
MiniMax 提示 H3 本地推理提速关键
MiniMax 称社区使用 Sol Engine 大幅提升本地 H3 模型推理速度,官方对此表示感谢。Sol Engine 已成为 H3 系列模型本地部署的社区优选方案,显著改善了推理吞吐。
ZCode 用户突破百万,推出智能编码新能力
智谱旗下 AI 编程助手 ZCode 用户数突破 100 万,同步推送更新增强长程任务完成能力与缓存效率。
ZCode 宣布用户数已达 100 万,作为回馈重置了所有 GLM Coding Plan 用户的用量限制。此次更新重点提升了真实工程工作流中的智能水平,并将缓存命中率提升至 98%,显著改善长程编码任务的完成效率。智谱表示将继续推动 AI 编程工具在工程实践中的深度应用。
SGLang 推出 Unified Radix Cache 统一缓存架构
SGLang 团队宣布 Unified Radix Cache,解决了混合模型(全注意力 / 滑动窗口 / 循环状态)在前缀缓存中的碎片化问题。此前每种注意力模式复用不同长度的前缀,导致缓存效率低下。统一基数缓存将不同注意力类别的缓存抽象为同一数据结构,显著提升 agentic 和多轮对话场景下的服务性能。
SWE-Bench ProMax:多语言代码重构新基准
SWE-Bench ProMax 是一个多语言代码重构基准,包含来自七种编程语言的 170 个实例,平均每个实例涉及 11.4 个文件和 261.6 行代码。基准通过重写问题描述、人工审查测试套件,解决了此前基准中近 60% 测试过窄或过宽的问题。在两种 Agent 框架下,最强模型解决率仅为 41.2%,表明当前 AI 编程代理在该基准上仍面临较大挑战。
「前沿模型在 20% 以上的时间里仍然蠢得像块砖,需要比大一新生更多的手把手指导。」
— @lateinteraction
Higgsfield Layers 上线:非破坏性布局编辑
Higgsfield Layers 正式上线,支持自动图层分解以实现非破坏性布局编辑。用户可将一张平面海报转化为全套多变体广告活动,且布局在生成后保持可编辑。每一步均可回溯,设计自由度大幅提升。
Runway Seedance 2.5 上线:完整角色阵容生成
Runway 发布 Seedance 2.5,支持 50 个独特角色参照和最长 30 秒的音乐同步片段。该版本在角色一致性和场景生成质量上有显著提升,可逐段逐个生成完整角色阵容和配乐。
Vidu 发布端到端原生唇形同步技术
Vidu 推出端到端原生唇形同步方案,不同于市面上先看视频后贴口型的做法,Vidu Sing 模式在生成阶段即同步合成唇形、表情和动作,输出更自然、更精确,消除了"恐怖谷"效应。
Luma Scenes 发布:先审批再渲染的视频工作流
Luma Labs 推出 Luma Scenes,由 Uni-1 驱动。用户可逐场景精修、逐节拍调时,全部确认后再渲染输出。这套工作流解决了"十次生成只有一个可用镜头"的行业痛点。
Ideogram Ad Resizer 上线:一套设计全平台投放
上传一份设计即可导出适配 Instagram、Facebook、YouTube、电视和印刷的全套广告投放素材,支持极端宽高比。现已通过 Ideogram 应用和 API 提供。
v0 发布新侧边栏
v0 推出全新侧边栏设计,聊天按项目分组,新增实时状态指示器展示流式生成、等待和就绪状态,悬停卡片可预览网站变更文件和 Git 分支信息。
Vercel AI Gateway 发布模型排行榜
DeepSeek V4 Flash token 用量居首占比 19.2%,开放权重模型占比 53.7% 高于封闭权重。GPT-5 nano 请求量居首。
Wan CLI 上线
阿里 Wan 推出命令行工具,支持从 Agent 直接调用 Wan 生成图像和视频,与 Wan 账户积分完全同步。
AravSrinivas 称赞 Nemotron
Perplexity CEO 称 Nemotron 3.5 Lightning 是可在笔记本和 DGX Spark 上高效运行的开放权重 MoE 模型。
Recraft V4.1 风格一致性展示
Recraft V4.1 可在差异极大的主体(皇冠、珠宝、骑士、喷气机)间保持冰晶风格的材质逻辑一致性。
NeurIPS 将举办两场 DiffuLM 研讨会
NeurIPS 2026 将在悉尼举办两场扩散语言模型研讨会,涵盖扩展定律、快速采样、长上下文生成、硬件感知系统等主题。参与机构包括斯坦福大学、MBZUAI 和 NVIDIA。
前沿实验室蒸馏漏洞引关注
natolambert 评论称前沿实验室需修补蒸馏漏洞,不需要政策干预,只需产品按设计运行。相关论文已公开发表。
Grok Bot Beta 即将扩容
Elon Musk 表示将在修复早期 Beta 问题并发布 Grok 4.6 后扩大 Grok Bot 测试范围。
美国开源 AI 模型开发回归
gneubig 指出 Meta 和 NVIDIA 接连发布 30B 开源模型,标志美国开放 AI 开发热潮回归。
先靠直觉构建,再让 AI 自学习
_arohan_ 分享系统构建方法论:先用人类直觉搭建复杂系统,再用 AlphaZero 式学习和自我改进取代人工规则。
AI Prompt 即工程管理
rauchg 认为 "you've got this" 式的提示词本质上是工程管理:需要花钱追结果,也需要判断死胡同。
Claude Fable vs GPT Luna:Groq 克隆赛
swyx 用 GPT Luna Max 和 Claude Fable Ultracode 构建 Grok Imagine 克隆,Fable 在视觉效果复刻上胜出。