Qwen3.8 开源:27B 多模态模型登场
原生多模态、262K 上下文可扩展至 1M,仅 27B 参数即综合超越 Qwen3.7-Plus。
阿里 Qwen 团队兑现「开放权重」的承诺,正式发布 Qwen3.8-27B。这是一款原生多模态的稠密模型:仅 27B 参数,综合表现却超越了上一代 Qwen3.7-Plus,并在真实世界的编程与办公工作流中大放异彩。原生上下文长达 262K,可轻松扩展至 1M,为长文档理解与长时程智能体任务留足了空间。
小巧的体积是关键——27B 意味着它能完整跑在单张消费级 GPU 上。发布当天,SGLang 与 vLLM 即宣布 Day-0 支持,Ollama 也同步上架。开源社区的火速跟进,正把这个「小模型」推向本地推理与边缘部署的前沿。Qwen3.8 的到来,再次印证了开源阵营「以小搏大」的路线正在收窄与闭源旗舰之间的差距。
Claude Code 默认权限模式升级为 Auto
Auto 模式今日起成为 Claude Code 在 Pro、Max 与 Team 计划中的默认权限模式。若用户此前已手动设置默认模式,Claude 会在改动前先行询问。仍可随时用 Shift+Tab 切换模式,或在设置里以 defaultMode 固定某一模式。
Gemini 3.7 Flash 开放给 Pro/Ultra
Gemini 3.7 Flash 现已向 Gemini 聊天应用的全部 Pro 与 Ultra 用户开放。这次模型更新带来了推理能力的明显改进,让轻量级 Flash 系列在复杂任务上的可用性再进一步。
vLLM Day-0 支持 Qwen3.8-27B
Qwen3.8-27B 是一款 27B 参数的混合注意力模型,64 层中 48 层采用线性注意力,并配备视觉塔与内置的 MTP 草稿头;原生上下文 262K、可扩展至 1M。vLLM 已提供 Day-0 支持,单 GPU 即可完成部署。
SGLang 实测 Qwen3.8-27B 单卡 206 tok/s
Qwen 团队转发了 SGLang 团队的 Day-0 工作:在单张 RTX 5090 上,Qwen3.8-27B 解码速度达到 206 tok/s;在 DGX Spark 上则为 38 tok/s。开源推理框架对这款小模型的即时适配,进一步拉低了本地高性能推理的门槛。
GLM-5.3:为代码而生,剑指网络防御
在 743B 基座上做后训练,智谱把「顶级编程 + 智能体 + 网络安全」一起塞进了同一款开源模型。
智谱(Z.ai)发布 GLM-5.3,主打「为代码而生,为网络防御而备」。官方称其具备顶级编程与智能体能力——通过在 743B 基座模型上做后训练实现,并在网络安全上大幅跃升,为开源模型树立新标杆。这条推文在数小时内收获近 1.8 万点赞、超 400 万浏览,成为当日开源圈最热的信号之一。
Anthropic 发 AI 水印 FAQ 回应欧盟法案
Anthropic 发布 FAQ 回应外界关于水印的疑问:实施水印是为遵守欧盟 AI 法案,其他主要模型开发商也已签署相同行为准则并将同步跟进。这份说明意在厘清合规逻辑与落地边界。
Anthropic 发布第二期系统风险报告
作为「负责任扩展政策」的一部分,Anthropic 定期发布风险报告,披露系统风险与应对准备情况。第二期风险报告现已上线,延续其例行化的透明度实践。
到明年,使用电脑将变成一种可选项。工作会因此发生根本性的改变。
— Amjad Masad,Replit 创始人
开源模型报告:小模型主导本地推理
Hugging Face《开源模型现状(2026 夏)》显示,前沿模型持续变大,但小模型在实际使用中仍占主导;本地推理领域 Qwen 领先、Gemma 紧随其后,AI 智能体正成为 Hub 上的重要力量。
Pika 推出 4 款音频基础模型
Pika 发布 4 款覆盖生成式声音全谱系的音频基础模型,号称比市面上所有音频模型更便宜、最高便宜 20 倍。团队称其高效推理技术让 Soundtrack、Music、SFX 与 Speech 在成本上实现数量级优势。
Wan 视频上线 Agent Skills
阿里万相视频(Wan)上线 Agent Skills:既可探索社区构建的技能,也可用 Wan 打造自定义工作流并分享给全世界——从短剧生成器到 MV 生成器,把创意沉淀成可复用的流水线。
dots3-note preview:280B/16B 多模态开源
dotsstudioai 开源 dots3-note preview:280B 总量、16B 活跃的多模态模型,512K 上下文,面向真实世界长时程智能体任务;它正是 RedNote IMO 2026 金牌背后的模型。
Qwen 3.8 27B 登陆 Ollama
Qwen 3.8 27B 现已上线 Ollama,是该尺寸下最佳开源模型之一,面向智能体任务与专业工作。可直接在 Claude Code(ollama launch claude --model qwen3.8)与 OpenCode 等工具中调用。
Recraft V4.1:一次到位的商品图
Recraft 发布 V4.1,商品图一次生成即可达到生产标准,且能稳定保持风格——无需再训练、无需后期修饰,把电商物料的生产周期压缩到一次提示。
SGLang:小模型之王回来了
SGLang 团队称 Qwen3.8-27B 开源并获 Day-0 支持:在单张 RTX 5090 上以 NVFP4 与 DSpark 达 206.1 tok/s 解码,DGX Spark 上 38.28 tok/s,再次抬高「小模型」的性能天花板。
DeepSeek-V4-Pro 正式开源,MIT 许可
DeepSeek-V4-Pro 正式发布并以 MIT 许可开源,智能体能力较预览版大幅跃升;架构与预览版一致,配置可原样沿用,vLLM 自 0.25.0 起已跑通该路径。
Ollama 支持 DeepSeek Harness
ollama launch dsh 即可在自有环境完整运行,预装 Ollama 网络搜索,并可通过轨迹视图查看后台动态。
DeepSeek V4 Pro 0813 上线 Bionic
在智能体编码与自动化任务上表现强劲、成本极具吸引力,托管于美国服务器并默认开启 ZDR。
Grok 4.6 登顶 CursorBench
马斯克称 Grok 4.6 在 CursorBench 真实世界编码基准上排名第一。
Grok 4.6 的 ARC-AGI 成绩单
ARC Prize 公布 Grok 4.6(SpaceXAI)验证成绩:ARC-AGI-1 达 87.5%(0.30 美元/任务)、ARC-AGI-2 达 67.1%(0.76 美元/任务)。
Grok 4.6 图像视频理解大升级
马斯克:试试 Grok 4.6 的图像与视频理解,这是一次重大升级。
开源能让 AI 更安全吗?
@ctnzr 的观点:越多人评估一项技术,就意味着越多的审视,也意味着越多人帮忙让它变得更安全。开放带来的集体审视,正是降低风险的一条路径。
吴恩达发布 AI 工程核心技能地图
Andrew Ng 发布一份 AI 工程最重要技能的地图,为从业者梳理进入该领域所需的能力栈。
ARC-AGI-3 接近被攻克
仅通过加入一个编程 harness,ARC-AGI-3 已近乎被解决。正如所料,编程让 LLM 得以泛化。
用可执行代码为世界建模
由 LLM 引导、即时合成符号化世界模型——通过编写可执行代码来编码对世界因果机制的认知,是一种极为强大的方法。
ARC-3 公开集只是演示集
公开的 ARC-3 题目集名为「演示集」,既非评估集也非训练集,不应被用作训练数据或评测,其分数不代表真实评测表现。
别再对中国模型感到意外
GLM-5.3 约 750B 参数、仅为 Kimi K3 的三分之一,却在多数基准上超越 Kimi K3、部分超过 Claude 与 GPT;中国实验室保持前沿靠的是发布周期短而非蒸馏。
Perplexity Search SDK 开放
Perplexity Search SDK 现可接入任意智能体 harness,让深度研究能力外溢到各类 Agent 产品。
MiniMax H3 登陆 Replicate
MiniMax 最新视频模型 H3 上线 Replicate,尤其擅长基于参考图的创作。
Seedance 2.5:一句话生成 30 秒广告
Higgsfield 上线 Seedance 2.5 1080p,一条提示词即可生成完整 30 秒商业广告,新用户可免费生成。
North Mini Code 下载破 15 万
North Mini Code 开发者社区持续壮大,下载量已超 15 万;随着 OpenCode 免费额度调整,开发者可在 Model Vault 或 OpenRouter 获取该开源模型,也可本地运行。
Vercel 自称全球最快 AI 网关
Vercel 称自己是全球最快的 AI Gateway 基础设施。
Ollama 将在开源后支持 GLM-5.3
Ollama 祝贺智谱团队,并宣布将在 GLM-5.3 开源发布后提供支持。
NVIDIA 与 LG 深化 AI 与机器人合作
NVIDIA 欢迎 LG 集团会长具光谟到访,双方将扩展在 AI 基础设施、物理 AI 与机器人领域的合作。
Sakana Chat 大升级
Sakana Chat 迎来重大升级,无需登录、免费使用,由 Fugu 与 Namazu 驱动。
回溯:1988 年首个反向传播 CNN
Schmidhuber 追溯历史:首个用于视觉的现代反向传播训练 CNN 于 1988 年由在日中国研究者 Wei Zhang 等发表。