2026年8月16日 · 星期日

Qwen3.8-27B 上线 LM Studio,小尺寸也能打

阿里开源模型 Qwen3.8-27B 正式登陆 LM Studio,可在笔记本上本地运行,官方称其为「笔记本尺寸、前沿级跳跃」。

一场围绕「端侧小模型」的竞赛在这个周末骤然升温。阿里通义千问团队宣布,Qwen3.8-27B 已可在 LM Studio 中直接下载运行——这是一款只有 27B 参数的密集多模态模型,却被寄予跑出「前沿级」能力的期待。过去数月,行业反复争论「小模型能否取代大模型成为默认选择」,而 Qwen3.8-27B 的落地速度给出了一个强信号:从手机到车载再到个人电脑,端侧推理的闸门正在被快速推开。对普通开发者而言,这意味着无需云端 API,也能在一台笔记本上体验接近旗舰的多模态能力。接下来几周,社区围绕它的微调、量化和 Agent 玩法,预计还会持续刷屏。

Runway 上线 Seedance 2.5,主打 1080p 细节

Seedance 2.5 以 1080p 分辨率登陆 Runway,今日起开放早期访问。

Seedance 2.5 正式在 Runway 上线,并以 1080p 分辨率提供早期访问,官方强调画质细节显著提升。对于正处在「AI 视频工具混战」中的创作者群体,分辨率与细节正是从 demo 走向交付的关键分水岭。

DeepSeek-V4-Pro 云版登陆 Ollama

DeepSeek-V4-Pro-0813 已在 Ollama 云全面上线,Pro/Max 订阅用户可用;服务托管于美国,并支持零数据保留(ZDR)。一行 ollama run deepseek-v4-pro:cloud 即可拉起推理,企业隐私顾虑进一步被压低。

Grok 4.6 接入微软 Copilot

马斯克确认 Grok 4.6 已在微软 Copilot 中提供,模型覆盖版图再下一城。这条仅有 6 个单词的官宣,转发近 1300 次、阅读量超六百万,足见「模型跨平台分发」已成当下最受关注的竞争变量。

vLLM 为 DSpark 引入动态草稿长度

vLLM 更新后,DSpark 可在 DeepSeek-V4-Pro-0813 上动态决定每一步验证的草稿量,首个 7-token 草稿 token 即可生效——此前用户只能为流量固定一个草稿长度,如今推理框架自己来权衡取舍。

Opus 4.6 级模型可本地跑在 MacBook Pro

Hugging Face CEO 转发称,Opus 4.6 Max 级别的智能已能在 MacBook Pro 上本地运行。「旗舰智能本地化」不再是口号——端侧硬件的进步正让前沿模型的体积门槛持续下移。

「Prompting is going away. Delete everything, keep Graph.」

智谱 GLM5.3 同基座,靠后训练大幅提升

博主点评:GLM5.3 与 GLM5.2 共享同一个 756B 基座,后训练却带来了巨大能力提升;反观 DeepSeek V4 Flash 仅以 304B 参数就展现出强劲实力,并推测 Luna 约在 500B 量级。「后训练」正成为大厂拉开差距的新战场。

Pika 连发 4 款音频模型,价格碾压同行

Pika 一口气放出视频配音、TTS、音乐、音效四款模型,主打超高性价比——配音约为同行半价,音乐低至十分之一。音频生成赛道突然卷起了「白菜价」。

● 模型与产品 · BRIEFS08·16
● 行业与观点 · OPINION08·16
● 短讯 · WIRE08·16

© 2026 FAV0 · AI Daily · 自动编排