2026年8月10日 · 星期一

Sakana Fugu 指挥者模型改换 Gemma 4

Sakana AI 宣布基于 Gemma 4 训练 Fugu 指挥者模型,性能与 Qwen 版相当且成本相同,并可模块化替换以适应主权需求。该设计使指挥者模型与模型池均可独立替换,未来将开发基于自研国内模型的指挥者,兼顾海外最佳 AI 能力与主权要求。

Sakana AI 于今年发布 Fugu 多智能体编排产品,将多个 AI 代理的调度封装为单一基座模型。此次改用 Google 最新 Gemma 4 作为指挥者骨架,验证了其核心设计理念:指挥者与执行模型解耦。在同等算力预算下,Gemma 4 版 Fugu 在数学推理与工具调用基准上与 Qwen 版打平,且成本结构不变。这一验证意味着部署方可根据所在地合规要求,自由替换底层的基座模型与模型池,而无需重写编排逻辑。Sakana AI 同时透露,正在研发基于日本自研模型的指挥者版本,以满足本土主权 AI 部署需求——这也呼应了全球多国对"AI 模型供应链自主可控"议题的日益重视。




产品与技术08.10

开放权重模型蒸馏疑云:推理轨迹是关键

有传言称 Kimi、Qwen、MiniMax 等模型存在蒸馏,好的蒸馏依赖通常隐藏的推理轨迹。作者指出此事与自身博士研究高度相关。

免费 Mac 字幕工具 BaoCut 本地转录剪辑一条龙

BaoCut 基于 Apple MLX 本地转录与说话人识别,云端模型默认关闭;所有 AI 操作生成建议、确认后才生效,支持翻译、软剪辑和导出。

LlamaIndex

LiteParse 毫秒级抽取 PDF 结构化数据

LiteParse 可快速从 PDF 中提取复选框、注释、矢量图形等结构化信息,进一步降低文档解析的门槛。

Pika Labs

Pika 演示 Seedance 2.5 音频生成 MV

Pika 向 Seedance 2.5 输入音乐、角色和场景参考,生成了一支完整音乐视频,编舞表现尤为令人印象深刻。

评测

Codex 基准偏向大模型?排名倒挂引争议

评测显示 Codex 在 GLM 5.2 排名第 2,但在 Gemma-4 掉到第 9,暗示基准对大模型过度优化,引发社区对评测公平性的讨论。

社区

Hugging Face 每 7 秒新增一个仓库

Hugging Face 约每 7 秒收到一个新仓库,相当于每天 1.2 万个新模型和数据集。开放 AI 生态的增速持续惊人。

xAI

Grok Build 升级为全能创作环境

Grok Build 现已支持用 Grok Imagine 生成图像和视频,正在成为集编码与创作于一体的一站式平台。

论文

本周 Hugging Face 热门论文:长程智能体与多模态生成

Hugging Face 每周论文盘点涵盖长程智能体、自改进强化学习和多模态生成等前沿方向。

调研

美国 75% 恐惧 AI,中国 80% 兴奋

调查显示美国人对 AI 恐惧比例高,而中国压倒性乐观。Yann LeCun 转发称这一叙事差距值得关注。

Anthropic

Swyx:Ultracode 是编码模式重大创新

Swyx 认为 Anthropic 的 Ultracode 是近年来最重要的编码模式创新之一,动态工作流潜力巨大。有参赛者仅用 3 个提示词即完成不错作品。

算力

MFU 曾是营销指标,HFU 为何没流行

讨论 MFU 的起源与 HFU 的消失,反思算力利用率指标背后的动机。社区调侃:去掉 M 只剩一个不太吉利的缩写。

Photo AI

Photo AI 上线 Seedance 2.5,价格降 95%

Photo AI 集成 Seedance 2.5 视频模型,称其为最逼真模型且比其他平台便宜 95%,引发对 AI 视频创作成本曲线的讨论。


观察与评论08.10

今日快讯08.10



© 2026 FAV0 · AI Daily