2026年8月27日 · 星期四




模型与产品 · 今日要闻08.27

GLM-5.3-Flash 正式开源:320B-A18B,MIT 协议

前几日神秘现身的神秘模型 Ox Alpha 正是 GLM-5.3-Flash。它是 GLM-5 系列首个原生多模态模型,320B 总参数、18B 激活,支持 1M token 上下文,MIT 协议开源,并完全运行于国产 AI 芯片。

Claude Code 新增自动生成反馈报告

当任务失败或 Claude 发现自身错误时,可自动撰写反馈报告,用户可审查、修改后发送。

Claude 将 Admin API 集成至 SDK 与 CLI

支持编程管理成员、工作区、API 密钥与速率限制,可通过 Admin API key 或 org:admin OAuth token 调用。

MiniMax M3 上线 SambaCloud,主打长程 Agent

M3 针对长程 Agent 设计,在 SambaCloud 上以最快速度运行,SWE-Bench 得分 59.0%。

Perplexity Computer 记忆系统 Brain 升级

Brain 将会话、文件与来源编译为结构化知识 wiki,正确性提升 9.3 分,token 用量下降 15%。

Recraft 推出 V4 Styles 风格一致生成

给一张参考图即可在后续所有生成中精确复现该风格,无需训练,且参考图不必来自 Recraft。

ChatGPT Work 新增浏览器登录,不接触密码

ChatGPT Work 现可用其计算机与浏览器帮助用户登录网站,而 ChatGPT 不会看到用户名和密码。

多向量嵌入模型训练与微调指南

介绍如何用 Sentence Transformers 训练与微调多向量嵌入模型,并附实际案例。

开源 TTS 模型 Breeze TTS 2 登顶 HF 榜首

Breeze TTS 2 已上传 Hugging Face,在 Artificial Analysis 上成为排名第一的开源权重 TTS 模型。


拆解 GLM-5.3-Flash:Kimi 风格混合注意力

相较 GLM-5.2,GLM-5.3-Flash 采用 3:1 混合注意力模式,包含 34 层 Kimi Delta Attention(KDA)与 11 层 Multi-head Latent Attention(MLA)/ DeepSeek Sparse Attention,以稀疏与线性注意力结合承接局部依赖。



研究 · 工具 · 活动·

© FAV0 · AI Daily · 自动编排