智谱开源 GLM-5.3,主打 Agent 编码与网络攻防
智谱最强开源权重模型正式开放下载、运行与微调,重点支持智能体编码与网络攻防。

Midjourney 开测 V8.2 编辑模型
支持指令编辑、最多 4 张参考图、画笔修复与外绘,并兼容个性化、moodboards 与 sref。
OpenAI 推出 Rosalind Workbench 科学工作流
将蛋白质结构、序列分析与测序流水线中的科学问题,与专用模型、工具和可审阅输出整合进同一工作流,让研究者从数据一路追踪到证据。

NVIDIA 发布 Nemotron 3.5 Lightning
紧凑可定制的开源模型,面向 7×24 小时常驻 Agent,帮助完成专项任务并加速迭代。

vLLM 指南:五种投机解码方法怎么选
对比 MTP、EAGLE-3、DFlash 与 DSpark 的工作原理与调优路径,强调没有通用最优解,最佳选择随模型、负载与投机深度变化。

腾讯 Hy4-Preview 发布,SGLang 首日支持
770B 总参数、49B 激活的 MoE,面向长程编码与办公工作流。
人类正不假思索地把巨额资源与能量,投入到一种近乎「另一个物种」的东西上——仿佛我们内心深处埋着某种本能,像一只雀跃着要结茧的幼虫。
vLLM 首日支持 GLM-5.3 744B
744B 总参数、40B 激活、1M 上下文、128K 最大输出。
SGLang 实测 537.6 tok/s/user
继承 GLM-5.2 全部优化,多轮 Agent 负载下吞吐显著。
Ollama 上线 GLM-5.3
美欧托管、无数据保留,兼容 Claude Code 与 OpenCode。
Perplexity Computer 接入
面向长上下文多模态 Agent,WANDR 研究基准超越 5.2。
Bionic 上线并限时五折
美国托管、零数据保留,周一前可享半价。
GLM-5.3 支持 tinkerapi 微调
现可对 GLM-5.3 进行微调,进一步适配自有场景。
Meta Muse 图像 API 上线,1 美分/张
以极低成本提供生产级图像生成,价格质量比突出。
Qwen3.8-Flash 登陆 OpenCode Go
125B/6B、1M 上下文、多模态,提供超长上下文编码体验。
MiniMax 联合发布 Fast H3 v1
与 Hào AI Lab、NVIDIA FastGen 合作,基于 FastVideo 框架。
Vercel 上线 eve:一分钟部署 Agent
加提示词、选模型与 MCP 连接即可部署,代码仓库归你。
fal 发布 H3 Max 视频模型
全新后训练视频模型,综合质量与提示理解等指标排名第一。
Wan3.0 登顶视频编辑榜
在 LMArena Video Edit Arena 榜单中位列第一。
Claude Code 周更新
启动提速、Token 消耗可视化、自动模式规则与远程控制改进。
Codex Appshots 截图操作
读取截图并代执行:总结 Slack、填写表单、调用 API 等。
模型越强,界面就越生成式、越动态。这股趋势才刚刚开始。
Firefly 推出 AI 视频编辑器
任意设备剪辑增强,适配演示、教程与培训视频。
Vidu Q3 Mix 改善视频一致性
复杂提示遵循、角色一致性、音画同步与手部交互稳定性。
Bionic Auto Review 放行 82%
AST 解析、指令匹配与审查子代理自动批准 shell 工具请求。
Luma 升级超分画质
上采样能力再进一步,细节呈现更清晰。
DGX SuperPOD 支撑学术超算
德州农工 VISION 成为 6 月 TOP500 最强学术超算,供七所机构使用。
Runway 上线 Omni 1.1 Flash
平台新增谷歌最新视频生成模型,可立即使用。
Ora 追踪 Agent 真实操作
用 Claude Code、ChatGPT、Gemini、eve 在真实网站定位注册/支付卡点。
Replit 引入模型智能路由
自动选最优模型,新增企业管理员控制,并发布增长工具包。
静态嵌入检索精度实验
maxsim 评分与小适配器,弥补静态嵌入的检索精度损失。
小样本 LoRA 优化 H3
254 个样本、8 卡 3 小时,提升 MiniMax H3 物理真实感。
Vercel 开源 vgpu 库
为 AI 智能体设计的着色器,浏览器与离线环境均可运行。
混元 4Preview 发布
Arena WebDEV 评分第五,与 GLM-5.3 Flash 相当。

