MiniMax H3 开放权重,H3 Max 刷新上限
MiniMax 以开放权重发布 H3,社区经由 fal 后训练出 H3 Max,官方称它同时刷新了榜单与速度的认知。
Kimi K3 上线 Cursor,逼近前沿水准
Kimi K3 现已在 Cursor 中可用,基于美国推理节点,CursorBench 得分接近前沿模型。
ChatGPT 工作区支持 GitHub 插件同步
Business / Enterprise 工作区现可导入 Codex GitHub 插件,管理员可同步管理。
腾讯混元 Hy4 preview 已支持 vLLM
Hy4 preview 可直接在 vLLM 中运行,方便开发者部署与推理。
「观看一个热门编码工具失去前沿模型访问权限,真正说明了模型弹性的价值。未来,即便多个底层模型下线,产品仍应继续完美运转——只是绕开它们。」
— hardmaru
Claude Code 周限额永久上调 25%
9 月 14 日起各付费套餐标准周限额永久提升 25%;此前临时 50% 增幅保留至该日期。
Vera Rubin NVL72 每兆瓦吞吐达 GB300 的 30 倍
SemiAnalysis 以 AgentX 负载实测得出。
2027 年约 15GW AI 算力无法如期并网
难点不止找电,还有变压器、布线、液冷与冷水机组。
GLM 5.3 与 Flash 全面上线云端
私有、快速、美欧托管、零数据保留。
Search API 包揽检索榜前三
medium 档较前纪录高 5 分,约 $0.091/任务扩展前沿。
Anthropic 表态继续增算力支持 Cursor
首席算力官 Tom Brown 称 Cursor 自 Sonnet 3.5 时代起即是信任伙伴。
Anthropic 与 OpenAI 像是对调了
OpenAI 断供 Cursor 后,Anthropic 反而加码,攻守易位。
Claude Code 加 25% 的直观感受是减 25%
临时 50% 一拖再拖,最终落地为永久的 25%。
Replit 上可免费访问 OpenAI 模型
作为 Cursor 的多模型替代,愿为迁移企业出资。
levelsio 联手 fal.ai 推出「无限 AI 直播」
观众在聊天框输入内容,AI 生成下一段视频并尝试衔接前段,形成永不停歇的直播流。
fx 0.0.7:Zig 编写的极简编码代理
显著改进 MCP 支持,精简工具集与 shell 执行。

Midjourney V8.2 编辑模型更新
提升图像质量,欢迎继续反馈。

三大视频模型同题拆箱对比
Gemini Omni 1.1 Flash、Seedance 2.5、Wan 3.0 在相同输入下的三种演绎。

8 分钟 AI 动作短片《The Trigger》开源
为 100 万美元全球电影节的参赛作品,制作于 Cinema Studio 4。

先用 Higgsfield 在 Blender 搭景
别再为迭代烧积分。

AI Overviews 是否在重演 StackExchange 故事
早期证据显示 Google AI Overviews 可能对维基百科产生类似影响。

Terminal-Bench 4.0 发布
距 3.0 仅约一月,转向持续式基准。

相机运动是 AI 视频最难的部分
用 Higgsfield 插件在 Blender 里锁定运动。

一款暖色厚涂的 Midjourney 配方
暖色偏亮,带厚涂感,参数 sref 2698223612。

Claude 博文:Warp 如何构建自我改进 Agent
用两个 Skill 让基础技能自动继承反馈并持续进化。
Kimi K3 架构可视化教程上线
详解 Kimi Delta Attention、SGL 混合注意力 Radix tree 等。
LeVJEPA:视频预训练新帕累托前沿
稳定、高效的端到端视频基础模型预训练方法。
自主 AI 科学家的前景与缺口
论文展示了希望与差距,问题在于更强模型能补上多少。
《Build a Reasoning Model》反馈热烈
两个读书会正在讨论,9 月 3 日将举行线上答疑。

这就是当下 AI 视频的水准
四年前不敢想的画面,如今已触手可及。
用 Gemini 加速真实世界科学发现
分享早期进展。
自建智能的时间窗口
要么自建,要么接受三家私有供应商的条款。
判断 AI Native:看流程围绕谁设计
AI Agent 是执行主体,人负责定义问题与验收。
linear/relu/linear 即共享权重的 MoE
关于专家共享的一次洞见。