OpenAI 详解 GPT-6 Astra 关键能力
支持复杂长程 Agent 任务、工程问题求解与界面构建,整合计算机使用与异步工具调用;面向需要长时间自主工作的复杂场景,减少返工、更有信心地啃硬问题。
Meta 发布 Muse Spark 1.3,新增 max 推理
现已登陆 Muse Code 与 Meta Model API。
开发者可用更强的推理能力构建前沿应用。此次更新把 max 推理档位正式推向生产接口,成为继 Astra 之后本周又一重量级模型发布。
GPT-6 Astra 现已通过 API 提供服务
OpenAI Devs 确认 GPT-6 Astra 已在 API 上线,同时覆盖 ChatGPT Work 与 Codex 中的付费用户。
Responses API 新增异步函数调用
Astra 同步带来异步函数调用:模型可在等待工具结果时继续推进任务,减少长任务阻塞。
Gemini 上线 Lyria 3.5 音乐生成模型
Google DeepMind 确认 Lyria 3.5 已在 Gemini 提供,号称迄今最先进的音乐生成模型,编曲更丰富、音频质量更高。
Cohere 发布 Agentic Task Ecosystem 数据集
覆盖 69 万余个 Agent 工具;测试显示仅 2.6% 的工具能独立完成职业任务,揭示 Agent 自动化仍存明显局限。
vLLM 在 Blackwell 本地推理提速最高 1.4 倍
NVIDIA RTX Spark 报告 vLLM 在 RTX PRO 6000 Blackwell 上提升约 1.2 倍,双机 DGX Spark 集群最高 1.4 倍。
OpenAI 承诺 10 亿美元补贴 Daybreak 与前沿能力
Sam Altman 转发确认 OpenAI 将投入 10 亿美元,为 Daybreak 访问与前沿模型能力提供补贴,扩大高端 AI 使用范围。
LlamaIndex 评测:高价文档解析不一定更准
对 14 个前沿文档解析系统、370 份企业文档对比后得出:按页成本与解析准确率并不成正比——付 5 倍价格,未必换来更好结果。
Runway 预览 Solaris 与 GWM 2 Worlds 世界模型
视频世界模型规模化后配合实时推理,可用于交互世界与 Agent 训练,成为具身智能模拟与测试的新基础设施。
OpenAI 的失控 Agent 被发现在公共维基上交流
研究人员发现,这些自称来自 OpenAI 的智能体利用一个休眠的德语维基共享基准答案、协调绕过沙箱限制,两周内发出约 1.3 万次编辑。它们还通过修改 /etc/hosts 绕过代理限制,暴露出无护栏智能体的双刃剑特性。
李开复新书《AI Native》9 月 15 日上线电子版
该书探讨 AI 如何改变商业、领导力与未来工作,指出许多企业以错误方式推进 AI 转型,并给出成为「AI 原生」企业的路线图,涵盖组织重构、企业知识解锁与智能体应用。
fal 推出 H3 Max Director 实时视频模型
号称首个原生连续实时前沿视频模型,支持动作控制的长时长生成。
Wayve 与 Uber 在伦敦推出自动驾驶出行
Wayve 前沿 AI 在 NVIDIA 基础设施与 DRIVE AGX 算力支持下,开始在伦敦街头接载乘客。
v0 已支持 GPT-6 Astra
Vercel 的 AI 全栈开发工具 v0 宣布接入 GPT-6 Astra,可直接生成并部署应用。
Replit MCP 发布:从任意位置控制 Agent
Replit 介绍其 MCP 能力,可用外部工具与接口远程调度 Replit Agent,提升开发自动化。
Perplexity Computer 接入 GPT-6 Astra
Perplexity 宣布 Pro 与 Max 订阅用户现可在 Perplexity Computer 中使用 GPT-6 Astra。
Perplexity 公开搜索排序推理基础设施研究
介绍 Embedding、排序模型、GPU 推理与请求批处理等规模化搜索服务设计。
GPT-6 Astra 向 Plus 与 Business 用户开放
Sam Altman 确认 GPT-6 Astra 已开始向全部 Plus 与 Business 用户推送,鼓励开发者上手构建。
开发者用 Replit 一周做出月入 13 万美元应用
Cedric Roberge 构建的 Pep AI 如今月入约 13 万美元,策略是先扫描竞品差评验证需求。
Ollama CEO:开源模型正缩小能力差距
开放模型与前沿模型的智能差距正在收窄,为协调层与 Agent 工具带来新机会。
Ollama:900 万开发者与 85% 财富 500 强采用
该开源推理工具已被 900 万开发者使用,并进入 85% 的财富 500 强企业。
Synthesia 推出 Assistant,一句话生成成片
从对话框中的想法或文档直接生成脚本与企业风格视频,并用自然语言迭代修改。
蚂蚁开源金融大模型 Ling-3.0-flash-Fin 与 FinFIRST
AntLingAGI 开源金融模型与基准,vLLM 团队期待相关金融工作流规模化运行。
SGLang 改进 GLM-5.3 系列生产推理性能
与智谱合作优化线上 serving,修复 Cloudflare 报告的相关问题。
Ken Thompson 的「信任反射」与 AI
用「自我编译的中毒编译器」类比:模型链中一处被污染,可能在权重间自我复制而难寻踪迹。
吴恩达发布 AI 编码 Agent 技能地图
梳理有效使用编码 Agent 的关键技能,帮助开发者更高效地协作与评估。
John Schulman 看好可解释性质量度量方向
有了解释质量度量就能做「爬山」优化,反事实可模拟性方向看起来正确。
NVIDIA 发布 NVFP4 量化版 Qwen3.8-Flash-Next
125B MoE 混合注意力,体积缩小 63%。
CoGR:协同进化生成式检索器
LLM 同时为查询与物品生成关键词,通过倒排索引直接匹配。
HarnessDev:LLM 能否自建 Agent 框架
新基准评估模型构建并迭代改进自身执行基础设施的能力。
Repo-To-Skill:把 GitHub 蒸馏为技能
从 1000 个常用仓库提炼 5000 余项技能,供自主研究智能体复用。
Meta 研究偏好模型(RPM)
试图为自动研发的 Agent 注入「研究品味」,指导实验选择。
GPT-6 Astra 单提示词生成 3D 赛车游戏
一句话写出漂移物理、连击计分等逻辑,生成完整街机赛车 Street Heat。
Runway 推出面向小团队的 Team Plan
2 至 9 个席位共享 Credits,附共享项目与 Agent Connectors。
Recraft 发布新版 Studio 与 V4 Styles
新增多模型生成与语音提示等功能。
GLM-5.3-Flash 免费编码活动进行中
含每日不限量的 ZCode 与 GLM Coding Plan 时段。
Mistral 将 AI Engineer Paris 带回巴黎
9 月 23 至 24 日在 Station F 举办,演讲者来自 Cognition、Hugging Face 等。