API 价格较 GPT-5.6 减半
OpenAI 开发者账号确认,Sol 与 Luna 今日上线 API,定价为 GPT-5.6 的一半。官方给出的定位十分清晰:用 Sol 构建,用 Luna 规模化。
Claude Opus 5.5 今日可用
Anthropic 宣布 Claude Opus 5.5 现已上线,成为 Claude 5.5 家族的首个模型。官方称其在大部分任务上追平旗舰 Fable 5.1 的水平。
性能持平 Fable 5.1,成本再降
Opus 5.5 比 Opus 5 快约 30%、每任务成本低约 40%。Claude Code 五小时会话限额今日提升 20%,Pro、Max 与 Team 用户获得一次额度重置。
价格只有上一代的一半,按任务来算,市场上几乎没有可比的了。
Sam Altman · OpenAI
小米开源 MiMo-V2.6,登顶开放权重
小米正式发布并开源 MiMo-V2.6 系列,包含 Pro 与 Flash 两款原生多模态模型。在第三方评测机构 Artificial Analysis 的综合智能指数上,Pro 版拿到 46 分,超过 Kimi K3 与 Qwen3.8 Max,与同日发布的 xAI Grok 4.7 并列,成为当前最强开源模型。
资深研究者指出,其架构相当简单——经典的 GQA 加上 128 token 窗口的滑动窗口注意力,却在开放权重加权平均榜上排到第一。这也再次印证:在开源阵营,小而专的简洁架构正持续逼近旗舰。
Kimi K3 上线 Amazon Bedrock
K3 开放权重模型登陆 Bedrock,支持 100 万 token 上下文、视觉与显式提示缓存,可用于编程、文档分析与 Agent 工作流。
GPT-6 API 提示缓存升级
默认提高缓存命中率,缓存输入折扣最高可达 90%,让 Agent 运行更快、更省钱。
Kimi 推出浏览器扩展
原 Kimi WebBridge 更名浏览器扩展,可在侧边栏聊天、导航、填表,并把重复步骤录制为技能。
SGLang v0.5.20 支持 Intel XPU
Intel XPU 加入标准发布,RL 采样掩码解码快 52%,统一 Radix Tree 提升缓存命中约 20 个点。
Cursor 接入 Claude Opus 5.5
Opus 5.5 在 Cursor 可用,CursorBench 最高 57.8%,每任务成本比 Opus 5 低 40%。
Perplexity 发布自蒸馏后训练研究
用提示引导自蒸馏让 Computer 模型从自身错误中学习,线上 A/B 中工具调用失败率相对降低 21.2%。
Step 5 Preview 刷新性价比前沿
Artificial Analysis 智能指数 44,每任务 0.71 美元,10 月 15 日将有更多发布。
vLLM 支持千卡 TPU 全参 RL
peano_ai 在 1000+ TPU 上对小米 MiMo-V2.6 310B 做全参数 RL,vLLM 驱动 rollout,310B 参数两秒内过 ICI。
RoboDawn 把 VLM 智能迁到机器人
冻结 VLM 做闭环控制,RoboTwin 单样本成功率 73.6%,高于 π0.5 的 46.0%。
WorldCrafter 视频世界模型
用隐式 3D 感知记忆,让视点决定多视角信息压缩,支持单图或文本的流式场景探索。
WebCraftBench
让 Agent 直接使用真实应用,以覆盖引导探索未触达路径,再对美学与功能打分。
funes 本地记忆
把编码 Agent 过往会话索引进 Lance 数据集,提供 recall/get 工具,可重建回滚并拦截凭证泄露。
LiteParse 提速 25%
PDF 转 Markdown 解析器新版对文本 PDF 解析快约 25%,达 2.8ms/页。
onPanda 标注工具
面向 LLM 数据标注与模型检查,token 级修正,中位标注时间比人工后期编辑低 52%。
修复计费异常
部分 deepseek-v4.1-flash 请求费率错误导致用量过高,Ollama 致歉并将补偿受影响用户。
Next.js 模型榜
Opus 5.5、GPT-6 Sol、Fable 5.1 均得 97%,Grok 4.7 为 94% 但便宜 2 至 7 倍。