OpenAI 扩展文本内容溯源,响应欧盟监管
OpenAI 将内容溯源机制扩展到文本,以回应欧盟 AI 法案的监管要求。公司同时承认,当前文本水印技术存在显著局限。此前其工具已可验证图像与音频是否由自家模型生成,如今文本被纳入同一套 provenance 框架——几周内,欧盟用户在 ChatGPT 与 Codex 中生成的文字将带上不可见水印。
编码 Harness 变成 RL 环境,同权重 62%
把 Claude Code、Codex、Hermes、Pi、opencode 等编码 harness 直接接成强化学习环境,不改 harness、不改训练代码,任何开放模型、任何任务集都可复现。同一模型、同一权重,在 Mini-SWE-Agent 上达到 62%。
前 1% AI 消费者每月个人信用卡花 $900+
数据显示,AI 产品最头部 1% 的消费者每月在个人信用卡上支出超过 900 美元,超过后 50% 用户的总和。人们戏称这催生了一个新物种——「AI 鲸鱼」。
Cursor SDK 支持运行时 steer Agent
新增 run.steer():可在 Agent 运行时插入下一条消息,若子 Agent 正在执行任务,它会转到后台继续工作,让开发者能在长任务中途「介入」。
Cohere 发布 North 2 企业 Agent 平台
Cohere 推出 North 2,带来 15 项以上新功能。团队称企业多年来一直在 agentic AI 上妥协:平台不可扩展、模型不主权、控制又缺乏企业级安全。North 2 直指这些痛点,主打可扩展、主权模型与企业级安全的智能体平台,是该公司迄今最大的一次升级。
Security-One 27B 开放权重安全模型发布
开放权重 27B 模型 Security-One,可读取文档、工具调用,用于安全决策。
Qwen3-Omni 在 RTX 5090 上首音频延迟降至 23ms
fractalyze.io 优化 vLLM-Omni:AWQ-4bit、batch-1 下首音频从 213ms 降至 23ms。
llama.cpp v0.6.0 发布:支持 Clef 与 Qwen3.8
新版本加入 Clef 文本与视觉支持,并高质量支持 Qwen3.8-Flash-Next 等模型。
OpenRouter 路由致推理定价扭曲:输入极便宜输出极贵
GLM 5.3 最高流量供应商输入 $0.08/M token、输出 $5.00/M token,prefill 与 decode 价格严重倒挂。
Meta、微软收紧内部使用 Claude
The Information 报道两家公司减少内部使用 Claude,Meta 使用 Claude Code 的员工从约 6 万降至 3 万。
SemiAnalysis:同价 Claude 订阅 Token 用量约 OpenAI 5 倍
实测九家 AI 订阅套餐,Claude 在主力模型上折算价值约为 OpenAI 的 5 倍。
用对称内存加速 NCCL 中小消息通信
NCCL 与 PyTorch 新增对称内存,几行代码即可提升中小消息量通信,缓解通信计算重叠难题。
Qwen3.8 27B 本地长数字加法实验
Simon Willison 重跑 GPT-4o 长数字加法实验,测试本地 Qwen3.8 27B 推理与非推理模式。
PixelUMM:无编码器统一多模态模型
直接在像素空间处理图像视频理解与生成,不用 VAE 或 ViT,采用 Mixture-of-Transformers。
最清晰的结论应该是:中国团队非常、非常擅长构建 LLM。
— @natolambert
RSR:递归自改写扩展复杂任务轨迹
用递归自改写框架,将约 3K 终端任务中 759 个成功解扩增为 11094 条监督微调轨迹。
OctLLM:用八叉树作显式 3D 语言
以八叉树占据 token 表示几何,用稀疏 S-Octree 兼顾形状保留与序列长度,不破坏语言通路。
全带宽 Transformer 新修订:纵向反馈
将上一层隐藏状态与采样 token 融合反馈,保留标准架构与 KV 缓存,1B 实验多项评测提升。
RMD:长程自回归视频生成蒸馏新法
对每个片段独立与片段教师打分,缓解长程误差累积。
Grok 4.7 上线 Amazon Bedrock 与 Gemini 企业平台
现已在 Amazon Bedrock 和 Google Gemini Enterprise Agent Platform 提供。
NVIDIA 开源图像转可探索 3D 世界工具
可将任意图像转成可探索的 3D 世界,100% 开源。
Codex CLI 支持语音启动与管理 Agent
语音启动任务、跨项目管理 Agent,并在独立 worktree 中探索方向。
ChatGPT 连接自定义 MCP 不再需开发者模式
连接自定义 MCP 服务不再需要手动开启开发者模式。
HuggingFace 补齐多 Harness RL 工程指南
用同一开放权重模型跨多 harness 做强化学习的完整指南。
Qwen3.8-Flash-Next NVFP4 量化版上线
MoE 专家量化为 FP4,其余保持 BF16。
Replit 上周发布:新模型与企业设置
支持 GPT-6.1 Sol、Claude Sonnet 5.5,新增 Jev AI 集成与企业工作区规则。
Higgsfield 发布 Ads Studio 静态广告引擎
号称首个 ROAS 驱动静态广告内容机器,可研究品牌、追踪趋势并生成广告。
Recraft V4.1 强化自然摄影与构图
带来自然摄影、强构图和真实日常瞬间,让简单提示词生成更鲜活的图像。
李开复:AI 需要不同的公司形态
与 100+ CEO 交流后认为,把 AI 类比以往技术变革是首个思维错误,企业需重新设计组织。
gdp-ts:TypeScript 的证明式 API 安全库
用类型检查验证敏感函数调用前已做授权检查。
Beam 未蒸馏,展示无 Claude 痕迹的竞争力
他兴奋于 Beam 可能完全未蒸馏,想看看不依赖 Claude 数据能有多大竞争力。