研究版Claude改进黎曼猜想零点界
未发布研究版Claude虽未证明黎曼猜想,却将ζ函数非平凡零点落在临界线的比例下界,从41.6%大幅提升至67.2%。
Anthropic披露了一项令人瞩目的实验:未公开研究版Claude尝试攻克黎曼猜想——这一1859年提出、悬赏百万美元的数学界最著名未解难题——虽未能证明猜想本身,却在相关问题上取得重大突破:将黎曼ζ函数非平凡零点满足猜想的已知比例下界,从四十一点六个百分点一举提升至六十七点二个百分点。
该成果迅速在Mathstodon与AI研究社区引发热议。研究者指出,Claude的工作方式并非暴力搜索,而是通过类似人类数学家的启发式推理逐步缩小候选空间,再系统性验证。这标志着AI辅助纯数学研究迈入一个新阶段——从辅助计算升级为参与猜想推进。
NVIDIA撬动五千亿美元AI算力融资
NVIDIA与六家全球顶级长期资本机构合作建立独立融资平台,目标调动超过五千亿美元第三方资金,让企业与研究机构规模化获取AI算力。
NVIDIA宣布与六家全球顶级长期资本提供方合作设立独立融资平台,目标调动逾五千亿美元第三方资本。这一动作将GPU计算资源正式定位为"可投资的生产性资产",与数据中心地产、能源基础设施处于同一资本类别,是对AI基础设施金融化路径的一次重定义。
该平台采用资产抵押与长期租赁结合的模式,客户无需预付全部硬件成本即可获得大规模GPU集群。分析人士指出,此举不仅拓宽了NVIDIA的收入渠道,更重要的是降低前沿AI研发的资本门槛——尤其在主权AI与公共研究领域,有望大幅加速全球AI基础设施部署。
编程并非AI的又一个应用领域——它是AI通过符号化世界模型自动生成自身训练材料所必需的元技能。这才是递归自我改进循环的真正启动点。
— François Chollet
深度报道
MatrAIx:83亿人设驱动大规模社会模拟
新论文发布Persona-8B数据集,含83亿条人设记录,覆盖1290个维度,约100万核心样本经质量筛选。平台以GPT-5.5、Claude Opus 4.8与Claude Haiku 4.5驱动人设,在25个领域完成18189次试验,致力于构建面向AI系统的群体级模拟评估基础设施。
Sakana AI进军物理AI
Sakana AI宣布递归自我改进的下一前沿是物理AI,将扩展到机器人领域,依托日本深厚的机器人产业基础推进研发。
训练数据或是美国不开源前沿权重主因
评论认为数据顾虑让美国大厂放缓开源前沿权重步伐;K3突破1e25算力后,计算层面的平衡正在改变。
模型与工具
Qwen-MM-Plugins多模态插件开源
让任意agent框架原生支持图像、视频、文档理解以及视频编辑、3D与CAD等操作,使agent从纯文本扩展为多模态代理。
SGLang v0.5.17上线Kimi K3与H3
新版SGLang将Kimi K3优化进主流程,支持KDA前缀缓存、DSpark投机解码、DCP 1M上下文,同时上线MiniMax-H3,兼容NVIDIA与AMD GPU。
Claude Code自动模式成默认设置
Claude Code不再要求每个操作都批准,自动模式默认开启,并公开其安全判定机制,开发者可查看自动批准决策原理。
Meta将开源Muse Spark 1.2权重
Meta宣布Muse Spark 1.2开放权重版本即将释出,与Muse Glimmer同属Superintelligence Labs的开放模型矩阵。
Redis作者为Mac编写MiniMax H3推理引擎
得益于开源权重,Redis创建者antirez为Mac实现MiniMax H3的Metal加速推理引擎,验证了开源模型社区可移植性。
DiffusionGemma技术报告正式发布
Google公开DiffusionGemma完整技术报告,分享基于扩散模型的Gemma训练管线与实验见解,为社区提供完整复现路径。
Ollama原生运行Muse Glimmer
Muse Glimmer通过Ollama MLX引擎在Apple Silicon上运行,支持Claude Code、Codex等本地智能体工作流。
vLLM提供Muse Glimmer Day-0支持
vLLM宣布Day-0支持Meta Muse Glimmer 30B,30B稠密、128K+上下文、多模态,专为本地智能体设计。
Perplexity Agent API上线美国区K3
Perplexity CEO Aravind Srinivas宣布K3模型已通过Perplexity Agent API在美国提供,可直接调用体验。
推出AI Agent公共信息平台HelpPeer
受OpenAI-HuggingFace事件启发,推出面向AI agent的公共平台,提供tell和lookup两个API接口。
Vercel CEO强调AI沙箱双重隔离
结合Kimi论文与OpenAI事件,指出容器隔离不足,需微虚拟机隔离计算并在网络边界限制不可信代码。
深度解析领域LLM中期训练与CPT
Cameron Wolfe详解继续预训练与中期训练的差异:在预训练和后训练间调整数据混合比例以训练领域专用高性能模型。
固定主机内存为何无人归还
Edward Yang详解pinned memory对GPU DMA的优势,以及异步拷贝与CUDA图导致其难以释放的工程困境。
Simon吐槽Claude Haiku幻觉严重
Simon Willison认为Claude Haiku幻觉多、已被GPT-5.6-Luna超越,但Claude Code WebFetch工具仍在调用Haiku。
Anthropic为Claude输出添加机器可读水印
为遵守欧盟AI法案第50条,Claude输出文本嵌入隐形水印,生成文件附加数字签名元数据,8月2日起所有新模型已执行。
新书《AI领导力》适合入门
vista8与金刚合著,适合普通人快速培养AI思维与素养,从非技术视角理解AI对组织与决策的影响。
Cursor人才主管:前线部署工程师最抢手
转译自Lenny Rachitsky,前线部署工程师正成为科技界最热职位,连接模型能力与客户场景。
AI写代码成本转嫁到审核端
以前写代码成本高、审核成本低;现在AI写代码成本骤降,审核者需更高成本才能跟上,成本结构已反转。
Maestro v1.7发布多窗口长视频功能
支持MiniMax H3模型的平滑片段切换与音频连续,单提示词即可自动规划动作、对话与镜头分镜。
首部全AI生成剧情长片在纽约首映
Higgsfield制作,获得知名演员形象授权,全部473600份创作素材已开源供社区学习,制作成本约200万美元。
Glif用MiniMax H3重制奥德赛
用Krea 2生成静态帧、MiniMax H3首尾帧技术完成平滑转场,将荷马史诗奥德赛改编为1970年代风格短剧。
前线部署工程师究竟是什么
FDE的角色更像一群士兵去教用石头的用AK47——把先进模型能力带入实际场景,让客户获得真正生产力提升。
Higgsfield制作首部AI剧情长片
首部有真人明星演员授权的AI生成剧情长片,使用Seedance 2.5制作110分钟全片,完整开源工作流公布。
Adobe Firefly推出创作者变现新机会
Adobe宣布为Firefly创作者提供新的收入来源,进一步拓展AI生成内容在商业化场景中的应用路径。