开源不是网络安全危机的根源,它恰恰是解决方案。
Moonshot 即将开源 3 万亿参数 Kimi-K3
号称全球首个公开的 3T 级开源模型,聚焦长时编程与推理。Hugging Face 上已有近百人等待发布通知,被认为将实质性威胁西方闭源模型支出。

谷歌 DeepMind 与美能源部合作加速科学发现
投入 4000 万美元 AI Token 与云信用,支持 Genesis Mission 在十年内将科学发现速度翻倍。
Moonshot 成为首个威胁西方闭源支出而非仅 Token 量的模型
因其模型昂贵但效果突出,Kimi K3 被认为真正开始威胁西方闭源模型的实际预算分配。
Grok Build 升级至 Grok 4.5,新增 Workflows 功能
新增原生子代理视图、Plan Mode 集成、鼠标支持及全屏终端 UI,通过对话即可完成复杂任务编排。
OpenAI Presence 发布,助企业部署 AI 代理
支持语音与文本代理,可用于客服及内部流程自动化,具备自动升级到人工的能力。
Claude 管理代理新增粒度控制与 Webhook
支持配置每个代理的力度等级,通过事件种子注入会话、最多 500 项技能,以及子代理流事件。
开源模型首次在 IMO 达到金牌水平
@emollick 指出 Kimi K3 等开源模型在 IMO 取得金牌成绩,此前这一里程碑仅属于闭源模型。
AI 解决 MBA 案例能力显著提升
新论文测试 AI 在哈佛等商学院案例中的表现,结果显示跨领域能力优异且随时间快速增强。
DeepSeek 经济学透明化获业界赞誉
@teortaxesTex 称 DeepSeek 公开内部经济数据"破除了业界大量神话",成为其他实验室的价格基准。

皮查伊:谷歌 AI 投资推动 Q2 收入增长 24%
Alphabet 第二季度营收同比增长 24%,Google Cloud 增速飙至 82%。AI 投资正在重新定义从搜索到 YouTube 再到 Gemini 应用的每条业务线边界。
马斯克:Grok Imagine 年底前完成《奥德赛》全片制作
Elon Musk 声称 Grok Imagine 将在今年年底前制作出一部符合荷马艺术风格、历史准确的《奥德赛》完整电影,该推文获得近 14 万点赞。
安卓 Gemini Intelligence 登陆三星折叠设备
首批功能已向 Galaxy Fold 系列推送,任务自动化扩展至 40 多个常见应用,涵盖购物、餐饮预订、旅行和购票等场景。
微软亚洲研究院推出轻量图像生成模型 Mage-Flow
仅 4B 参数的小模型,针对图像生成和编辑优化,性能可匹敌更大规模的同类模型,已在 Hugging Face 开放。
Macaron-V1-Venti 748B 混合模型上线 vLLM
基于 GLM-5.2 基座与四个 1B LoRA 专长的 748B 智能体模型,支持原生的 Chat/Agent/Coding/GenUI 自动路由。
Macaron-V1-Venti 登陆 SGLang,支持即时推理
SGLang 宣布第一时间支持该模型,提供原生的多 LoRA 路由推理能力,日均首发体验让开发者无需等待适配。
AutoIndex:学习文档表示程序提升检索召回
新框架通过搜索可执行的文档转换程序,在 CRUMB 基准上平均召回率提升 8.4%,nDCG@10 提升 8.3%。
日本发布首个免费 AI 视频生成模型,专攻动画制作
官方推出免费 AI 视频模型辅助动画制作流程,标志 AI 在专业动漫领域的正式入场。
Wenfeng 52 条语录:始终开源最佳模型
@teortaxesTex 总结 DeepSeek 创始人 Wenfeng 的核心观点:近期渐进奇点、不关心商业、承诺永远开源最优模型。
中美在开源权重模型上的博弈日益紧张
@emollick 观察到美国声明对蒸馏模型保留行动权并指责 Kimi 蒸馏,中国方面信息矛盾,双方张力持续升级。
Nanogpt 消耗虽大成果有限,HF 入侵事件最令人警惕
@MillionInt 指出大量 Token 投入加速实验却鲜有突破,同时将 HF 事件称为迄今最令人担忧的 AI 安全信号。
想象 Claude 在安全评估外黑入真实沃尔玛
@teortaxesTex 警示:如果 AI 从测试环境转向入侵真实商业系统,那将是真正的"纸夹子"时刻。
DS V4 GA 可能未延期,截止日期分析合理
@teortaxesTex 分析 DeepSeek V4 预览版发布后的时间线,认为正式版本可能按原定计划如期推出。
真正重磅将是 2026 年国产计算集群的公开演示
@teortaxesTex 认为中国模型已非新闻,国产 2026 代计算集群的公开亮相才是真正里程碑式事件。
中国 AI 硬件从多年沉寂到突然建万卡集群训练 236B
@teortaxesTex 惊叹中国 AI 硬件公司长期低调后突然爆发出惊人产能,问"AMD 上有训练过这么大的模型吗?"
OpenAI API 向所有账户开放硬支出限额
本周起所有账户可自行设置 API 消费上限。
Replit 移动端应用全面改版上线
重新设计的 iOS 和 Android 应用支持随时随地编码。
谷歌发布 Gemini 3.6 Flash 模型
各评分指标较 3.5 Flash 略有提升。
Kling AI 发布 MCP 创意工作流教程
从角色创建到批量视频生成的完整流程。
CodePilot 免费整合 Grok 4.5
通过 Super Grok 授权即可在 CodePilot 中使用。
BasicallyMythos:123行本地代理工具
零依赖监控 Claude Code 是否重新路由请求。
Poolside 公开所有评估轨迹
研究者称赞其为继 Llama 3 后最开放的评估实践。
Codex 和 Claude Code 需增强子代理控制
@emollick 呼吁用户应自主选择各子代理所用模型。
智力增长或只需更多耐心与 Token
@MillionInt 认为推理能力的瓶颈可能只是等待时间。
AI 互动式奥德赛故事两日 $250 完成
利用 AI 编程+视频模型实现分支剧情叙事。
Nat Lambert:模型输出无知识产权先例
前沿实验室可通过其他方式保护生成内容。
开源模型可能被误解而遭全面监管
应聚焦技术栈标准化而非模型层面的限制。
多模型创意生成对比:GPT-5.6 夺冠
在 Churchill 语录生成任务中 GPT-5.6 Sol Pro 表现最佳。
提示工程被高估,直接说需求更有效
@emollick 认为精准的提示词设计价值被过度放大。
科学知识的生产与评价正在发生巨变
@francoisfleuret 预测三年后局面将截然不同。

