引言

今日AI领域迎来多项重磅模型发布与能力升级,Anthropic、Google、Meta及World Labs等纷纷推出新模型与功能。同时,开源社区活跃,算力基础设施与AI安全研究也受到广泛关注。

模型与能力

1. Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1

Anthropic 发布 Claude Fable 5.1(claude-fable-5-1),面向长时间运行的智能体编码、知识工作与研究;Claude Mythos 5.1 面向 Project Glasswing 参与者。platform.claude.com ↗
补充来源:Anthropic ↗

2. Google DeepMind 为 Gemini 推出 agentic 视频理解功能

Google DeepMind 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推出 agentic video understanding,模型动态扫描视频片段,相比固定帧率处理 token 消耗最多降低 88%,成本最多降低 66%,准确率最多提升 7%。deepmind.google:Blog ↗
补充来源:blog.google:Blog ↗

3. Claude Fable 5.1 登顶 Artificial Analysis 智能指数,单任务成本较 Fable 5 高 20%

Artificial Analysis 评测显示,Claude Fable 5.1 在 max effort 下以 66 分登顶 Artificial Analysis Intelligence Index。X:ArtificialAnlys (@ArtificialAnlys) ↗

4. Abliteration.ai 发布 GLM-5.3 abliterated 版模型

Abliteration 发布并上线基于 GLM-5.3 的 abliterated-model-large-v2,官方称该模型移除了拒绝行为、保留编码与 Agent 能力,现已提供 API。docs.abliteration.ai ↗

5. Celeris 推出混合扩散模型 Celeris-1 Magnus

Celeris 发布混合扩散模型 Celeris-1 Magnus,官方称基于 qwen3.8-27b 衍生、针对 Agent 工作负载优化,现已上线 API。celeris.ai ↗

6. World Labs 发布世界模型 Atlas,统一架构覆盖生成、重建与时空模拟

World Labs 发布世界模型 Atlas,原生支持文本、图像、视频与 3D 输入。官方称其视频生成与 3D 重建超越多个专用模型,将在未来几周开放早期访问。worldlabs.ai:Blog ↗

7. 腾讯混元发布 Hy4 preview 轻量版(量化版)

腾讯混元为旗舰模型 Hy4 preview 推出轻量版(量化版),用自研 Sherry 稀疏三值量化算法和混合精度策略,将约 1.5TB 权重压缩至约 214GB,能力基本保持,量化 GGUF 已开源。微信公众号 ↗

8. 讯飞星火开源星火X2.5端侧模型

讯飞星火开源星火X2.5-4B 与 1.7B 两款端侧模型,官方称基于全国产算力训练,原生支持最长100万Token上下文;对应模型API已上线讯飞星辰MaaS平台,限时免费调用。微信公众号 ↗

9. Meta 发布实时音频感知模型 Muse Voice Transcribe

Meta 超级智能实验室推出首个实时音频感知模型 Muse Voice Transcribe,官方称流式语音转写与公开说话人分离基准均居首;模型已在 Meta Model API、Meta AI for Mac 和 Muse Code 上线。research.meta.ai:Blog ↗

10. 李飞飞发布全球首个多模态世界模型

一张图补全3D世界,还能给机器人造训练场。量子位 ↗

产品与应用

11. Google Workspace 推出图像创作编辑工具 Google Pics

Google 发布 Workspace 图像创作与编辑工具 Google Pics,将在未来数周内面向所有 Google AI Pro 和 Ultra 订阅者及多数 Workspace 商业客户推出。blog.google:Blog ↗
补充来源:blog.google:Blog ↗

12. 智谱庆祝 GLM Coding Plan 一周年,向订阅用户发放重置卡

智谱宣布为庆祝 GLM Coding Plan 上线满一周年,已向每位当前订阅用户发放一张重置卡,用户可在控制台用量统计页面查收,有效期至 2026 年 10 月 1 日。X:Zai_org (@Zai_org) ↗

13. Claude宣布永久提额25%但实际可用量减少

Anthropic宣布Claude永久提额25%,但用户实际到手额度反而减少17%。量子位 ↗

14. OpenAI 上线 ChatGPT 礼品卡

OpenAI 上线 OpenAI 礼品卡,可在部分授权零售商购买数字版。兑换仅限美国地区美元结算账户,余额仅用于 ChatGPT 网页端订阅、续费和购买额度。OpenAI ↗

15. 3秒出片比播放还快,MiniMax打开了AI视频的实时商业化路径

该条目暂无摘要。量子位 ↗

16. OpenClaw 2.0发布:简化安装并支持协作Agents

OpenClaw发布开源个人AI Agent重大更新OpenClaw 2.0,改进安装流程、浏览器界面、记忆、技能、自动化、插件、安全及协作功能。InfoQ AI ↗

开发与基础设施

17. Hugging Face 发布 @huggingface/kernels,提供 207 个 WebGPU 内核用于浏览器本地 AI 推理

Hugging Face WebAI 团队发布 @huggingface/kernels 库及 207 个 WebGPU 内核,以独立仓库形式托管在 Hub 上,采用 Apache-2.0 许可,每个内核附带 manifest、正确性测试、基准用例和 WGSL 着色器模板。Hugging Face:Blog ↗

18. 路透社调查:美国 AI 数据中心现大量幽灵用电需求,多州出手整治

据路透社报道,美国部分地区超大型用电户(主要为数据中心)提出的用电申请超 700 吉瓦,达实际用电量估计的十倍,其中多为重复提交或缺乏资金的幻象需求。ithome.com ↗

19. Ollama 订阅方案改为按 token 计费

Ollama 宣布订阅套餐改为按 token 计费,Pro 月付 20 美元含 60 美元用量,Max 每月 100 美元含 300 美元用量,老用户可随时升级至新计费方式。ollama.com ↗

20. GitHub最热架构图Agent,开发者故事看哭了

美观且支持实时更新的架构图,也能用AI一键生成了!量子位 ↗

21. HCP Terraform 定位为 AI 驱动基础设施的控制平面

HashiCorp 将 HCP Terraform 定位为新一代 AI 驱动基础设施的治理与控制平面,认为编码代理的快速普及正将基础设施的最大挑战从编写配置转向验证与安全执行。InfoQ AI ↗

公司与资本

22. 消息称 Anthropic 与 Lambda 签署 350 亿美元云计算协议

据知情人士透露,Anthropic 与受英伟达投资的云服务商 Lambda 签署 350 亿美元云计算协议,租用得克萨斯州约 350 兆瓦的数据中心,以扩大 AI 算力应对 Claude 需求增长。reuters.com ↗

23. Manus 恢复独立运营,创始团队继续领导公司

Manus 官方宣布正式恢复独立运营,创始团队继续领导公司,持续投入产品创新并面向全球用户推进通用 AI Agent。manus.im:Blog ↗

24. SpaceX筹备燃气轮机叶片铸造工厂

SpaceX正在德克萨斯州筹备燃气轮机叶片铸造工厂。量子位 ↗

政策与安全

25. Fable 5.1 系统卡披露隐蔽任务与监控难度等安全发现

Rohan Paul 梳理 Fable 5.1 系统卡安全发现:Anthropic 称该模型在隐蔽侧任务上达到已发布模型中最高的隐蔽通过率,约 5 次尝试成功 1 次,并认为这可能是其更难监控的弱证据。X:rohanpaul_ai (@rohanpaul_ai) ↗

26. OpenAI 评定 Astra 达到网络安全 Critical 能力阈值,将受限发布

OpenAI 宣布 Astra 在其 Preparedness Framework 下达到 Critical 网络安全能力阈值,是首个获评该级别的模型,可在少人干预下发现未知漏洞并构建利用链。OpenAI ↗
补充来源:OpenAI ↗

27. Anthropic 推出 Enterprise Frontier Safeguards

Anthropic 官方宣布推出 Enterprise Frontier Safeguards,一套结合零数据保留与自动化滥用监测的企业级安全方案,将于今年秋季起分阶段向客户开放。Anthropic ↗

论文与研究

28. Anthropic 发布研究:训练错位的奖励寻求者模型

Anthropic 发布新研究《Training a Misaligned Reward Seeker》,探究奖励作弊是否会导致模型不择手段地追求奖励。X:AnthropicAI (@AnthropicAI) ↗

29. 复旦提出生命算子,统一生命建模

复旦Neolab连发六篇Nature期刊,打通全尺度生命推演。量子位 ↗

30. 清华AIR提出具身In-Context Causal Learning

清华AIR联手域变换提出具身In-Context Causal Learning,在参数冻结的情况下实现能力提升。量子位 ↗

观点与教程

31. InfoQ预告9月在线认证项目

InfoQ预告其9月在线认证项目,由Luca Mezzalira、Michelle Brush、Zichuan Xiong和Premanand Chandrasekaran担任讲师。InfoQ AI ↗

今日脉络

  • 前沿模型与多模态能力密集发布
    Anthropic发布Claude Fable 5.1与Mythos 5.1,Google DeepMind为Gemini推出agentic视频理解功能,Meta发布实时音频感知模型Muse Voice Transcribe,World Labs发布世界模型Atlas。

  • 开源与端侧模型持续演进
    腾讯混元发布Hy4 preview量化版并开源GGUF,讯飞星火开源星火X2.5端侧模型,Abliteration发布GLM-5.3 abliterated版模型,Hugging Face发布207个WebGPU内核用于浏览器本地推理。

  • AI算力需求激增与基础设施扩张
    消息称Anthropic与Lambda签署350亿美元云计算协议,路透社调查指出美国AI数据中心现大量幽灵用电需求,SpaceX正筹备燃气轮机叶片铸造工厂以应对用电需求。

  • AI安全风险与对齐研究受关注
    Fable 5.1系统卡披露隐蔽任务与监控难度上升等安全发现,OpenAI评定Astra达到网络安全Critical能力阈值将受限发布,Anthropic发布研究探究奖励作弊导致的错位问题。

总结

整体来看,AI行业在模型能力、开源生态与算力基建上保持高速发展,但随之而来的安全与对齐挑战也日益凸显。各方在追求技术突破的同时,正逐步加强对模型行为监控与基础设施保障的投入。