引言
今日 AI 动态集中在模型发布、产品开放与开发基础设施升级。模型能力评测、智能体工具调用和安全控制继续成为关注重点。
模型与能力
1. Qwen3.8-27B 登顶 Artificial Analysis 智能指数
作者将 Qwen3.8-27B 装入智能体后表现优异。该模型在 Artificial Analysis 智能指数中位列 135 款模型之首,得分 52,超过 Z.ai 的 753B 参数开源模型 GLM-5.2(51 分)。tomtunguz.com ↗
2. Inco AI 发布 DFlash 2 并行推测解码器
官方称 DFlash 2 接近自回归解码速度的 3 倍,已上线主流引擎,并发布 Drafters 两款模型。inco.ai:Blog ↗
3. 智象未来发布交互式世界模型 HiDream-O1-World
智象未来发布交互式世界模型 HiDream-O1-World,支持通过文本或图片一键生成可漫游、可编辑的 3D 世界。yanghb22-fdu.github.io ↗
4. Artificial Analysis 发布 Search Index 榜单
Artificial Analysis 发布 Search Index 评测榜,通过固定模型、仅更换搜索 API 的方式,比较 Agent 搜索的质量、成本与速度。artificialanalysis.ai ↗
5. π0引用的中国团队发布世界仿真器新作
给机器人打造一个更接近真实的“第二世界”。量子位 ↗
6. 阿里发布 AI 音乐模型 HappyShrimp,人人都能写好听的歌
8 月 17 日,阿里巴巴发布 AI 音乐模型 HappyShrimp。量子位 ↗
产品与应用
7. OpenAI 推出 ChatGPT for Teens,强化青少年学习与安全保护
OpenAI 发布 ChatGPT for Teens,面向 13-17 岁用户自动启用更强安全保护与家长控制,并加入 Study Mode、作业提醒、测验、学习可视化和 Study Hours,引导用户分步解题。OpenAI 还宣布与 CodeAI 合作,帮助青少年理解、质疑并创造性地使用 AI。OpenAI ↗
补充来源:OpenAI ↗
8. Populous 用 Runway 加速标志性场馆设计
Populous 高级建筑师 Georgina Myers 介绍团队如何用 Runway 辅助体育场馆概念设计,生成完整渲染图和航拍图,缩短视觉制作时间。该工具已用于利雅得 MBS 体育场等中东项目,并支持 9 种活动模式的场景迭代。runwayml.com ↗
9. Claude Science 产品指南:面向生命科学研究的 AI 工作台
该条目已按原始标题回退,未经原始证据明确支持的细节不予展开。claude.com:Blog ↗
10. Claude 支持管理 Gmail 邮件与 Google Drive 文件
Claude 现在可以在 Gmail 中发送邮件,并管理 Google Drive 文件;用户可让它回复邮件线程并控制是否需要批准。该功能可从连接器菜单启用,所有付费套餐均可使用。X:claudeai (@claudeai) ↗
11. Claude Code 每周使用上限提高 50% 的措施延长至 8 月 31 日
ClaudeDevs 宣布,Claude Code 每周使用上限提高 50% 的措施延长至 8 月 31 日。官方希望将其变为订阅方案的永久调整,但模型需求旺盛,未来数周容量可能紧张。X:ClaudeDevs (@ClaudeDevs) ↗
12. 6 个 Agent 组团进行 Vibe Gaming:生成、试玩并修复 Bug
代码能运行,并不等于游戏可玩。量子位 ↗
13. Claude Cowork 向所有付费订阅用户开放移动端和网页端
Claude 官方宣布,Claude Cowork 现已向所有付费订阅用户开放移动端和网页端;此前 Beta 版已向 Max 订阅用户推出。X:claudeai (@claudeai) ↗
14. Gemini in Chrome 向美国所有 Android 用户开放
Google 宣布,Gemini in Chrome 现已向美国所有 Android 用户开放。Auto Browse 的 Agentic 能力仅限 AI Pro 和 AI Ultra 订阅用户使用。blog.google:Blog ↗
15. MiMo个人桌面端应用即将上线,新一代模型训练中
小米 CFO 林世伟称,MiMo 首款个人桌面端应用即将上线;新一代 MiMo 模型正在训练中,有望很快发布。ithome.com ↗
16. 秦MAX正式上市,售价10.99万至14.39万元
8月13日,比亚迪秦MAX正式上市,推出 EV 与 DM-i 双动力版本。量子位 ↗
17. 网易传媒发布蜜蜂AI:让AI更懂人
8月18日,网易传媒举办蜜蜂AI媒体沟通会。量子位 ↗
18. 豆包 Windows 版上线虚拟桌面功能
豆包工作任务模式在 Windows 版上线虚拟桌面功能。获授权后,豆包可操作电脑,且不占用用户鼠标键盘;用户可随时暂停或接管。微信公众号 ↗
19. 郭富城换购30万级顶配华为全家桶
车型为5.3米六座家用SUV。量子位 ↗
20. 阿里“千问办公”接入企业微信
国内三大办公平台全面支持。量子位 ↗
开发与基础设施
21. Claude Tag 成为 Anthropic CI/CD 故障的一线响应者
Anthropic 的 CI 工程师用 Claude Tag 构建值班智能体,作为 CI/CD 故障的一线响应者。Claude 在事故发生后中位 14 分钟发布首份基于证据的分析,最快 3 分钟内验证修复并确认错误率恢复基线。该方案通过 Slack 频道、Datadog 或 Grafana 工具访问及 GitHub 技能文件实现,Anthropic 已发布通用设置套件供其他团队部署。claude.com:Blog ↗
22. Mojo 正式开源,编译器与工具链全面开放
Mojo 现已按 Apache 2.0 许可证(含 LLVM 例外)开源,编译器、工具链及全部源码已发布至 Modular 的 GitHub 仓库。此次开源涵盖整个编译器与工具链;编译器相关贡献计划于年底前开放。modular.com:Blog ↗
23. Sentence Transformers v6.0 新增 MultiVectorEncoder,支持 ColBERT 风格多向量检索
Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,可加载 PyLate、Stanford-NLP ColBERT 和 colpali-engine 检查点,用于 ColBERT 式晚期交互检索。Hugging Face:Blog ↗
24. Remotion 发布 Skills 2.0,加入 Sub-skills 与交互式编辑
Remotion 发布 Skills 2.0,新增 Sub-skills、Interactive 和 Taste-neutral 特性,生成的代码可在 Studio 中手动编辑,核心 API 也得到简化。remotion.dev ↗
25. 企业微信5.0.10上线,开放CLI与MCP能力
企业微信新版本上线,全面开放CLI与MCP能力。WorkBuddy等Agent可直接调用企微十大办公能力,且不限企业规模。微信公众号 ↗
26. 智谱上线 GLM-5.3 API,定价与 GLM-5.2 持平
智谱正式上线 GLM-5.3 API,定价与 GLM-5.2 一致。该模型在 Artificial Analysis Intelligence Index 上获得 60 分,并已通过官方 API 及合作网关提供服务。bigmodel.cn ↗
27. MiniMax 发布 MiniMax Code CLI,将编程能力带入终端
MiniMax 发布命令行工具 MiniMax Code CLI,现处于公开测试阶段,支持 macOS、Linux 和 Windows。X:MiniMaxAgent (@MiniMaxAgent) ↗
28. Vercel Labs 推出用 Zig 编写的极简 coding Agent fx
该条目已按原始标题回退,未经原始证据明确支持的细节不予展开。fx.sh ↗
29. Cloudflare WriteGuard为MCP服务器提供细粒度安全控制
Cloudflare正推出处于私测阶段的WriteGuard,为MCP服务器提供细粒度安全控制。它旨在通过控制AI agents访问可修改数据或执行操作的工具,提升安全性,而不只是允许读取信息。InfoQ AI ↗
30. Netflix 开源因果推断智能体工作流
Netflix 开源了一个用于观测性因果推断(OCI)的智能体工作流,以减少因果分析中的重复工作。给定观测数据和用户的分析计划后,该智能体通过演员—评论家循环估计因果关系、撰写报告并提出后续步骤。InfoQ AI ↗
公司与资本
31. AI 芯片初创公司 Etched 完成 7 亿美元融资
AI 芯片公司 Etched 完成 7 亿美元融资,估值达 210 亿美元,由量化基金 Jane Street 领投;首个机架已交付 Jane Street。etched.com ↗
32. 谷歌以1000万美元竞得Spirit Airlines企业数据
据报道,谷歌以1000万美元竞得破产航司Spirit Airlines的企业内部数据,将用于改进产品与AI模型。谷歌称不会接收个人信息,交易尚待法院批准。reuters.com ↗
33. Anthropic IPO前夕,650亿美元营收底牌曝光
回头看,Anthropic就这样完成了反超。量子位 ↗
34. 消息称 Anthropic 拟向 CEO Amodei 及联合创始人发放额外投票权股票
据报道,Anthropic 正准备向 CEO Dario Amodei 等联合创始人发放具有额外投票权的股票,意在隔绝外部股东压力;目前尚未获官方确认。thein.fo ↗
35. 吉利汽车业绩达高点,李书福激流勇退
吉利不再研发传统燃油车。量子位 ↗
政策与安全
36. OpenAI 启动计划,强化国家安全领域 AI 的民主监督
OpenAI 将在未来一年提供 500 万美元,用于帮助民主监督机构开展培训、技术支持和 OpenAI 积分,并试点工具供授权审查员检查 AI 辅助政府决策记录。OpenAI 表示,AI 应增强而非取代人类判断,且不承担政府监督职责。OpenAI ↗
37. OpenAI因网络安全能力风险放缓模型开发
OpenAI因 OpenAI-Hugging Face 事件及 Astra 可能达到《预备框架》下的“关键网络安全能力”阈值,暂时放缓模型扩展速度,包括暂停最新部署模型的强化学习训练两周,并搁置最大规模前沿 RL 运行。公司已加强研究环境安全,要求对 Astra 及网络相关负载实施最严格防护,并扩展思维链监控,采用多阶段激活分类器检测机制。OpenAI ↗
补充来源:OpenAI ↗
38. 主要前沿模型提供商采用水印技术以遵守欧盟法规
截至 2026 年 8 月 2 日,欧盟《人工智能法案》第 50 条要求 AI 系统以机器可检测的方式标记合成内容。主要厂商正在采用统计水印方法,在不影响性能的情况下影响自然语言生成。这引发了开源社区的迅速反应,也带来合规和漏洞方面的担忧。InfoQ AI ↗
论文与研究
39. Claude 加速蛋白质设计与分析化学研究
Anthropic 公布两项实验:Claude(Mythos Preview 和 Opus 4.8)针对 15 个靶点设计蛋白质结合剂,成功 14 个,命中率为 22.6% 至 35.1%。Anthropic:Blog ↗
40. MVICAD2:建模时间延迟与膨胀的多视图独立成分分析
巴黎-萨克雷大学等机构提出 MVICAD2,用于建模不同被试脑源之间的时间延迟和膨胀差异,以弥补 MVICA 假设过严及仅估计延迟的局限。模拟实验显示,该方法优于现有方法;Cam-CAN 数据集分析显示,延迟和膨胀与衰老相关。machinelearning.apple.com:Blog ↗
41. 八款模型评测显示:智能体记忆需按模型能力校准
研究显示,强模型适合注入完整指南集,DeepSeek-V3.2(671B MoE)任务完成率提升 9.5 个百分点;较弱模型采用精选检索效果更佳,gpt-oss-120b(117B MoE)提升 16.1 个百分点,仅增加 5% token。该方法从智能体过往轨迹中蒸馏指南,并在推理时注入,无需更新权重或人工标注。Hugging Face:Blog ↗
42. GRPO 在多语言推理中的表现研究
一项大规模实证研究考察 GRPO 在多语言和非英语环境下的表现。研究发现,使用母语进行推理训练与使用英语训练的性能差距很小,表明 RLVR 同样适用于非英语场景。machinelearning.apple.com:Blog ↗
43. Google DeepMind 刷新矩阵乘法指数 ω 纪录
Google DeepMind 宣布矩阵乘法理论速度指数 ω 的新上界小于 2.371177;该结果由 Gemini 驱动的编程 Agent AlphaEvolve 参与取得。X:GoogleDeepMind (@GoogleDeepMind) ↗
观点与教程
44. Git 大规模托管为何困难
Git 的分布式设计使大规模托管面临挑战,packfile 成为服务器端可用性与扩展性的瓶颈。业界曾探索分布式文件系统、分布式 packfile 和分布式 Git,但对象级分布式存储因 Git 协议要求传输 packfile、导致 clone 性能不佳而被放弃。cursor.com:Blog ↗
45. 设计 AI 评测:先明确目标,再进行可视化
本文介绍如何使用开源评测框架 Inspect AI 和 Harbor 评估 agent 技能,并结合 Google Sheets 与 Data Studio 进行可视化分析。dev.to ↗
46. 从晶圆厂到 Token:AI 市场现状
Jordan Nanos 探讨半导体限制、数据中心扩张和网络瓶颈如何影响 AI 软件架构,并结合 SemiAnalysis 研究分析基准性能、GPU 扩展,以及从芯片制造到模型推理的 Token 经济学。InfoQ AI ↗
47. AI 的递归自我改进可能没那么快到来
当前 AI 行业最大胆的承诺是,AI 很快就能在几乎不需要人类监督的情况下自我改进。LLM 已经能够编写代码、生成用于训练的合成数据,并优化其运行所依赖的计算芯片。有关 AI 将爆发式进步的预测认为,研究人员所称的递归自我改进已近在眼前。MIT科技评论AI ↗
48. 我们仍不知道人们究竟如何使用 AI
Anthropic 和 OpenAI 等 AI 公司会定期发布关于人们如何使用 Claude、ChatGPT 等产品的报告,但 AI 研究人员指出,它们只公开希望我们看到的数据。斯坦福大学可信 AI 研究方向的计算机科学博士生 Anka Reuel 表示:“没有独立来源能够加以佐证。”。MIT科技评论AI ↗
人物与动态
49. 千问团队面向全球在读高校学生开放 25 类岗位
阿里千问团队面向全球在读高校学生开放 25 类岗位,覆盖大模型研发完整链路;投递入口位于阿里巴巴校园招聘官网。微信公众号 ↗
50. 比亚迪护航丝路万里行,深圳收官后开启海外征程
8月14日,2026丝绸之路万里行·启迪之路国内段在深圳收官。量子位 ↗
今日脉络
-
模型与评测持续推进
Qwen3.8-27B 在 Artificial Analysis 智能指数中位列 135 款模型之首;Inco AI 发布 DFlash 2 并行推测解码器,官方称其接近自回归解码速度的 3 倍。 -
AI 产品扩大使用范围
Claude Cowork 已面向所有付费订阅方案开放移动端和网页端;Gemini in Chrome 已向美国所有 Android 用户开放,Auto Browse 的 Agentic 能力限 AI Pro 与 AI Ultra 用户使用。 -
开发基础设施加速开放
Mojo 编译器、工具链及全部源码已按 Apache 2.0 许可证开源;企业微信 5.0.10 全面开放 CLI 与 MCP 能力,不限企业规模。 -
公司治理动向仍待确认
据报道,Anthropic 正准备向 CEO Dario Amodei 等联合创始人发放具有额外投票权的股票,意在隔绝外部股东压力;目前尚未获得官方确认。
总结
今日信息显示,AI 发展同时推进模型性能、终端产品覆盖和开发生态开放。随着智能体获得更多工具权限,相关安全控制与公司治理动态也值得持续关注。
评论 (0)
发表评论
请先登录后发表评论