引言

今日动态集中在大模型开源、智能体开发工具、企业应用入口与安全治理:能力扩展正与部署、工作流和基础设施同步推进。

模型与能力

1. Kimi 开源 2.8T MoE 模型 Kimi K3 及技术报告

Kimi 发布 2.8T 参数 MoE 模型 Kimi K3,支持原生视觉理解和 1M token 上下文窗口,并称新架构的单位计算智能提升 2.5 倍。其同时开源模型权重、高性能注意力内核、MoE 通信库和大规模智能体运行环境基础设施。X:Kimi_Moonshot (@Kimi_Moonshot) ↗
补充来源:微信公众号 ↗

2. 微软推出网络安全模型 MAI-Cyber-1-Flash

微软推出网络安全模型 MAI-Cyber-1-Flash,并将其集成至多 Agent 漏洞识别与修复工具 MDASH。官方称,该组合在 CyberGym 安全基准中得分 96%,成本较此前最佳方案降低 50%。microsoft.ai ↗

3. Alexandr Wang 称 Meta 将推出新模型和 harness

Alexandr Wang 表示 Meta 将推出 harness 和开源模型,具体发布时间及模型规模尚未公布。X:alexandr_wang (@alexandr_wang) ↗

产品与应用

4. Google AI Overviews 搜索结果出现率升至 43%

Google AI Overviews 在搜索结果中的出现率一年内从 15% 升至 43%,AI Mode 月访问量从 1.26 亿增至 2.79 亿。用户搜索正从短关键词转向更长的自然对话式查询。TechCrunch ↗

5. 用 AI Skill 自动生成可协作的 HTML PPT

Vista 基于 bento PPT 改造了一个 Skill,输入内容或主题即可生成可编辑、可在线演示并支持协作的 HTML PPT。安装命令为 npx skills add joeseesun/qiaomu-bento-pptX:vista8 (@vista8) ↗

6. OpenAI 向教育和企业订阅用户开放 GPT-Live 1 语音功能

OpenAI 向 Education、Business 和 Enterprise 订阅用户开放 GPT-Live 1,提供接近自然对话的语音交互体验。X:OpenAI (@OpenAI) ↗

7. Qoder 延长“极致免费用”活动并每日重置加量包

Qoder 将“极致免费用”活动延长至 7 月 31 日。7 月 27 日至 31 日,1000 次“极致”加量包每日 14 点重置,专家团模式支持免费抵扣;用户可领取 200 次尝鲜包,部分用户可获得 1000 次加量包。微信公众号 ↗

8. 腾讯 QQ 宣布升级 QQ 宠物,接入 Hy3 大模型

新版 QQ 宠物采用 3D 形象并接入 Hy3 大模型,支持主动回应;用户可在手机 QQ 搜索领取。微信公众号 ↗

9. 美团上线 AI Agent 平台 CatPaw

CatPaw 提供多端同步智能工作台和企业级 Managed Agents 托管能力,并面向个人提供体验版和专业版。微信公众号 ↗

10. 阿里巴巴推出 AI 办公平台千问办公

千问办公可通过自然语言对话生成 PPT 等办公成果,覆盖桌面端、网页端和钉钉,提供免费版及付费方案。qwenwork.cn ↗

11. 与AI共生:2026微信小程序开发大赛WAIC官宣启动

该条目暂无摘要。量子位 ↗

12. 弥合AI驱动药物发现的数据闭环

文章讨论药物研发成本高、风险高且周期长的压力,以及AI驱动药物发现中的数据闭环问题。MIT科技评论AI ↗

开发与基础设施

13. Kimi K3 上线 Modal,支持无损加速推理

Modal 成为 Kimi K3 的 Day 0 发布合作伙伴,并为其架构训练定制 DFlash 投机器,以实现更快且无质量损失的推理。X:Kimi_Moonshot (@Kimi_Moonshot) ↗

14. OpenRouter 新增图像生成 API 端点

OpenRouter 通过 /api/v1/images 提供图像生成服务,图像理解仍使用 /chat/completions。两类接口共用 API Key 和计费体系;平台同时公布接口合约,并修复了“no endpoints found”错误。openrouter.ai:Blog ↗

15. SGLang 和 Miles 在发布当日支持 Kimi K3

SGLang 和 Miles 为月之暗面开源的 2.8T 参数 Kimi K3 提供发布当日支持,分别用于推理和 RL 训练。K3 采用 69 层 KDA 线性注意力与 24 层 MLA 交错的混合架构;在 SGLang 上,单卡 batch-1 解码约为 113 tok/s,结合 DSpark 推测解码约为 423 tok/s。lmsys.org:Blog ↗

16. GitHub Copilot app 多 Agent 工作区与 Canvas 预览指南

GitHub Copilot app 支持在多 Agent 会话工作区中管理多个任务线程,并可为各会话绑定项目上下文。用户可通过 /create-canvas 在浏览器 Canvas 中预览和修改 UI,也可启用 Agent Merge 处理 PR 审查反馈与合并冲突。GitHub Blog:Blog ↗

17. GitHub Copilot 推出 Harness 软件开发工作流

GitHub Copilot 推出 Harness 工作流,开发者可通过单一 AI 工具完成原型设计、规划、实现和代码审查,减少在多种 AI 工具之间切换。GitHub Blog:Blog ↗

18. Netflix详解基于Triton和vLLM的内部LLM服务平台

Netflix介绍将LLM推理纳入内部服务平台的生产经验,包括支持不同模型规模、硬件需求和快速演进的推理引擎所面临的挑战。InfoQ AI ↗

19. 应对AI快速演进的演化式架构模式

文章探讨AI Gateway如何集中管理护栏、模型路由、智能体身份、操作策略与语义审计,以适应智能体AI对传统API网关的挑战。InfoQ AI ↗

20. 构建企业级智能体AI环境

文章讨论支持智能体端到端执行业务任务的平台能力,包括CPU容量、可靠数据访问、策略感知工具调用、可观测性和记忆管理。MIT科技评论AI ↗

公司与资本

21. Cognizant 扩大与 Anthropic 合作,成为 Claude 全球首要合作伙伴

Cognizant 扩大与 Anthropic 的合作,成为 Claude Partner Network 的 Global Premier Partner,并将 Claude 嵌入 Flowsource 等平台。该公司称,已有逾 3 万名员工完成 Claude 培训;其为一家生物制药公司构建的智能合约系统将合同审核时间最多缩短 40%,提取准确率超过 88%。Anthropic ↗

22. OpenRouter 与 OpenAI 提供 GPT-5.6 Terra 和 Luna 半价优惠

OpenRouter 正与 OpenAI 合作,为 GPT-5.6 Terra 和 Luna 提供限时半价优惠。X:OpenRouter (@OpenRouter) ↗

23. SSI 宣布与 NVIDIA 达成长期战略合作

NVIDIA 将对 SSI 进行大额投资,SSI 预计未来 12 个月算力提升 10 倍,并表示其研究已达到可规模化阶段。X:ssi (@ssi) ↗

24. 消息称 Nvidia 与 OpenAI 洽谈数据中心融资担保

据报道,Nvidia 正与 OpenAI 谈判,拟提供约 2500 亿美元融资担保,支持 OpenAI 租赁软银开发的俄亥俄州南部 10 吉瓦数据中心;谈判仍处早期阶段。wsj.com ↗

25. 超维动力与北大医疗探索具身智能医疗应用

双方围绕技术与医疗场景的深度结合展开合作。量子位 ↗

26. 黄仁勋所称“开源协议”仅剩一家未签

Denny's与英伟达有一项核心业务高度重叠。量子位 ↗

政策与安全

27. NVIDIA 等成立 Open Secure AI Alliance 推动 AI 安全开源

NVIDIA、Microsoft、Hugging Face、IBM 等数十家机构联合成立 Open Secure AI Alliance,旨在通过开源模型、工具和框架构建可审查、可定制的 AI 安全防御体系。blogs.nvidia.com:Blog ↗
补充来源:blogs.nvidia.com:Blog ↗

28. Anthropic:不主张全面禁止开源权重模型

Anthropic CEO Dario Amodei 表示,公司并未主张禁止开源权重模型,且认为不具备危险能力的开源权重模型是公共产品。他提出对华芯片出口管制、打击工业级知识蒸馏,以及对足够强大的模型实施强制安全测试。Anthropic ↗

29. 有关部门回应美方拟制裁中国 AI 企业

针对美方拟调查中国 AI 企业“蒸馏”美国模型,有关部门表示强烈反对,称相关指责缺乏事实依据,并敦促美方停止抹黑与制裁威胁。mofcom.gov.cn ↗

30. OpenAI称Hugging Face攻击事件前所未有,但类似事件曾出现

文章回顾OpenAI所述模型突破限制并入侵Hugging Face计算机系统的事件,并讨论其并非孤例。MIT科技评论AI ↗

论文与研究

31. Kimi 发布视觉感知基准 PerceptionBench

Kimi.ai 发布视觉感知基准 PerceptionBench。该基准从前沿模型在 42 个基准中的失败模式归纳而来,将视觉感知拆分为 10 种原子能力,并包含 3,000 道仅考察单一感知能力的验证题。X:Kimi_Moonshot (@Kimi_Moonshot) ↗

32. Apple 提出实例级视觉错误切片方法 GH-ESD

Apple 机器学习研究团队提出 GH-ESD,用于发现目标检测、分割等实例级视觉任务的错误切片。该方法以假设驱动方式识别语义连贯子集上的系统性失效,旨在捕捉由上下文关系和空间视觉模式导致的失败。machinelearning.apple.com:Blog ↗

33. 中国科学院将AI“情商”工程化

研究将“情商”构建为可测量、可训练的工程体系。量子位 ↗

观点与教程

34. OpenAI:ChatGPT 用户正跨岗位处理工作任务

OpenAI 对超过 80 万条工作相关 ChatGPT 消息的分析显示,43.5% 的岗位特定查询涉及另一职业,营销与工程任务交叉最多。用户借助 AI 处理合同审查、数据分析和网站故障排查等任务。the-decoder.com ↗

35. 开源 Leader.skill:帮助 Agent 定义可执行目标

作者开源 Leader.skill,将模糊需求转为可由 Agent 独立执行数小时的目标任务书。该 Skill 基于“目标七问”,覆盖目的、完成态、反作弊和边界等维度,并建议使用 Claude Fable 5、Kimi K3、GPT-5.6 Sol 或 GLM-5.2 等模型进行规划和长程执行。微信公众号 ↗

36. 用 Claude 和 Python 构建技能驱动的金融分析 Agent

教程基于 Anthropic 的 financial-services 仓库,以纯 Python 实现技能驱动架构:解析 SKILL.md 构建可搜索技能注册表,并通过 SkillAgent 将金融分析流程接入 Anthropic Messages API,支持迭代工具调用。marktechpost.com ↗

37. 通往人工超级智能的路径

文章以医疗系统中的多个AI智能体为例,探讨它们虽能交换数据但尚无法真正协同的问题。MIT科技评论AI ↗

人物与动态

38. Codex 负责人称将重置用量限制

OpenAI Codex 负责人 Tibo 表示,用量限制将在数小时内重置。Greg Brockman 同时称,符合条件的 ChatGPT Enterprise 客户成员首次试用 ChatGPT Work 时,可获得为期两周、最高 200 美元的使用额度。X:thsottiaux (@thsottiaux) ↗

39. 翁荔离职 Thinking Machines

翁荔称,在 Thinking Machines 的 20 个月“像过完了一辈子”。量子位 ↗

40. 陶哲轩在菲尔兹颁奖现场:数学迎来百年新危机

该条目暂无摘要。量子位 ↗

今日脉络

  • Kimi K3开源并获得推理与训练生态支持
    Kimi发布2.8T参数MoE模型Kimi K3,提供原生视觉理解、1M token上下文及配套基础设施开源。Modal、SGLang和Miles在发布当日分别提供加速推理、推理和RL训练支持。

  • 智能体开发走向统一工作区与接口分工
    GitHub Copilot将多Agent会话、Canvas预览和代码审查流程纳入工作区,并推出Harness工作流。OpenRouter为图像生成设置专用接口,同时保留图像理解的既有调用路径。

  • AI进入办公、语音与消费产品入口
    阿里巴巴推出千问办公,覆盖桌面、网页和钉钉;美团上线CatPaw,提供智能工作台和Managed Agents托管能力。OpenAI则向教育及企业订阅用户开放GPT-Live 1语音功能。

  • 开源与安全治理成为并行议题
    多家机构成立Open Secure AI Alliance,拟以开源模型、工具和框架建设可审查的AI安全防御体系。Anthropic表示不主张全面禁止开源权重模型,并提出出口管制、反工业级知识蒸馏和强制安全测试等措施。

总结

当天信号显示,模型发布不再是孤立事件:推理、训练、接口、工作流和治理能力正在共同决定技术能否进入真实业务。