每日 AI 趋势周报:2026-07-25
2026 年 7 月 25 日,AI 行业在模型迭代、用户规模、合规治理与地缘政策四条线上同时发生重大变化。Anthropic 发布新一代 Claude Opus 5,Google 披露 Gemini 月活逼近 10 亿,Anthropic 与作者的 15 亿美元版权集体诉讼获法院最终批准,微软与 Mistral 签署数十亿美元欧洲 AI 基础设施合作。本日报将梳理近 24 小时内的关键动态,并分析它们对开发者、企业与政策制定者的意义。
一、海外前沿:Anthropic 发布 Claude Opus 5,Google 披露 Gemini 近 10 亿月活
1.1 Anthropic 发布 Claude Opus 5:以半价逼近 Fable 5 的前沿性能
7 月 24 日,Anthropic 正式发布 Claude Opus 5(
claude-opus-5),将其定位为“日常可用的前沿模型”:性能接近 Claude Fable 5,但价格仅为 Fable 5 的一半。Opus 5 在多项高价值软件工程与知识工作基准上取得领先地位,并保持与 Opus 4.8 相同的 API 定价——输入 5 美元/百万 token、输出 25 美元/百万 token。核心性能与数据:
- Frontier-Bench v0.1:Opus 5 超过所有其他模型,并在成本低于 Opus 4.8 的情况下将其表现提升一倍以上;
- CursorBench 3.2:在最大努力下,成绩距离 Fable 5 峰值仅 0.5%,但每任务成本仅一半;
- ARC-AGI 3:得分达到次优模型的三倍,在新颖问题解决能力上拉开差距;
- Zapier AutomationBench:以相同任务成本实现约 1.5 倍于次优模型的通过率;
- OSWorld 2.0:以略高于 Fable 5 三分之一成本的成绩超越 Fable 5 最佳结果;
- 科学研究:在有机化学、蛋白质功能预测等生命科学评测中,较 Opus 4.8 提升 7.7–10.2 个百分点;
- 上下文与输出:支持 100 万 token 上下文窗口,最大输出 token 128k,默认开启 thinking 模式;
- Fast 模式:以 2.5 倍默认速度运行,价格为基准价的两倍。
Anthropic 强调,Opus 5 的改进不仅在于准确率,更在于工作方式:它会主动验证自己的工作、迭代修正,并在模糊任务中表现出更强的判断力。早期用户案例显示,Opus 5 能够在仅被提供机器零件图纸的原始像素、且无法直接查看图片的情况下,自行编写计算机视觉管线重建 3D FreeCAD 模型;也能在开源包管理器中发现并修复社区补丁遗漏的根因漏洞。安全评估方面,Opus 5 的自动化行为审计显示出 Anthropic 近期模型中最低的错位行为分数(2.3),在网络安全漏洞识别上接近 Mythos 5,但在漏洞利用能力上仍有明显差距。
1.2 Alphabet Q2 财报:Gemini 月活突破 9.5 亿,逼近 10 亿俱乐部
7 月 22 日(财报披露)/ 7 月 23 日(媒体集中报道),Alphabet 发布 2026 年第二季度财报,披露多项由 AI 驱动的超预期数据:
- 总营收 1198 亿美元,同比增长 24%,高于华尔街预期的 1170 亿美元;
- 每股收益 9.11 美元,同比激增约 291%,大幅高于预期的 2.88 美元;
- Google Cloud 营收 248 亿美元,同比增长 82%,运营利润增长超过三倍至 88 亿美元;
- Gemini 月活跃用户达到 9.5 亿,较 2025 年第四季度的 7.5 亿增长约 27%,一年内用户规模大约翻三倍。
Gemini 9.5 亿月活意味着它已非常接近 Google 旗下 Search、Gmail、Drive、Android、YouTube、Chrome 等“10 亿用户级”产品俱乐部。这也使 Gemini 与 ChatGPT(6 月披露约 10 亿月活)的差距进一步缩小。Google 同时上调了 2026 年资本支出预期,以应对 AI 基础设施需求。
1.3 微软与 Mistral 扩大战略合作:数十亿美元押注欧洲 AI 基础设施与主权云
7 月 21 日,微软与法国 Mistral AI 宣布扩大战略合作,核心包括:
- 数十亿美元级欧洲 GPU 基础设施扩张:Mistral 将部署数千颗 NVIDIA Vera Rubin GPU,微软将利用该欧洲算力扩大 Azure 与 AI 服务的容量;
- Mistral 模型进入微软企业产品:Mistral Medium 3.5 与 OCR 4 已上线 Microsoft Foundry,Mistral Medium 3.5 进入 Microsoft Copilot Studio;
- 支持云、云连接与完全离线部署:通过 Azure 与 Azure Local,企业可在公有云、客户可控环境与完全断开连接的环境中部署 Mistral 模型,满足主权、合规与韧性需求。
微软副主席 Brad Smith 表示,欧洲应能使用世界最先进 AI,同时不牺牲对数据、运营和数字未来的控制。此次合作被视为微软“欧洲数字承诺”的落地,也为受监管行业(金融、制造、医疗、关键基础设施)提供了美国模型之外的可控选项。
1.4 OpenAI 近期动态:ChatGPT Work 与 Health 继续铺开
近几日 OpenAI 继续推进产品矩阵:7 月 9 日上线的 ChatGPT Work 已向付费计划(Plus、Pro、Enterprise、Edu)铺开,支持跨应用与文件完成文档、表格、演示文稿、报告与网站,并可通过 Scheduled Tasks 定时或触发执行。7 月 23 日,OpenAI 向全美 18 岁以上用户开放 Health in ChatGPT,允许连接医疗记录、实验室结果与健康应用数据。OpenAI 强调不会在 Health 中基于个人医疗数据训练模型,但同日佛罗里达州一名牧师起诉 OpenAI,称 ChatGPT 提供的医疗建议导致其延误肺栓塞救治,凸显 AI 健康场景的合规与责任边界。
二、国内与开源:Kimi K3 权重临近开源,OpenAI 安全事件余波
2.1 Kimi K3:2.8 万亿参数完整权重将于 7 月 27 日开源
Moonshot AI 在 7 月 16 日发布 Kimi K3 后,持续推动生态适配。根据其官方技术博客,完整模型权重将于 2026 年 7 月 27 日 以开放权重形式发布。Kimi K3 是首个达到 3 万亿参数级别的开源模型:
- 2.8 万亿参数,稀疏混合专家架构(MoE);
- 100 万 token 上下文窗口,原生多模态能力;
- Kimi Delta Attention(KDA) 与 Attention Residuals(AttnRes) 架构,在百万 token 上下文中解码速度提升最高 6.3 倍;
- API 定价:缓存命中 0.30 美元/百万 token、缓存未命中 3.00 美元/百万 token、输出 15.00 美元/百万 token;
- 在 DeepSWE、Terminal-Bench 2.1、SWE Marathon 等代码与智能体基准上表现突出。
Moonshot 官方也坦言,Kimi K3 整体性能仍略逊于 Claude Fable 5 与 GPT-5.6 Sol 这两个最强闭源模型,但其在开放权重阵营中的规模与能力上限已逼近前沿。即将到来的权重开源将使全球研究者与企业能够本地部署、微调并基于此构建应用,对开源生态与硬件适配都是一次压力测试。
2.2 DeepSeek 旧 API 别名已正式退役
7 月 24 日 15:59 UTC,DeepSeek 的
deepseek-chat 与 deepseek-reasoner 两个旧 API 别名已按官方公告正式停用。开发者需切换至 deepseek-v4-pro 或 deepseek-v4-flash,并通过 thinking 参数控制是否启用推理。此前近三个月旧别名已被透明映射到 V4-Flash,但硬截止后任何旧调用都会返回错误。这一变更意味着 DeepSeek-V4 的接口正式化,对中国开发者出海及使用第三方 API 聚合平台的应用需要完成一次迁移。2.3 中国 AI 应用:智能体功能合规整改仍在继续
7 月初,字节跳动旗下豆包与阿里旗下通义千问几乎同步宣布下线“用户自建智能体”与“拟人化互动类智能体”功能。豆包于 7 月 15 日停用,千问于 7 月 10 日先行下线。豆包建议用户迁移至垂直角色互动应用“猫箱”,千问则表示将在整合优化后推出更稳定、安全的新一代服务。此次调整被视为对 AI 虚拟伴侣伦理与监管风险的集中回应,标志着国内头部平台从“功能扩张”转向“质量与合规深耕”。
三、安全与治理:版权集体诉讼落地、开放权重监管辩论升温
3.1 Anthropic 15 亿美元版权集体诉讼获法院最终批准
7 月 20 日,美国加州北区联邦法院法官 Araceli Martinez-Olguin 最终批准了 Anthropic 与数千名作者之间的 15 亿美元 集体诉讼和解。该案源于 2024 年 Bartz 等作者起诉 Anthropic 使用盗版书籍训练 Claude。法院此前裁定:使用合法获取的书籍训练 AI 可构成合理使用,但盗版行为很可能不构成合理使用。最终和解仅约 350 名作者选择退出,成为美国历史上最大的版权集体诉讼和解之一。
《哈利·波特》出版商 Bloomsbury 是和解受益方之一。其披露有 14,087 部图书 被纳入和解范围,每部作品补偿约 3,000 美元,扣除约 10% 法律费用后,Bloomsbury 与受影响作者预计共获约 1900 万美元。该案对 AI 训练数据的合法性具有标杆意义:它确认了“合法获取训练数据”与“盗版训练数据”在法律上的边界差异,也可能促使更多出版商与 AI 公司就授权费用展开谈判。
3.2 美科技巨头联名反对限制开放权重模型
7 月 24 日,包括 Hugging Face、Meta、Microsoft、Mistral、Nvidia 在内的多家科技公司签署了一封公开信,敦促美国政策制定者不要对中国 AI 采取“过早、过于宽泛的开放权重模型限制”。此前,美国政界正在讨论如何应对所谓中国实验室窃取美国知识产权并快速提升模型能力的指控。信件主张,广泛限制开放权重模型将损害创新、竞争与安全,并削弱美国在全球开源生态中的领导地位。这一表态与 Kimi K3、DeepSeek-V4 等中国开源模型的快速崛起形成呼应,也预示着开放权重模型可能成为中美 AI 博弈的下一个政策焦点。
3.3 联合国报告警告 AI 发展可能带来灾难性风险
7 月初发布的联合国 AI 专家组报告同样值得持续关注。报告指出,AI 能力发展速度已超越科学理解和政府政策能力,复杂 AI 任务的处理能力每 4–7 个月翻一番,自主智能体将处理更多真实世界任务。报告呼吁加强全球治理,以应对“不受控制的 AI 进展”可能带来的灾难性风险。这与近日 OpenAI 测试模型越狱 Hugging Face 事件、Anthropic 安全评估等新闻共同构成一个背景:前沿模型的能力正在快速超出传统安全框架的覆盖范围。
四、数据与对比
公司/模型 | 关键事件 | 时间 | 核心数据 |
Anthropic | Claude Opus 5 发布 | 7 月 24 日 | Frontier-Bench 新 SOTA;输入 $5/输出 $25 每百万 token;1M 上下文 |
Alphabet | Gemini 月活 / Q2 财报 | 7 月 22–23 日 | Gemini 9.5 亿 MAU;营收 1198 亿美元;Cloud 营收 248 亿美元 |
Microsoft / Mistral | 扩大战略合作 | 7 月 21 日 | 数十亿美元欧洲 GPU 基础设施;Mistral 模型进入 Foundry / Copilot Studio |
Anthropic | 版权集体诉讼和解获批 | 7 月 20 日 | 15 亿美元;约 350 名作者退出;Bloomsbury 14,087 部作品 |
OpenAI | Health in ChatGPT 全美开放 | 7 月 23 日 | 18 岁以上美国用户可连接医疗记录;同日遭遇诉讼 |
Moonshot | Kimi K3 权重即将开源 | 7 月 27 日 | 2.8T 参数、1M 上下文、原生多模态 |
DeepSeek | 旧 API 别名退役 | 7 月 24 日 | deepseek-chat / deepseek-reasoner 停用;切换至 v4-pro / v4-flash |
豆包 / 千问 | 自建智能体功能下线 | 7 月 10–15 日 | 国内头部平台对 AI 虚拟伴侣进行合规整改 |
Hugging Face / Meta / Microsoft 等 | 联名反对宽泛限制开放权重 | 7 月 24 日 | 公开信反对美国对中国 AI 采取过早开放权重限制 |
五、观察结论
2026 年 7 月 25 日的 AI 趋势可以用三个关键词概括:模型再分层、用户规模战、合规常态化。Anthropic 用 Claude Opus 5 证明,高端模型市场正在从“唯一旗舰”走向“分层服务”:Fable 5 负责最难问题,Opus 5 负责日常高价值工作,Sonnet 5 负责大规模普及。Google 则用 9.5 亿月活说明,Gemini 正在从“追赶者”变成与 ChatGPT 并驾齐驱的“十亿级入口”。
在合规层面,Anthropic 15 亿美元和解为训练数据合法性树立了重要参照,但 AI 健康建议等新兴场景的责任边界仍未明确。国内豆包、千问下线智能体功能,则显示平台在追求创新的同时,必须先行处理伦理与监管风险。而微软与 Mistral 的欧洲合作、科技巨头联名反对限制开放权重,则预示着 AI 的地缘与监管博弈正在从产品层面向基础设施与生态规则层面升级。
对开发者而言,这意味着:第一,模型选择将更加丰富,但需要在能力、成本、延迟与合规之间做更精细的权衡;第二,开源与开放权重模型的部署和微调能力将成为核心竞争力;第三,AI 应用的合规设计需要从产品第一天就纳入,而不是作为事后补丁。
六、参考来源
作者:Stav
声明:本文采用 CC BY-NC-SA 4.0 许可协议,转载请注明出处。
Previous
每日 AI 趋势周报:2026-07-26
Next
usbliter8:Apple A12/A13 BootROM 漏洞全解析——从原理、触发到风险边界