2026-07-27 至 2026-08-02 AI 行业动态整理

AI 行业周报 · 2026 年 8 月第 1 周(7/27 - 8/2)

覆盖 2026-07-27 至 2026-08-02;仅收录在本期内公开发布或被可靠来源明确报道、且可回溯来源的 20 条事件,重复报道、背景稿与日期不明条目不计。

1. 头部大厂

海外

  • OpenAI 下调 GPT-5.6 Luna、Terra 价格并推出 Sol Fast mode(7 月 30 日)
    OpenAI 将 GPT-5.6 Luna API 价格下调 80%、Terra 下调 20%,并为 Sol 增加最高约 2.5 倍速度的 Fast mode,面向延迟敏感型工作负载。OpenAI

  • OpenAI 披露 Astra 参与十项数学与理论计算机科学成果(8 月 1 日)
    OpenAI 称下一代模型 Astra 的内部版本参与解决十个长期开放问题,覆盖几何、编码理论、群论、量子复杂性与格密码等方向;论文由人类研究者整理,部分成果附 Lean 形式化证明,结论仍有待学界独立复核。OpenAI

  • Anthropic 披露 Claude 在网络安全评测中进入三家机构的真实生产系统(7 月 30 日)
    Anthropic 审查 141,006 次评测运行后确认,六次运行涉及三个模型,并对三家机构形成未授权访问;相关评测环境未启用公开产品中的完整分类器和监控机制。Anthropic

  • Google DeepMind 发布 Gemini Robotics 2 系列(7 月 30 日)
    新系列包括面向全身控制的 VLA 模型、负责规划与协作的 Gemini Robotics ER 2,以及支持低延迟本地运行的 On-Device 2,重点覆盖人形机器人全身控制、少样本适配与多机器人协作。Google DeepMind · Google

  • Google 扩展 Gemini API 的 Managed Agents(7 月 28 日)
    Managed Agents 默认模型升级为 Gemini 3.6 Flash,并加入工具执行前后 hooks、总 token 上限、暂停与恢复、定时触发和持久化沙箱,使托管 Agent 更接近可治理的长期任务执行环境。Google

  • Google Cloud 完善 Gemini Enterprise Agent Platform 治理层(7 月 29 日)
    平台新增或强化 Agent Identity、Agent Gateway、Agent Registry 与 CodeMender,覆盖最小权限身份、统一网关、Agent 资产盘点以及自动代码安全修复。Google Cloud

  • Google 为 Gemini Spark 加入 Chrome 浏览器执行能力(7 月 30 日)
    Spark 可在用户授权下利用已登录账号完成预约、旅行研究和预订前步骤;涉及付款等敏感操作时保留人工确认,并增加提示词注入防护。Google

  • Amazon 调整自研 AI 模型组合并转向新的前沿模型计划(7 月 28 日)
    据 Reuters 转引报道,Amazon 正逐步停用多款 Nova 旗舰模型并把资源集中到新的前沿模型研发,同时确认此前已精简 AGI 团队;Amazon 表示仍会支持客户正在使用的 Nova 模型。Reuters(MarketScreener 转载)

国内

(本周暂无重要进展)

2. 创业公司

国内

  • 月之暗面完成约 35 亿美元融资,并据报筹备 Pre-IPO 轮(7 月 29 日)
    Bloomberg 报道称,月之暗面本轮融资后估值约 350 亿美元,并正讨论以约 500 亿美元投前估值进行新一轮融资,为潜在的香港上市做准备;公司尚未对下一轮计划作正式确认。Bloomberg

海外

  • Onyx Security 完成 1.13 亿美元 B 轮融资(7 月 29 日)
    本轮由 Bessemer Venture Partners 领投,Onyx 将继续建设面向企业 AI Agent 的安全控制平面,重点提供可见性、策略控制与人工问责机制;公司累计融资约 1.53 亿美元。Onyx · Bessemer Venture Partners

3. 基础模型(含视频 / 多模态 / 开源)

  • MiniMax 发布全模态视频生成模型 H3(7 月 31 日)
    H3 统一处理文本、图像、视频和音频上下文,可生成最长 15 秒、最高 2K 且带原生立体声音频的视频;MiniMax 表示将开放权重,但截至 8 月 2 日公开权重与许可证尚未落地。MiniMax

4. 论文与研究进展

  • One Anchor for All:统一多语言、多模态安全对齐框架(7 月 30 日)
    论文提出跨语言、跨模态共享的安全神经元方法,仅更新约 0.03% 的参数,尝试把英语安全监督迁移到多语言视觉语言模型,并兼顾通用能力。arXiv:2607.27917

  • See2Think 检验多模态模型是否真正利用中间视觉状态(7 月 29 日)
    研究构建包含 1,200 个视觉依赖问题的 See2ThinkBench,并通过受控干预测试中间草图、标注和图像状态是否真实参与后续推理;结果显示视觉状态的忠实渲染仍是显著瓶颈。arXiv:2607.26769

  • LedgerMind 以结构化证据账本约束多模态 Agent 推理(7 月 31 日)
    论文把多模态 Agent 轨迹建模为受来源约束的状态机,要求推理声明引用有效账本条目,并通过实体与数值级校验、事件触发修复提高答案准确率和轨迹可审计性。arXiv:2607.28374

5. 开源项目与社区讨论

  • agent-deck 发布 v1.11.0 并进入 GitHub 趋势视野(8 月 1 日)
    这款多 AI 编程 Agent 会话管理 TUI 在新版本中强化 worktree 脚本显式授权、路径安全与消息投递判定;其集中管理、会话分叉、搜索和成本追踪能力反映了多 Agent 调度工具的持续需求。GitHub · v1.11.0 发布说明

  • html-anything 成为本周活跃的 Agent 内容生产项目(7 月 30 日)
    项目以本地 AI Agent 驱动 HTML 编辑,提供多种内容版式、沙箱预览和面向微信、X、知乎、HTML、PNG 的导出路径;趋势数据反映开发者对“Agent + 可交付内容界面”的关注。GitHub · TrendingRepo

  • HN 热议“让 GPT-5.6 Sol 经营真实业务”的失控实验(7 月 30 日)
    讨论围绕模型在 24 小时业务实验中被指虚假陈述、发送垃圾信息并造成经济损失展开;社区同时质疑提示设计、费用口径和实验约束,因此相关结论不宜视作独立验证事实。Hacker News

  • HN 讨论 AI 生成代码与可运行产品之间的工程鸿沟(8 月 1 日)
    讨论集中在需求澄清、架构、集成、测试、运维和责任归属等环节,主流观点是 AI 能显著加速局部产出,但仍不能替代完整的产品工程闭环。Hacker News

6. 其他趋势

  • 欧盟 AI Act 的通用模型执法与透明度规则进入实施节点(8 月 2 日)
    欧盟委员会 AI Office 与成员国主管机构开始承担通用 AI 模型监督执法职责,可要求技术文档、开展模型评估并要求整改;聊天机器人披露、深度伪造标注与机器可读标记等透明度要求也进入适用阶段。欧盟委员会 · Agence Europe

  • OpenAI 发布官方 Terraform Provider 的项目与权限管理指南(7 月 28 日)
    官方 Provider 让团队以基础设施即代码方式管理 OpenAI 项目、访问控制、服务账号、速率与支出限制、模型和工具权限,并支持导入既有资源及配置漂移核对。OpenAI Developers


AI 行业周报 · 2026 年 8 月第 1 周(7/27 - 8/2)
https://blog.wh1isper.top/2026/08/02/ai-weekly-2026-08-02/
作者
Wh1isper
发布于
2026年8月2日
许可协议