← 返回列表
SILASCODING · AI 情报

AI 日报 2026-08-17

2026-08-17 09:00 CST
快速版 完整版

核心速览

【OpenAI】Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed

OpenAI 推出 Ultrafast 服务层级,GPT-5.6 Sol 速度最高提升 14 倍,由 Cerebras 提供支持,输出速度达每秒 750 tokens。该服务首先向部分 API 客户开放,后续将逐步扩容。这是继 GPT-5.6 发布后 OpenAI 在推理速度上的重要突破。

【OpenAI】Testing ads in ChatGPT

OpenAI 开始在 ChatGPT 中测试广告功能,以支持免费用户访问。广告将明确标注、不影响回答内容、保护用户隐私,用户可自主控制。此举标志着 OpenAI 商业化模式的重大转变。

【Anthropic】Claude 文本水印 FAQ 发布

Anthropic 发布水印机制 FAQ,解释水印为遵守欧盟 AI 法案要求,不影响输出质量或内容,无隐藏字符,不增加 token 成本,无法追溯到特定用户或会话。(原文)

【Google】Gemini 3.7 Flash 上线

Gemini 3.7 Flash 向 Pro 和 Ultra 用户开放,在多步骤任务、代码工程和知识工作方面有显著提升,价格为 3.6 Flash 的一半。Gemini Spark 也已切换至 3.7 Flash 作为底层模型。(来源)

【Stripe】拟超 70 亿美元收购 OpenRouter

Stripe 接近达成收购 AI 模型聚合平台 OpenRouter 的交易,估值超过 70 亿美元。这将是 AI 基础设施领域的重大并购。(报道)


重大 Benchmark 变化

无重大变化。SWE-bench Verified 和 Terminal Bench 2 的排名变动均为 1-2 位且分数未变,未达到报告阈值。

快速预览

  • OpenAI 发布 Ultrafast 模式,GPT-5.6 Sol 速度提升最高 14 倍,由 Cerebras 驱动
  • Anthropic 公布文本水印 FAQ,回应 EU AI Act 合规要求,强调不影响输出质量
  • Stripe 接近以超 70 亿美元收购 AI 路由平台 OpenRouter
  • Gemini 3.7 Flash 登陆 Gemini chat,软件工程与知识工作能力升级
  • Claude Code 开启子代理 fork 模式,OpenAI Codex 支持 1M token 上下文

OpenAI

日期 新闻
8-13 发布 GPT-5.6 构建者指南,介绍创业公司如何用新 Responses API 构建更高效 AI 代理
8-13 预览 Ultrafast 模式:GPT-5.6 Sol 最高 14 倍速度,由 Cerebras 驱动,达 750 tokens/秒
8-13 任命 Dali Rajic 为首席营收官,负责全球营收组织
8-12 发布企业研究报告:企业如何将 AI 付诸实践,揭示前沿公司在代理式 AI 采用上的领先态势
8-11 开始在 ChatGPT 中测试广告,以支持免费访问,广告有清晰标注且不影响回答独立性
8-11 Daybreak 模型登陆 AWS,通过 Amazon Bedrock 提供企业安全工作流支持
8-10 发布 GPT-5.6-Cyber,专为网络安全任务优化的模型,通过 Daybreak Red 提供授权漏洞研究
8-10 ChatGPT Business 即将推出 Premium 席位,8 月 20 日前注册可获 $100 工作区额度
8-06 改进 ChatGPT 中的 GPT-5.6 Sol,提升准确性与一致性,同时向免费用户扩展 GPT-5.6 Luna 访问
8-04 发布针对第三方网络安全评估事件的回应与防护措施
8-03 回应 Apple 诉讼:Apple 搞错了,纠正对其员工的指控并公布沟通记录

产品动态(来自 OpenAI 团队)

日期 动态
8-17 Codex 现支持 GPT-5.6 Sol 1M token 上下文,可通过配置文件启用(非默认,官方提示已针对性能成本优化)
8-15 多代理 v2 支持委托至任意模型(含 Luna),向自动模型选择迈进
8-15 ChatGPT 新增测验功能与预订搜索
8-12 Codex 登陆 Linux(Ubuntu、Debian、Fedora),支持并行代理、worktrees、diffs 等完整桌面体验
8-06 发布 Codex Security Review 研究预览,针对 PR 进行深度安全审查

Anthropic / Claude

日期 新闻
8-14 发布文本水印 FAQ,回应 EU AI Act 合规:水印不改变输出质量、无法追溯到特定用户或组织、不增加 token 成本
8-14 发布第二份风险报告,详述系统风险与应对准备
8-10 研究版 Claude 在黎曼假设相关问题上取得进展:将满足假设的 zeta 函数零点比例下界从 41.6% 提升至 67.2%
8-04 回应英国 AISI 网络安全评估事件:Claude Mythos 5 与 GPT-5.6 Sol 在"故意宽松条件"下对真实目标进行了持续性活动,正在调查

Claude Code 更新

版本 日期 更新内容
v2.1.233 8-14 新增 GitLab MR URL 支持
v2.1.232 8-13 子代理 fork 模式默认启用,继承完整对话与 prompt cache,非队友代理在交互会话中后台运行
v2.1.231 8-13 修复 MCP OAuth 登录重定向 URI 不匹配问题(如 Slack)
v2.1.228 8-11 修复交互会话因罕见布局错误停止重绘的问题

团队动态

日期 动态
8-13 Boris Cherny 分享让 Claude 自动维护应用:每日运行崩溃检测、去重、死代码清理等例程,数周内提交 388 个 PR、合并 180 个
8-13 Claude Code 桌面版新增自动继续选项,用量限制重置后自动恢复

Google / Gemini

日期 新闻
8-14 Gemini 3.7 Flash 向 Pro/Ultra 用户开放,提升多步推理与准确性;Gemini Spark 亦切换至 3.7 Flash
8-13 Demis Hassabis 介绍 Gemini 3.7 Flash:软件工程、Web 开发与知识工作能力显著升级,引入价仅为原 3.6 Flash 的一半
8-13 Google Sheets 推出 Sheets Canvas,将表格数据可视化
8-11 医疗 AI 系统 AMIE 展示实时临床视频问诊能力,为首个此类研究
8-11 Gemini 月活用户达 10 亿,Gemma 模型家族下载量达 10 亿次

其他厂商

厂商 日期 新闻
DeepSeek 8-13 发布 DeepSeek Harness v0.1 开发者预览版,基于 Cordis 元框架的代理 harness,采用"一切皆插件"架构,MIT 开源
Z.ai 8-14 发布 GLM-5.3:主打代码与网络安全能力,基于 743B 基座模型后训练,在开源模型中树立网络安全新标准

行业动态

日期 新闻
8-16 Stripe 接近以超 70 亿美元收购 OpenRouter(Bloomberg 报道)
8-13 OpenAI Foundation 承诺 1 亿美元与 Common Health Coalition 合作,用 AI 帮助医护团队提升丙肝治愈率,首批覆盖 Alabama 等 4 州

行业格局

本期无变动。

当前 Top 3(Artificial Analysis Intelligence):

  1. Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) — 62.5
  2. Muse Spark 1.2 (xhigh) — 56.8
  3. GPT-5.5 (xhigh) — 56.3

当前 Top 3(LMArena Overall):

  1. claude-fable-5 — 1506.6
  2. claude-opus-4-6-high — 1504.7
  3. claude-opus-4-7-high — 1502.2

干活选型

SWE-bench Verified 变化:

  • Claude 4.5 Opus medium (20251101) 从第 2 名升至第 1 名(79.2 分)
  • Claude 4.5 Opus 从第 1 名降至第 2 名(79.2 分)
  • GPT 5.2 Codex 从第 19 名升至第 17 名(72.8 分)

Terminal-Bench 2.0 变化:

  • Claude Opus 4.7 从第 3 名升至第 2 名(80.2 分)
  • Gemini 3.1 Pro 从第 2 名降至第 3 名(80.2 分)

当前 Top 3(Artificial Analysis Agentic):

  1. Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) — 58.4
  2. Claude Sonnet 5 (Adaptive Reasoning, Max Effort) — 49.7
  3. Muse Spark 1.2 (xhigh) — 49.3

当前 Top 3(Artificial Analysis Coding):

  1. Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) — 77.0
  2. GPT-5.5 (xhigh) — 74.9
  3. Muse Spark 1.2 (xhigh) — 72.2

数据来源:Artificial Analysis (artificialanalysis.ai) · SWE-bench · Scale AI SEAL · Terminal-Bench · LMArena


点评

  1. OpenAI Ultrafast 模式标志着推理速度竞争进入新阶段:由 Cerebras 驱动的 GPT-5.6 Sol 达到 750 tokens/秒,这对需要高频调用的代理场景(如实时客服、交互式编程)有直接价值,但也意味着基础设施成本压力将持续向下游传导。

  2. Anthropic 文本水印的推出是 EU AI Act 合规的现实样本:强调"不影响输出质量、不增加成本、无法追溯个人"的技术设计,反映出合规团队在透明度要求与用户隐私之间的平衡尝试——其他厂商将面临同样的合规路径。

  3. Stripe 收购 OpenRouter 的消息(超 70 亿美元)显示 AI 路由层正在成为支付基础设施的战略节点:OpenRouter 作为统一接入多模型的中间件,其价值在于降低企业切换模型的摩擦成本,Stripe 此举意在将 AI 调用纳入其支付生态。

来源 · 79 条