【OpenAI】Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed
OpenAI 推出 Ultrafast 服务层级,GPT-5.6 Sol 速度最高提升 14 倍,由 Cerebras 提供支持,输出速度达每秒 750 tokens。该服务首先向部分 API 客户开放,后续将逐步扩容。这是继 GPT-5.6 发布后 OpenAI 在推理速度上的重要突破。
【OpenAI】Testing ads in ChatGPT
OpenAI 开始在 ChatGPT 中测试广告功能,以支持免费用户访问。广告将明确标注、不影响回答内容、保护用户隐私,用户可自主控制。此举标志着 OpenAI 商业化模式的重大转变。
【Anthropic】Claude 文本水印 FAQ 发布
Anthropic 发布水印机制 FAQ,解释水印为遵守欧盟 AI 法案要求,不影响输出质量或内容,无隐藏字符,不增加 token 成本,无法追溯到特定用户或会话。(原文)
【Google】Gemini 3.7 Flash 上线
Gemini 3.7 Flash 向 Pro 和 Ultra 用户开放,在多步骤任务、代码工程和知识工作方面有显著提升,价格为 3.6 Flash 的一半。Gemini Spark 也已切换至 3.7 Flash 作为底层模型。(来源)
【Stripe】拟超 70 亿美元收购 OpenRouter
Stripe 接近达成收购 AI 模型聚合平台 OpenRouter 的交易,估值超过 70 亿美元。这将是 AI 基础设施领域的重大并购。(报道)
无重大变化。SWE-bench Verified 和 Terminal Bench 2 的排名变动均为 1-2 位且分数未变,未达到报告阈值。
| 日期 | 新闻 |
|---|---|
| 8-13 | 发布 GPT-5.6 构建者指南,介绍创业公司如何用新 Responses API 构建更高效 AI 代理 |
| 8-13 | 预览 Ultrafast 模式:GPT-5.6 Sol 最高 14 倍速度,由 Cerebras 驱动,达 750 tokens/秒 |
| 8-13 | 任命 Dali Rajic 为首席营收官,负责全球营收组织 |
| 8-12 | 发布企业研究报告:企业如何将 AI 付诸实践,揭示前沿公司在代理式 AI 采用上的领先态势 |
| 8-11 | 开始在 ChatGPT 中测试广告,以支持免费访问,广告有清晰标注且不影响回答独立性 |
| 8-11 | Daybreak 模型登陆 AWS,通过 Amazon Bedrock 提供企业安全工作流支持 |
| 8-10 | 发布 GPT-5.6-Cyber,专为网络安全任务优化的模型,通过 Daybreak Red 提供授权漏洞研究 |
| 8-10 | ChatGPT Business 即将推出 Premium 席位,8 月 20 日前注册可获 $100 工作区额度 |
| 8-06 | 改进 ChatGPT 中的 GPT-5.6 Sol,提升准确性与一致性,同时向免费用户扩展 GPT-5.6 Luna 访问 |
| 8-04 | 发布针对第三方网络安全评估事件的回应与防护措施 |
| 8-03 | 回应 Apple 诉讼:Apple 搞错了,纠正对其员工的指控并公布沟通记录 |
产品动态(来自 OpenAI 团队)
| 日期 | 动态 |
|---|---|
| 8-17 | Codex 现支持 GPT-5.6 Sol 1M token 上下文,可通过配置文件启用(非默认,官方提示已针对性能成本优化) |
| 8-15 | 多代理 v2 支持委托至任意模型(含 Luna),向自动模型选择迈进 |
| 8-15 | ChatGPT 新增测验功能与预订搜索 |
| 8-12 | Codex 登陆 Linux(Ubuntu、Debian、Fedora),支持并行代理、worktrees、diffs 等完整桌面体验 |
| 8-06 | 发布 Codex Security Review 研究预览,针对 PR 进行深度安全审查 |
| 日期 | 新闻 |
|---|---|
| 8-14 | 发布文本水印 FAQ,回应 EU AI Act 合规:水印不改变输出质量、无法追溯到特定用户或组织、不增加 token 成本 |
| 8-14 | 发布第二份风险报告,详述系统风险与应对准备 |
| 8-10 | 研究版 Claude 在黎曼假设相关问题上取得进展:将满足假设的 zeta 函数零点比例下界从 41.6% 提升至 67.2% |
| 8-04 | 回应英国 AISI 网络安全评估事件:Claude Mythos 5 与 GPT-5.6 Sol 在"故意宽松条件"下对真实目标进行了持续性活动,正在调查 |
Claude Code 更新
| 版本 | 日期 | 更新内容 |
|---|---|---|
| v2.1.233 | 8-14 | 新增 GitLab MR URL 支持 |
| v2.1.232 | 8-13 | 子代理 fork 模式默认启用,继承完整对话与 prompt cache,非队友代理在交互会话中后台运行 |
| v2.1.231 | 8-13 | 修复 MCP OAuth 登录重定向 URI 不匹配问题(如 Slack) |
| v2.1.228 | 8-11 | 修复交互会话因罕见布局错误停止重绘的问题 |
团队动态
| 日期 | 动态 |
|---|---|
| 8-13 | Boris Cherny 分享让 Claude 自动维护应用:每日运行崩溃检测、去重、死代码清理等例程,数周内提交 388 个 PR、合并 180 个 |
| 8-13 | Claude Code 桌面版新增自动继续选项,用量限制重置后自动恢复 |
| 日期 | 新闻 |
|---|---|
| 8-14 | Gemini 3.7 Flash 向 Pro/Ultra 用户开放,提升多步推理与准确性;Gemini Spark 亦切换至 3.7 Flash |
| 8-13 | Demis Hassabis 介绍 Gemini 3.7 Flash:软件工程、Web 开发与知识工作能力显著升级,引入价仅为原 3.6 Flash 的一半 |
| 8-13 | Google Sheets 推出 Sheets Canvas,将表格数据可视化 |
| 8-11 | 医疗 AI 系统 AMIE 展示实时临床视频问诊能力,为首个此类研究 |
| 8-11 | Gemini 月活用户达 10 亿,Gemma 模型家族下载量达 10 亿次 |
| 厂商 | 日期 | 新闻 |
|---|---|---|
| DeepSeek | 8-13 | 发布 DeepSeek Harness v0.1 开发者预览版,基于 Cordis 元框架的代理 harness,采用"一切皆插件"架构,MIT 开源 |
| Z.ai | 8-14 | 发布 GLM-5.3:主打代码与网络安全能力,基于 743B 基座模型后训练,在开源模型中树立网络安全新标准 |
| 日期 | 新闻 |
|---|---|
| 8-16 | Stripe 接近以超 70 亿美元收购 OpenRouter(Bloomberg 报道) |
| 8-13 | OpenAI Foundation 承诺 1 亿美元与 Common Health Coalition 合作,用 AI 帮助医护团队提升丙肝治愈率,首批覆盖 Alabama 等 4 州 |
本期无变动。
当前 Top 3(Artificial Analysis Intelligence):
当前 Top 3(LMArena Overall):
SWE-bench Verified 变化:
Terminal-Bench 2.0 变化:
当前 Top 3(Artificial Analysis Agentic):
当前 Top 3(Artificial Analysis Coding):
数据来源:Artificial Analysis (artificialanalysis.ai) · SWE-bench · Scale AI SEAL · Terminal-Bench · LMArena
OpenAI Ultrafast 模式标志着推理速度竞争进入新阶段:由 Cerebras 驱动的 GPT-5.6 Sol 达到 750 tokens/秒,这对需要高频调用的代理场景(如实时客服、交互式编程)有直接价值,但也意味着基础设施成本压力将持续向下游传导。
Anthropic 文本水印的推出是 EU AI Act 合规的现实样本:强调"不影响输出质量、不增加成本、无法追溯个人"的技术设计,反映出合规团队在透明度要求与用户隐私之间的平衡尝试——其他厂商将面临同样的合规路径。
Stripe 收购 OpenRouter 的消息(超 70 亿美元)显示 AI 路由层正在成为支付基础设施的战略节点:OpenRouter 作为统一接入多模型的中间件,其价值在于降低企业切换模型的摩擦成本,Stripe 此举意在将 AI 调用纳入其支付生态。