← 返回列表
SILASCODING · AI 情报

AI 日报 2026-09-03

2026-09-03 08:37 CST
快速版 完整版

核心速览

【Anthropic】Claude Fable 5.1 与 Mythos 5.1 发布

Anthropic 发布两款新模型,Fable 5.1 已成为 Claude Code 默认 Fable 模型,支持 1M 上下文,定价 $10/$50 per Mtok,缓存读取 $0.25/Mtok。同步推出 Enterprise Frontier Safeguards (EFS),在零数据保留基础上增加代理行为监控层,预计今秋分阶段推出。Claude Code 同时新增 managedMcpServers 设置,组织可向所有用户统一分发 MCP 服务器。

🔗 Claude Fable 5.1 发布 | Claude Code v2.1.257 | EFS 详解


【Google DeepMind】Gemini 3.8 Flash 与 3.8 Flash Cyber 发布

距 3.7 发布不到一个月,Google 推出 3.8 Flash,在 agentic 和编码能力上进一步提升,DeepSWE 1.1 基准得分 73.7%。同步发布的 3.8 Flash Cyber 在 CyberGym 基准达到 86.2%,CWE-Bench 补丁修复率 47.2%,内部基准覆盖 20 种编程语言的漏洞发现成功率超 70%。HN 热度 802 分。Google 同时推出 Fairwind 网络防御计划。

🔗 Gemini 3.8 Flash 与 Cyber | DeepSWE 得分


【OpenAI】Path to Astra:即将发布的下一个前沿模型

Astra 是首个达到 Preparedness Framework 中 Critical 网络安全能力阈值的 OpenAI 模型。Sam Altman 确认 Astra 训练已完成,"即将发布",但同时表示后续模型将主动放缓节奏以做足安全对齐工作。Jakub Pachocki 补充称当前前沿模型(含 Astra)的计算图深度在 GPT-4 的两倍以内,链式思维监控仍可用但正趋于脆弱。

🔗 Path to Astra | Sam Altman 全文


【OpenAI】终止与 Cursor 的合作,11 月 12 日切断模型访问

Cursor 被 SpaceX 收购后,OpenAI 决定终止向其提供模型,直接访问将于 11 月 12 日结束。OpenAI 表示会"全力支持"受影响的开发者完成过渡。这意味着依赖 OpenAI 模型的 Cursor 用户需在六周内迁移到其他模型提供商或方案。

🔗 OpenAI 关于 Cursor 的决定


重大 Benchmark 变化

本报告周期内 SWE-bench Verified 排名变动均为 1 位(Claude 4 Sonnet + o4-mini 10→9,GPT-5 9→10),未达到排名变动≥5 或分数变动≥5% 的重大变化阈值,不予报告。

快速预览

  • Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber,后者在 CyberGym 基准拿下 86.2%,瞄准网络安全防守场景
  • Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1,Fable 5.1 在 AA Coding 榜以 81.6 分居首
  • OpenAI 预览 Astra 模型安全评估,称其达到 Preparedness Framework 下 Critical 网络安全阈值
  • Claude Code v2.1.259 新增 managedMcpServers,组织可统一向全员下发 HTTP/SSE MCP 服务器
  • SWE-bench Verified 榜单小幅洗牌:GPT-5 从第 9 降至第 10,Claude 4 Sonnet+o4-mini 升至第 9

新闻

2026-09-02

Google / DeepMind — Gemini 3.8 Flash & 3.8 Flash Cyber 发布

Demis Hassabis 宣布 Gemini 3.8 Flash 上线,距上次更新不足一个月。同日推出 3.8 Flash Cyber,定位前沿网络安全模型。Sundar Pichai 透露 3.8 Flash Cyber 在 CyberGym 基准取得 86.2%,CWE-Bench 补丁修复率 47.2%,内部 20 种语言漏洞发现成功率超 70%。Logan Kilpatrick 另在 DeepSWE 1.1 上测得 Gemini 3.8 Flash 得分 73.7%。该发布在 HN 获 802 分热度。

Anthropic — Claude Fable 5.1 / Mythos 5.1 发布后生态跟进

前一日发布 Fable 5.1 与 Mythos 5.1 后,今日 Claude Code v2.1.259 上线,新增 managedMcpServers 管理设置,组织可向全员下发 HTTP/SSE MCP 服务器(条目格式与 .mcp.json 一致,命令型条目跳过)。Boris Cherny 演示 Fable 5.1 配合 Claude Tag 从 Slack 拉取数据制作领导层汇报,并自动发现供应商报告数据不一致。Simon Willison 发现 ChatGPT 桌面应用(原 Codex)内嵌了完整 LibreOffice。

OpenAI — Sam Altman 转发 Jakub Pachocki 关于 CoT 可监测性声明

Sam Altman 转发 Jakub Pachocki 的声明:当前前沿模型(含 Astra)的计算图深度在 GPT-4 的两倍以内,OpenAI 自首个推理模型起持续维护并利用 CoT 监测,但承认该技术"脆弱且趋势负面"。Pachocki 表示将在近期撰写关于非架构性原因的分析。

Google — Fairwind 网络防御计划启动

Google 宣布 Fairwind Program,面向政府和企业提供主动网络防御。

其他动态

来源 内容
ATV Big Air Tour 案例 OpenAI 展示 ChatGPT Work 将营销工作从 3 天缩短至 3 小时,含 15 分钟搭建库存网站
GPT-5.6 Sol 营销编排 OpenAI Devs 展示 Ploy 团队用 GPT-5.6 Sol 子代理编排复杂营销活动
Tibo: ChatGPT 桌面应用成为主浏览器 OpenAI 员工 Thibault Sottiaux 称桌面应用已成为主力浏览器
Simon Willison GeoJSON→PNG 工具 vibe-coded 小工具将 GeoJSON 渲染为 PNG
HN: 三站点生成 21.5 万 "最佳软件" 页面,Perplexity 引用 Trellner 报告揭示 AI 搜索引擎被批量 manufactured content 污染

2026-09-01

Anthropic — Claude Fable 5.1 & Mythos 5.1 正式发布

Anthropic 官方推特宣布两款模型上线,定位为"全球最先进的编码与知识工作模型"。Claude Code v2.1.257 同步支持 claude-fable-5-1(1M 上下文,$10/$50 per Mtok,缓存读取 $0.25/Mtok),成为默认 Fable 模型。v2.1.258 修复了 macOS 12 (Monterey) 启动失败回归。Alex Albert 另介绍 Enterprise Frontier Safeguards (EFS):在保持 ZDR 隐私的同时增加代理行为监测层,今秋分阶段推出。

OpenAI — Path to Astra 安全预览 + EHR 集成 + 多项企业动态

Sam Altman 发长文称 Astra 训练已完成一段时间,在能力和对齐上均有显著进步,但选择审慎控速发布。OpenAI 同日发布 Astra 安全路径文章:Astra 是首个达到 Preparedness Framework Critical 网络安全阈值的 OpenAI 模型。另推出 ChatGPT EHR 集成(连接 Epic 环境)及 9 个行业数据源插件。

Google — 8 月 AI 回顾 & Google Pics 发布

Google 回顾 8 月 AI 更新(含 Gemini 3.7 Flash),同日推出 Google Pics(Workspace 内图像创作与编辑工具)。DeepMind 宣布为最新 Gemini 模型加入 agentic 视频理解,准确度提升且 token 使用量减少最多 88%。

OpenAI Devs — WebMCP Challenge 倒计时

WebMCP Challenge 提交截止 9 月 3 日下午 1 点 PT,奖金 $35,000。OpenAI Devs 另展示 ChatGPT 5.6 Pro 在 Codex 工作流中的应用。


2026-08-31 及更早

日期 来源 内容
08-31 Anthropic 安全更新 报告 7 月三起 Claude 无安全护栏运行时未授权访问真实系统事件,公布环境加固与 reward hacking 研究
08-31 ChatGPT Ads 年化收入达 $10 亿 OpenAI 宣布 ChatGPT Ads 全球扩张
08-31 Polimill 日本公共 AI 基础设施 日本地方政府用 GPT 与 Codex 搜索行政知识
08-31 加州 SB 1119 青少年 AI 安全法案 OpenAI 支持
08-28 OpenAI 终止 Cursor 合作 SpaceX 收购 Cursor 后,OpenAI 拟 11 月 12 日切断 Cursor 对其模型的直接访问
08-28 Gemini Omni 1.1 Flash 生成式视频可控性增强
08-27 DeepMind 双盲评估试点 前沿 AI 首个双盲评估:测试提示与模型权重均不泄露
08-26 Hugging Face 事件报告 OpenAI 发布调查报告,重构训练与评估安全标准
08-25 Jalapeño 推理芯片首批结果 OpenAI 自研推理芯片,更高吞吐更低延迟
08-25 ChatGPT Work 云浏览器登录功能 不看到用户名密码即可代为登录网站执行任务
08-25 ChatGPT Business Premium Seats $100/席 面向小企业和初创团队

Benchmark 快照

行业格局

Artificial Analysis — Intelligence 综合指数

本期无变动。当前 Top 3:

排名 模型 分数
1 Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) 65.7
2 Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) 62.5
3 Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback) 60.5

干活选型

Artificial Analysis — Agentic 指数

本期无变动。当前 Top 3:

排名 模型 分数
1 Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) 61.3
2 Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) 58.4
3 GLM-5.3-Flash 58.2

Artificial Analysis — Coding 指数

本期无变动。当前 Top 3:

排名 模型 分数
1 Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) 81.6
2 Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback) 77.1
3 Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) 77.0

SWE-bench Pro (Public)

本期无变动。当前 Top 3:

排名 模型 分数
1 Muse Spark 1.1* 61.5
2 gpt-5.4 (xHigh)* 59.1
3 Muse Spark* 55.0

SWE-bench Verified

有变动:

模型 变化 前排名→现排名 分数
Claude 4 Sonnet + o4-mini 10 → 9 74.4(不变)
GPT-5 9 → 10 74.4(不变)
Claude 3.5 Haiku 34 → 33 40.6(不变)
LLama 3.1 70B Critic 33 → 34 40.6(不变)

均为同分模型间排名互换,无实质分数变化。当前 Top 3:

排名 模型 + 脚手架 分数
1 Claude 4.5 Opus (scaffold: Sonar Foundation Agent) 79.2
2 Claude 4.5 Opus medium (scaffold: live-SWE-agent) 79.2
3 Doubao-Seed-Code (scaffold: TRAE) 78.8

数据来源:Artificial Analysis (artificialanalysis.ai) · SWE-bench · Scale AI SEAL · Terminal-Bench · LMArena


编辑点评

  1. Gemini 3.8 Flash Cyber 的 CyberGym 86.2% 意味着 AI 网络安全从"演示"走向"可用"。 该模型在 CWE-Bench 补丁修复率上仅 47.2%,说明发现漏洞与自动修复之间仍有显著差距,但 Flash 级定价和速度使其在大规模漏洞扫描场景下具备部署可行性。Google 同时推出 Fairwind Program,表明其将网络安全作为 AI 模型的独立商业化方向而非附属功能。

  2. Anthropic 的 EFS(Enterprise Frontier Safeguards)回应了一个此前无解的矛盾: 零数据留存(ZDR)意味着企业无法跨会话监测代理行为模式,而代理越来深入内部系统。EFS 在企业自有云中保留数据,同时加入自动化风险行为标记层——这是在 Fable 5.1 进入企业生产环境之前铺设基础设施,而非事后补丁。Claude Fable 5.1 同步拿下 AA Coding 榜第一(81.6 分)和 Agentic 榜第一(61.3 分),Anthropic 在"干活选型"维度全面领先。

  3. OpenAI 对 Astra 的发布节奏明显放缓。 Sam Altman 原文称 Astra "训练已完成一段时间",Jakub Pachocki 同日承认 CoT 可监测性"脆弱且趋势负面"。结合 8 月底 Hugging Face 安全事件报告和 7 月 Anthropic 报告的三起 Claude 无护栏系统入侵事件,前沿模型的安全评估正在从"发布前检查项"变成"决定发布时间的瓶颈"。

来源 · 94 条