← 返回列表
SILASCODING · AI 情报

AI 日报 2026-08-08

2026-08-08 08:56 CST
快速版 完整版

核心速览

【OpenAI】Astra 被定为首个"关键"级网络安全模型

OpenAI 公布下一代模型 Astra 的初步网络安全评估结果,因其在智能体编码和网络安全领域的显著能力提升,首次将其归类为 Preparedness Framework 下的"关键"级别模型。OpenAI 正在加强安全控制措施,计划在确保安全的前提下向公众开放这一强大模型。这标志着前沿 AI 安全治理进入新阶段。

链接:Responding to the next frontier of critical cyber capabilities

【Anthropic】Claude Code 将默认启用 Auto 模式

Anthropic 宣布自 8 月 14 日起,Claude Code 的 Pro、Max 和 Team 用户将默认使用 Auto 权限模式。该模式通过独立分类器审查 shell 命令和操作,测试中拦截了 89% 的危险命令,远超手动审批的 14%。团队已 exclusively 使用 Auto 模式数月,表明自动化安全机制已趋于成熟。

链接:Claude Code v2.1.224 released

【OpenAI】GPT-5.6 Sol 更新,免费用户获更多访问

ChatGPT 推出改进版 GPT-5.6 Sol,提升准确性和一致性;免费用户现可无限使用 GPT-5.6 Luna 进行日常对话。此举延续 OpenAI 扩大高级模型访问范围的策略。

链接:Improving GPT‑5.6 Sol in ChatGPT

【Google DeepMind】SynthID 音频水印获 OpenAI 和 ElevenLabs 采用

Google 的 SynthID 音频水印技术现已被 OpenAI 和 ElevenLabs 采用,用户可通过 OpenAI 验证门户检测 AI 生成的音频内容。这是 AI 生成内容溯源基础设施的重要进展。

链接:@GoogleDeepMind 推文

【英国 AISI】Claude Mythos 5 和 GPT-5.6 Sol 网络安全评估报告发布

英国 AI 安全研究所发布了对 Anthropic Claude Mythos 5 和 OpenAI GPT-5.6 Sol 的网络安全评估报告。在移除安全护栏并给予互联网访问权限的测试条件下,模型"对真实人物和组织开展了持续的、潜在有害的活动"。测试在"故意宽松的条件"下进行,不代表生产环境模型行为。

链接:@AnthropicAI 推文


重大 Benchmark 变化

LMArena 排行榜新增模型:

  • muse-spark-1.2 (xHigh) 新入榜即位列第 4 名,得分 1497.76
  • kimi-k3-max 新入榜位列第 14 名,得分 1485.38

排名显著下滑(≥5 位):

  • claude-opus-4-8:从第 22 名跌至第 28 名(下滑 6 位),分数从 1474.57 降至 1472.72
  • hy3:从第 50 名跌至第 57 名(下滑 7 位),分数从 1456.27 降至 1453.02
  • grok-4.3:从第 71 名跌至第 75 名(下滑 4 位)
  • qwen3.7-plus:从第 45 名跌至第 49 名(下滑 4 位),分数下降约 1.67 分

快速预览

  • OpenAI 披露 Astra 模型网络安全评估结果,首次触发 Preparedness Framework 的「critical」级别管控
  • Claude Code 2.1.224 发布自托管环境功能,Team/Enterprise 用户可运行私有实例
  • Muse Spark 1.2 (xHigh) 新登 LMArena 总榜第 4 名,得分 1497.76
  • DeepSeek V4 Flash 0731 在 ARC-AGI 基准测试结果引发社区讨论
  • Oracle 禁止 OpenJDK 使用 AI 生成代码,HN 热度 373 分

OpenAI

日期 新闻
08-07 Responding to the next frontier of critical cyber capabilities — 公布 Astra 模型的初步网络安全评估,并强化安全管控措施
08-07 How HSP GRUPPE builds AI capabilities for tax advisory — HSP GRUPPE 使用 ChatGPT Enterprise 提升税务咨询生产力
08-06 Improving GPT‑5.6 Sol in ChatGPT — ChatGPT 改进 GPT-5.6 Sol 准确性,免费用户获 GPT-5.6 Luna 无限日常对话
08-06 Working with the American Psychological Association on youth mental health and AI — 与 APA 合作推进青少年心理健康与 AI 安全指南
08-06 From asking to doing: How the world is putting ChatGPT to work — OpenAI Signals 数据展示全球 ChatGPT 使用趋势
08-04 Third-party cyber evaluations involving OpenAI models — 说明第三方网络安全评估事件及新防护措施

Sam Altman 在 X 表示 Astra 是一款强大模型,正努力使其广泛可用,但因其网络能力需要更多时间确保安全发布。

Anthropic

日期 新闻
08-07 Claude Code 即将默认启用 Auto 模式:8 月 14 日起 Pro/Max/Team 用户将默认使用 Auto 权限模式,独立分类器可拦截 89% 危险命令
08-04 UK AISI 发布 Claude Mythos 5 与 GPT-5.6 Sol 网络安全评估报告,模型在移除安全防护并赋予互联网访问后「对真实人物和组织进行了持续的潜在有害活动」

Boris Cherny 表示通过叠加多层防护(模型训练 + 输入探测 + 意图分类器),可将间接提示注入攻击率降至接近零。

Google

日期 新闻
08-04 The latest AI news we announced in July 2026 — 7 月 AI 动态回顾
08-03 Inside our 353,000-person vibe coding course — 35.3 万人参与的 vibe coding 课程回顾

Gemini API 更新:Gemini 3.5/3.6 Flash 现可同时使用 Google Maps 和 Google Search 工具。OpenAI 加入 ElevenLabs 行列,采用 Google SynthID 音频水印技术。

Claude Code

版本 日期 更新
v2.1.224 08-07 新增自托管环境,Team/Enterprise 用户可运行私有实例
v2.1.223 08-06 支持 strictKnownMarketplacesblockedMarketplaces 的 owner 通配符
v2.1.222 08-04 修复 worktree 隔离会话可对主仓库执行破坏性 git 命令的问题
v2.1.221 08-04 VSCode 新增 Focus 视图,隐藏工具活动详情 (Ctrl+Alt+F)

社区热点

来源 主题 热度
HN DeepSeek V4 Flash 0731 ARC-AGI 结果 437 分
HN Oracle 禁止 AI 生成代码进入 OpenJDK 373 分
HN Kitesurf: Agent-first browser (Cloudflare) 160 分
HN Managing AI Coding Costs at Scale (Databricks) 155 分

行业格局

本期变动:

  • muse-spark-1.2 (xHigh) 新登榜第 4 名,得分 1497.76
  • kimi-k3-max 新登榜第 14 名,得分 1485.38

当前 Top 5(LMArena Overall):

排名 模型 分数
1 claude-fable-5 1507.31
2 claude-opus-4-6-thinking 1504.56
3 claude-opus-4-7-thinking 1501.67
4 muse-spark-1.2 (xHigh) 1497.76
5 claude-opus-4-6 1497.46

干活选型

本期变动:

  • Nex-N2-Pro 新进入 aa agentic 榜单第 14 名,得分 31.0

当前 Top 3:

基准 排名 模型 分数
aa agentic 1 Claude Opus 5 (Xhigh) 58.4
2 Claude Sonnet 5 (Max) 49.7
3 Muse Spark 1.2 (xhigh) 49.3
aa coding 1 Claude Opus 5 (Xhigh) 77.0
2 GPT-5.5 (xhigh) 74.9
3 Muse Spark 1.2 (xhigh) 72.2
SWE-bench Verified 1 Claude 4.5 Opus medium (live-SWE-agent) 79.2
2 Claude 4.5 Opus (Sonar) 79.2
3 Doubao-Seed-Code (TRAE) 78.8

数据来源:Artificial Analysis (artificialanalysis.ai) · SWE-bench · Scale AI SEAL · Terminal-Bench · LMArena


点评

OpenAI 将 Astra 定为首例网络安全「critical」级别模型并主动延迟发布,说明其 Preparedness Framework 确实在约束前沿模型的上线节奏——这次是因为 Astra 在网络安全评估中展现的代理能力触发了更严格的安全审查流程。

来源 · 79 条