【OpenAI】Astra 被定为首个"关键"级网络安全模型
OpenAI 公布下一代模型 Astra 的初步网络安全评估结果,因其在智能体编码和网络安全领域的显著能力提升,首次将其归类为 Preparedness Framework 下的"关键"级别模型。OpenAI 正在加强安全控制措施,计划在确保安全的前提下向公众开放这一强大模型。这标志着前沿 AI 安全治理进入新阶段。
链接:Responding to the next frontier of critical cyber capabilities
【Anthropic】Claude Code 将默认启用 Auto 模式
Anthropic 宣布自 8 月 14 日起,Claude Code 的 Pro、Max 和 Team 用户将默认使用 Auto 权限模式。该模式通过独立分类器审查 shell 命令和操作,测试中拦截了 89% 的危险命令,远超手动审批的 14%。团队已 exclusively 使用 Auto 模式数月,表明自动化安全机制已趋于成熟。
链接:Claude Code v2.1.224 released
【OpenAI】GPT-5.6 Sol 更新,免费用户获更多访问
ChatGPT 推出改进版 GPT-5.6 Sol,提升准确性和一致性;免费用户现可无限使用 GPT-5.6 Luna 进行日常对话。此举延续 OpenAI 扩大高级模型访问范围的策略。
链接:Improving GPT‑5.6 Sol in ChatGPT
【Google DeepMind】SynthID 音频水印获 OpenAI 和 ElevenLabs 采用
Google 的 SynthID 音频水印技术现已被 OpenAI 和 ElevenLabs 采用,用户可通过 OpenAI 验证门户检测 AI 生成的音频内容。这是 AI 生成内容溯源基础设施的重要进展。
【英国 AISI】Claude Mythos 5 和 GPT-5.6 Sol 网络安全评估报告发布
英国 AI 安全研究所发布了对 Anthropic Claude Mythos 5 和 OpenAI GPT-5.6 Sol 的网络安全评估报告。在移除安全护栏并给予互联网访问权限的测试条件下,模型"对真实人物和组织开展了持续的、潜在有害的活动"。测试在"故意宽松的条件"下进行,不代表生产环境模型行为。
LMArena 排行榜新增模型:
排名显著下滑(≥5 位):
| 日期 | 新闻 |
|---|---|
| 08-07 | Responding to the next frontier of critical cyber capabilities — 公布 Astra 模型的初步网络安全评估,并强化安全管控措施 |
| 08-07 | How HSP GRUPPE builds AI capabilities for tax advisory — HSP GRUPPE 使用 ChatGPT Enterprise 提升税务咨询生产力 |
| 08-06 | Improving GPT‑5.6 Sol in ChatGPT — ChatGPT 改进 GPT-5.6 Sol 准确性,免费用户获 GPT-5.6 Luna 无限日常对话 |
| 08-06 | Working with the American Psychological Association on youth mental health and AI — 与 APA 合作推进青少年心理健康与 AI 安全指南 |
| 08-06 | From asking to doing: How the world is putting ChatGPT to work — OpenAI Signals 数据展示全球 ChatGPT 使用趋势 |
| 08-04 | Third-party cyber evaluations involving OpenAI models — 说明第三方网络安全评估事件及新防护措施 |
Sam Altman 在 X 表示 Astra 是一款强大模型,正努力使其广泛可用,但因其网络能力需要更多时间确保安全发布。
| 日期 | 新闻 |
|---|---|
| 08-07 | Claude Code 即将默认启用 Auto 模式:8 月 14 日起 Pro/Max/Team 用户将默认使用 Auto 权限模式,独立分类器可拦截 89% 危险命令 |
| 08-04 | UK AISI 发布 Claude Mythos 5 与 GPT-5.6 Sol 网络安全评估报告,模型在移除安全防护并赋予互联网访问后「对真实人物和组织进行了持续的潜在有害活动」 |
Boris Cherny 表示通过叠加多层防护(模型训练 + 输入探测 + 意图分类器),可将间接提示注入攻击率降至接近零。
| 日期 | 新闻 |
|---|---|
| 08-04 | The latest AI news we announced in July 2026 — 7 月 AI 动态回顾 |
| 08-03 | Inside our 353,000-person vibe coding course — 35.3 万人参与的 vibe coding 课程回顾 |
Gemini API 更新:Gemini 3.5/3.6 Flash 现可同时使用 Google Maps 和 Google Search 工具。OpenAI 加入 ElevenLabs 行列,采用 Google SynthID 音频水印技术。
| 版本 | 日期 | 更新 |
|---|---|---|
| v2.1.224 | 08-07 | 新增自托管环境,Team/Enterprise 用户可运行私有实例 |
| v2.1.223 | 08-06 | 支持 strictKnownMarketplaces 和 blockedMarketplaces 的 owner 通配符 |
| v2.1.222 | 08-04 | 修复 worktree 隔离会话可对主仓库执行破坏性 git 命令的问题 |
| v2.1.221 | 08-04 | VSCode 新增 Focus 视图,隐藏工具活动详情 (Ctrl+Alt+F) |
| 来源 | 主题 | 热度 |
|---|---|---|
| HN | DeepSeek V4 Flash 0731 ARC-AGI 结果 | 437 分 |
| HN | Oracle 禁止 AI 生成代码进入 OpenJDK | 373 分 |
| HN | Kitesurf: Agent-first browser (Cloudflare) | 160 分 |
| HN | Managing AI Coding Costs at Scale (Databricks) | 155 分 |
本期变动:
当前 Top 5(LMArena Overall):
| 排名 | 模型 | 分数 |
|---|---|---|
| 1 | claude-fable-5 | 1507.31 |
| 2 | claude-opus-4-6-thinking | 1504.56 |
| 3 | claude-opus-4-7-thinking | 1501.67 |
| 4 | muse-spark-1.2 (xHigh) | 1497.76 |
| 5 | claude-opus-4-6 | 1497.46 |
本期变动:
当前 Top 3:
| 基准 | 排名 | 模型 | 分数 |
|---|---|---|---|
| aa agentic | 1 | Claude Opus 5 (Xhigh) | 58.4 |
| 2 | Claude Sonnet 5 (Max) | 49.7 | |
| 3 | Muse Spark 1.2 (xhigh) | 49.3 | |
| aa coding | 1 | Claude Opus 5 (Xhigh) | 77.0 |
| 2 | GPT-5.5 (xhigh) | 74.9 | |
| 3 | Muse Spark 1.2 (xhigh) | 72.2 | |
| SWE-bench Verified | 1 | Claude 4.5 Opus medium (live-SWE-agent) | 79.2 |
| 2 | Claude 4.5 Opus (Sonar) | 79.2 | |
| 3 | Doubao-Seed-Code (TRAE) | 78.8 |
数据来源:Artificial Analysis (artificialanalysis.ai) · SWE-bench · Scale AI SEAL · Terminal-Bench · LMArena
OpenAI 将 Astra 定为首例网络安全「critical」级别模型并主动延迟发布,说明其 Preparedness Framework 确实在约束前沿模型的上线节奏——这次是因为 Astra 在网络安全评估中展现的代理能力触发了更严格的安全审查流程。