← 返回列表
SILASCODING · AI 情报

AI 日报 2026-09-19

2026-09-19 08:47 CST
快速版 完整版

核心速览

【Anthropic】Anthropic 与 Accenture 合资 10 亿美元嵌入独立 AI 评估 Anthropic 与 Accenture 合作,双方各出资至少 10 亿美元,在未来五年内建设前沿 AI 独立评估能力。这是 Anthropic 落实 Dario Amodei "We Must Pace the Frontier" 承诺的第一步——向第三方评估者提供员工级系统访问权限。此举可能成为前沿 AI 实验室接受常态化外部监督的行业范式,类似核电站驻厂检查员模式。 原文链接

【OpenAI】OpenAI 发布模型失对齐报告框架,同时公开 6 起异常行为案例 OpenAI 公布了模型失对齐(model misalignment)的追踪、调查和披露框架,设定公开披露的标准与时间线,并同步发布过去六个月训练和评估中观察到的 6 起失对齐行为报告。框架明确:即使尚未完全解释或缓解,也会按规定时间线披露。 原文链接

【CNN/HN】美军因 AI 幻觉情报报告险些引发误判 美国军方使用 AI 生成情报报告时出现幻觉,错误报告了涉及中国船只的情报,险些导致严重后果。该事件在 Hacker News 获得 380 点讨论,凸显 AI 在高风险军事决策场景中的可靠性风险仍未解决。 原文链接

【Anthropic】Anthropic 发布 AI 发展速度三项度量指标 Anthropic 发布三项内部指标:AI 研发中由 AI 完成的比例、AI 代理的监督程度、算力分配方式,并公开当前快照数据。Anthropic 呼吁所有前沿实验室发布相同指标,第三方可验证,以缩小实验室与公众之间的信息差。 原文链接

【Google DeepMind】DeepMind 成立研究所,聚焦 AGI 社会影响 Shane Legg 宣布成立 DeepMind Institute,基于其 25 年 AGI 研究经验,旨在加深对 AGI 即将到来所带来的技术与社会影响的理解。同时发布关于推理透明性的论文,主张有意保留 Chain of Thought 的可监控性。 原文链接

重大 Benchmark 变化

本周 SWE-bench Verified 排名仅有微小变动(Claude 4 Sonnet + o4-mini 从第 10 升至第 9,GPT-5 从第 9 降至第 10,分数均未变化),不满足排名变动≥5 或分数变动≥5% 的报告阈值,本周无重大 benchmark 变化。

快速预览

  • Anthropic 与 Accenture 合资 10 亿美元,五年内嵌入独立 AI 评估团队
  • OpenAI 推出 Astra for Law,含 26 个合作方插件、47 个社区插件,主打法律数据隐私
  • Claude Code v2.1.277 新增 AGENTS.md 支持,无 CLAUDE.md 时自动读取
  • 美军因 AI 生成虚假情报报告险些引发误判,HN 热度 380 分
  • ChatGPT 桌面应用支持 Chrome 扩展,企业管理员可集中部署

新闻

Anthropic

日期 标题 摘要
09-18 Anthropic 与 Accenture 合作独立评估前沿 AI 双方预计未来五年各投至少 10 亿美元建设独立评估能力,评估人员常驻 Anthropic 内部
09-17 发布 AI 发展速度三项测量指标 量化"AI 研发中由 AI 完成的比例""AI 代理监督质量""算力分配",呼吁全行业公开同类数据
09-17 生命科学验证计划开放申请,首次开放 Mythos 模型 面向学术实验室至药企,配备新生物安全防护机制;后续扩展至 Pro/Max 个人用户
09-12 转推 Dario Amodei《We Must Pace the Frontier》 Anthropic 单方面承诺第一步:向第三方评估者提供常驻员工级系统访问权限
09-10 发布迄今最详细威胁情报报告 涵盖网络攻击、影响力操作、监控、生物、武器制造五类 Claude 误用案例,全部已被阻断

OpenAI

日期 标题 摘要
09-17 Introducing Astra for Law 面向律所的 GPT-6 Astra 定制方案,含数据隐私、26 个合作方插件、47 个社区插件
09-17 Cooley 用 ChatGPT 加速 IPO 工作 Cooley 基于 ChatGPT Work 构建 GO Public,帮助律师更早发现 IPO 流程中的问题
09-16 发布模型失对齐报告框架 设定公开披露标准与时间线,同时发布六份过去半年观察到的失对齐行为报告
09-16 重新构想 AI 广告 推出 Sponsored Agents、营销工具,集成 HubSpot 和 Shopify
09-16 Hex 用 GPT-6 Astra 将复杂数据分析转为可视化报告 数据代理可将分析结果输出为交互式可视化
09-16 ChatGPT 用量如何连接业务价值 ChatGPT Work 和 Codex 分析功能帮助团队理解 AI 使用与支出
09-16 工人如何解锁新型工作方式 经济研究报告展示 AI 如何让工人承担传统角色之外的新活动
09-16 帮助老年人用 AI OpenAI 与 AARP 在美国 10 个城市为 1000 名老年人提供免费 ChatGPT 工作坊
09-14 Perplexity 用 GPT-6 Astra 运行端到端系统 Perplexity 用 Astra 写沟通、改代码、监控生产系统,检查频率大幅降低
09-14 Fyxer 用 OpenAI 模型打造 AI 高管助理 利用微调、记忆和用户反馈,按用户个人风格整理收件箱和起草邮件
09-11 Cognition 用 GPT-6 Astra 让 Devin 测试自身工作 目标是减少工程师代码审查时间、提高交付量
09-11 为超过 10 亿 ChatGPT 用户快速扩展在线存储 Habitat 从 Python 库演变为全球分布式存储平台,承载 2200 万 QPS
09-10 推出 Agents API 基于 Codex harness 的托管云代理服务,支持长会话和工具使用
09-10 推出 API 中的 GPT-Live-1 全双工语音对话,支持指令跟随、自定义语音和电话集成
09-10 ChatGPT Work 推出 Data 代理 连接企业数据源,用自然语言生成洞察和交互式仪表板
09-10 推出 ChatGPT for Financial Services 内置金融数据 + GPT-6 Astra,用于研究、建模和客户材料
09-10 扩大面向美国各级政府的 AI 访问与网络防御 与 GSA 合作,提供 0 美元许可费、50% 折扣用量和扩展网络防御支持
09-09 GPT-6 Astra 发布 OpenAI 面向企业的最强模型,支持高级推理、计算机使用和更强的写作与设计判断
09-09 Paul Christiano 加入 OpenAI Foundation 董事会 同时加入安全与安全委员会,并担任 OpenAI Group PBC 董事会无投票权观察员
09-09 AI 政策窗口已打开 Chris Lehane 呼吁在政策窗口仍开放时推动安全标准与政策行动

OpenAI Developers

日期 标题 摘要
09-18 ChatGPT 桌面应用支持 Chrome 扩展 可安装、固定和使用扩展(如 1Password);企业管理员可集中部署
09-18 插件多账号支持上线 可在工作与个人账号间跨插件连接上下文,开发者无需额外适配
09-18 GPT-6 Astra Challenge 登陆 Product Hunt 超过 800 个产品参赛竞争排行榜和奖品
09-18 预告:ChatGPT 自定义通知音效即将上线 Brent Traut 透露下周随 Sam Altman "大发布"推出
09-17 Codex 语音代理上线,由 GPT-Live-1 驱动 可从手机连接电脑端的 Codex 语音代理

Claude Code

日期 版本 变更
09-18 v2.1.277 新增 AGENTS.md 支持:无 CLAUDE.md 时自动读取 AGENTS.md,可在 /config 切换(Bedrock/Vertex/Foundry 暂不支持)
09-18 v2.1.276 修复 2.1.275 回归 bug:ANTHROPIC_BASE_URL 指向代理时所有请求 400 报错
09-17 v2.1.275 网关登录增加已登录账号确认;/status 显示当前账号
09-17 v2.1.274 内存临界时显示可见警告并给出释放/重启指引
09-15 v2.1.273 新增 5 个 LLM 网关请求头(需 CLAUDE_CODE_GATEWAY_HINT_HEADERS=1 开启)

Anthropic 个人动态

日期 人物 内容
09-17 Mike Krieger Claude Projects 上线:Claude 自动拆分线程、并行云端会话、跨线程传上下文
09-17 Boris Cherny 转推 Ethan Mollick:Projects 可编排多层级代理团队,实测生成 18 个并行线程解决历史谜题
09-16 Alex Albert Claude Cowork 与 chat 合并:统一体验,Claude Docs/Slides/Design 随 Artifacts 平台改版上线
09-16 Mike Krieger Claude Docs/Slides/Design 全面上线

Google / DeepMind

日期 标题 摘要
09-18 Google AI & Economy 团队引入新专家 扩充 AI 与经济研究项目
09-18 与 Google 共创时尚未来 Jane Wade 和 Sergio Hudson 参与 Google Flow 时尚项目
09-17 让全球数据更易探索 联合国系统数据共享平台上线
09-16 DeepMind Institute 成立 Shane Legg 发起,研究 AGI 临近时的技术与社会影响
09-16 Demis Hassabis 获 RSA Albert Medal 演讲强调人文社科在 AGI 时代的重要性
09-16 呼吁保留推理可监视性 Anca Dragan 与 Rohin Shah 合著文章,主张有意保留 CoT 以确保可审计性

行业人物与社区

日期 人物 内容
09-18 swyx 转推 Jev 发布:ChatGPT 联合发明人 Diogo Almeida 隐身两年后推出新模型 Jev,号称 20-200x 更快、40-400x 更便宜
09-18 gdb 称插件多账号支持是连接上下文的关键小功能
09-16 Sam Altman 本周重点发布推迟至下周,称"值得等待"
09-14 Sam Altman 阐述 AI 进展两大风险:失去对未来的控制、权力过度集中
09-12 Karpathy 支持 Dario Amodei 的前沿减速计划
09-18 Simon Willison 比喻:拒绝关注 LLM 的计算机科学家如同拒绝关注刚开放的侏罗纪公园的遗传学家

HN 热帖

日期 标题 热度
09-18 Claude Code 无 CLAUDE.md 时读取 AGENTS.md 476 分
09-18 美军因 AI 生成虚假情报报告险些误判 380 分
09-17 How to Write with an LLM 371 分
09-18 Cactus Needle 3:8-29MB 自动化模型可匹敌 DeepSeek V4 Flash 159 分

Benchmark 快照

行业格局

Artificial Analysis — 综合智能

排名 模型 分数
1 Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) 53.4
2 GPT-6 Astra (max) 52.8
3 GPT-6 Astra (xhigh) 52.5
4 Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) 49.7
5 Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback) 49.1

LMArena — 总体

排名 模型 分数
1 claude-fable-5 1505.68
2 claude-opus-4-6-high 1504.56
3 claude-opus-4-7-high 1501.75

干活选型

Artificial Analysis — Agentic

排名 模型 分数
1 Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) 58.0
2 Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) 55.5
3 GPT-6 Astra (max) 51.5

Artificial Analysis — Coding

排名 模型 分数
1 Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) 81.6
2 Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback) 77.1
3 Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) 77.0

SWE-bench Pro (Public)

排名 模型 分数
1 Muse Spark 1.1* 61.5
2 gpt-5.4 (xHigh)* 59.1
3 Muse Spark* 55.0

SWE-bench Verified

排名 模型 分数
1 Claude 4.5 Opus (scaffold: Sonar Foundation Agent) 79.2
2 Claude 4.5 Opus medium (scaffold: live-SWE-agent) 79.2
3 Doubao-Seed-Code (scaffold: TRAE) 78.8

本期变动 — SWE-bench Verified

模型 变化类型 前排名 → 现排名 分数
Claude 3.5 Haiku 排名上升 34 → 33 40.6(不变)
Claude 4 Sonnet + o4-mini 排名上升 10 → 9 74.4(不变)
GPT-5 排名下降 9 → 10 74.4(不变)
LLama 3.1 70B Critic 排名下降 33 → 34 40.6(不变)

注:以上四项均为同分排名微调,分数未变。

数据来源:Artificial Analysis (artificialanalysis.ai) · SWE-bench · Scale AI SEAL · Terminal-Bench · LMArena


编辑点评

  1. Anthropic 与 Accenture 的 10 亿美元独立评估合作——这是 Dario Amodei 9 月 12 日提出"嵌入评估者"承诺后的首笔大规模落地协议,双方各投至少 10 亿美元、五年周期,评估人员将获得"常驻员工级系统访问权限",这意味着第三方可以实时审计模型训练过程而非仅审查发布后产物,在当前前沿实验室中尚属首次。

  2. OpenAI 发布模型失对齐报告框架并附带六份案例——框架明确要求"即使尚未完全解释或缓解也须按时间线披露",且优先发布揭示新失对齐机制或挑战安全假设的案例。这在行业内首次将失对齐事件的披露制度化,比此前各实验室零散发布安全博文更具结构性约束力。

  3. 美军因 AI 生成虚假情报报告险些误判(CNN/HN 380 分)——具体细节为 AI 生成了一份关于中国船只的虚假情报报告并险些引发军事反应,说明当前 LLM 幻觉问题在高风险情报场景中的后果已不限于技术讨论层面,而是直接触及国防决策链路。

来源 · 116 条