【Anthropic】Anthropic 与 Accenture 合资 10 亿美元嵌入独立 AI 评估 Anthropic 与 Accenture 合作,双方各出资至少 10 亿美元,在未来五年内建设前沿 AI 独立评估能力。这是 Anthropic 落实 Dario Amodei "We Must Pace the Frontier" 承诺的第一步——向第三方评估者提供员工级系统访问权限。此举可能成为前沿 AI 实验室接受常态化外部监督的行业范式,类似核电站驻厂检查员模式。 原文链接
【OpenAI】OpenAI 发布模型失对齐报告框架,同时公开 6 起异常行为案例 OpenAI 公布了模型失对齐(model misalignment)的追踪、调查和披露框架,设定公开披露的标准与时间线,并同步发布过去六个月训练和评估中观察到的 6 起失对齐行为报告。框架明确:即使尚未完全解释或缓解,也会按规定时间线披露。 原文链接
【CNN/HN】美军因 AI 幻觉情报报告险些引发误判 美国军方使用 AI 生成情报报告时出现幻觉,错误报告了涉及中国船只的情报,险些导致严重后果。该事件在 Hacker News 获得 380 点讨论,凸显 AI 在高风险军事决策场景中的可靠性风险仍未解决。 原文链接
【Anthropic】Anthropic 发布 AI 发展速度三项度量指标 Anthropic 发布三项内部指标:AI 研发中由 AI 完成的比例、AI 代理的监督程度、算力分配方式,并公开当前快照数据。Anthropic 呼吁所有前沿实验室发布相同指标,第三方可验证,以缩小实验室与公众之间的信息差。 原文链接
【Google DeepMind】DeepMind 成立研究所,聚焦 AGI 社会影响 Shane Legg 宣布成立 DeepMind Institute,基于其 25 年 AGI 研究经验,旨在加深对 AGI 即将到来所带来的技术与社会影响的理解。同时发布关于推理透明性的论文,主张有意保留 Chain of Thought 的可监控性。 原文链接
本周 SWE-bench Verified 排名仅有微小变动(Claude 4 Sonnet + o4-mini 从第 10 升至第 9,GPT-5 从第 9 降至第 10,分数均未变化),不满足排名变动≥5 或分数变动≥5% 的报告阈值,本周无重大 benchmark 变化。
| 日期 | 标题 | 摘要 |
|---|---|---|
| 09-18 | Anthropic 与 Accenture 合作独立评估前沿 AI | 双方预计未来五年各投至少 10 亿美元建设独立评估能力,评估人员常驻 Anthropic 内部 |
| 09-17 | 发布 AI 发展速度三项测量指标 | 量化"AI 研发中由 AI 完成的比例""AI 代理监督质量""算力分配",呼吁全行业公开同类数据 |
| 09-17 | 生命科学验证计划开放申请,首次开放 Mythos 模型 | 面向学术实验室至药企,配备新生物安全防护机制;后续扩展至 Pro/Max 个人用户 |
| 09-12 | 转推 Dario Amodei《We Must Pace the Frontier》 | Anthropic 单方面承诺第一步:向第三方评估者提供常驻员工级系统访问权限 |
| 09-10 | 发布迄今最详细威胁情报报告 | 涵盖网络攻击、影响力操作、监控、生物、武器制造五类 Claude 误用案例,全部已被阻断 |
| 日期 | 标题 | 摘要 |
|---|---|---|
| 09-17 | Introducing Astra for Law | 面向律所的 GPT-6 Astra 定制方案,含数据隐私、26 个合作方插件、47 个社区插件 |
| 09-17 | Cooley 用 ChatGPT 加速 IPO 工作 | Cooley 基于 ChatGPT Work 构建 GO Public,帮助律师更早发现 IPO 流程中的问题 |
| 09-16 | 发布模型失对齐报告框架 | 设定公开披露标准与时间线,同时发布六份过去半年观察到的失对齐行为报告 |
| 09-16 | 重新构想 AI 广告 | 推出 Sponsored Agents、营销工具,集成 HubSpot 和 Shopify |
| 09-16 | Hex 用 GPT-6 Astra 将复杂数据分析转为可视化报告 | 数据代理可将分析结果输出为交互式可视化 |
| 09-16 | ChatGPT 用量如何连接业务价值 | ChatGPT Work 和 Codex 分析功能帮助团队理解 AI 使用与支出 |
| 09-16 | 工人如何解锁新型工作方式 | 经济研究报告展示 AI 如何让工人承担传统角色之外的新活动 |
| 09-16 | 帮助老年人用 AI | OpenAI 与 AARP 在美国 10 个城市为 1000 名老年人提供免费 ChatGPT 工作坊 |
| 09-14 | Perplexity 用 GPT-6 Astra 运行端到端系统 | Perplexity 用 Astra 写沟通、改代码、监控生产系统,检查频率大幅降低 |
| 09-14 | Fyxer 用 OpenAI 模型打造 AI 高管助理 | 利用微调、记忆和用户反馈,按用户个人风格整理收件箱和起草邮件 |
| 09-11 | Cognition 用 GPT-6 Astra 让 Devin 测试自身工作 | 目标是减少工程师代码审查时间、提高交付量 |
| 09-11 | 为超过 10 亿 ChatGPT 用户快速扩展在线存储 | Habitat 从 Python 库演变为全球分布式存储平台,承载 2200 万 QPS |
| 09-10 | 推出 Agents API | 基于 Codex harness 的托管云代理服务,支持长会话和工具使用 |
| 09-10 | 推出 API 中的 GPT-Live-1 | 全双工语音对话,支持指令跟随、自定义语音和电话集成 |
| 09-10 | ChatGPT Work 推出 Data 代理 | 连接企业数据源,用自然语言生成洞察和交互式仪表板 |
| 09-10 | 推出 ChatGPT for Financial Services | 内置金融数据 + GPT-6 Astra,用于研究、建模和客户材料 |
| 09-10 | 扩大面向美国各级政府的 AI 访问与网络防御 | 与 GSA 合作,提供 0 美元许可费、50% 折扣用量和扩展网络防御支持 |
| 09-09 | GPT-6 Astra 发布 | OpenAI 面向企业的最强模型,支持高级推理、计算机使用和更强的写作与设计判断 |
| 09-09 | Paul Christiano 加入 OpenAI Foundation 董事会 | 同时加入安全与安全委员会,并担任 OpenAI Group PBC 董事会无投票权观察员 |
| 09-09 | AI 政策窗口已打开 | Chris Lehane 呼吁在政策窗口仍开放时推动安全标准与政策行动 |
| 日期 | 标题 | 摘要 |
|---|---|---|
| 09-18 | ChatGPT 桌面应用支持 Chrome 扩展 | 可安装、固定和使用扩展(如 1Password);企业管理员可集中部署 |
| 09-18 | 插件多账号支持上线 | 可在工作与个人账号间跨插件连接上下文,开发者无需额外适配 |
| 09-18 | GPT-6 Astra Challenge 登陆 Product Hunt | 超过 800 个产品参赛竞争排行榜和奖品 |
| 09-18 | 预告:ChatGPT 自定义通知音效即将上线 | Brent Traut 透露下周随 Sam Altman "大发布"推出 |
| 09-17 | Codex 语音代理上线,由 GPT-Live-1 驱动 | 可从手机连接电脑端的 Codex 语音代理 |
| 日期 | 版本 | 变更 |
|---|---|---|
| 09-18 | v2.1.277 | 新增 AGENTS.md 支持:无 CLAUDE.md 时自动读取 AGENTS.md,可在 /config 切换(Bedrock/Vertex/Foundry 暂不支持) |
| 09-18 | v2.1.276 | 修复 2.1.275 回归 bug:ANTHROPIC_BASE_URL 指向代理时所有请求 400 报错 |
| 09-17 | v2.1.275 | 网关登录增加已登录账号确认;/status 显示当前账号 |
| 09-17 | v2.1.274 | 内存临界时显示可见警告并给出释放/重启指引 |
| 09-15 | v2.1.273 | 新增 5 个 LLM 网关请求头(需 CLAUDE_CODE_GATEWAY_HINT_HEADERS=1 开启) |
| 日期 | 人物 | 内容 |
|---|---|---|
| 09-17 | Mike Krieger | Claude Projects 上线:Claude 自动拆分线程、并行云端会话、跨线程传上下文 |
| 09-17 | Boris Cherny | 转推 Ethan Mollick:Projects 可编排多层级代理团队,实测生成 18 个并行线程解决历史谜题 |
| 09-16 | Alex Albert | Claude Cowork 与 chat 合并:统一体验,Claude Docs/Slides/Design 随 Artifacts 平台改版上线 |
| 09-16 | Mike Krieger | Claude Docs/Slides/Design 全面上线 |
| 日期 | 标题 | 摘要 |
|---|---|---|
| 09-18 | Google AI & Economy 团队引入新专家 | 扩充 AI 与经济研究项目 |
| 09-18 | 与 Google 共创时尚未来 | Jane Wade 和 Sergio Hudson 参与 Google Flow 时尚项目 |
| 09-17 | 让全球数据更易探索 | 联合国系统数据共享平台上线 |
| 09-16 | DeepMind Institute 成立 | Shane Legg 发起,研究 AGI 临近时的技术与社会影响 |
| 09-16 | Demis Hassabis 获 RSA Albert Medal | 演讲强调人文社科在 AGI 时代的重要性 |
| 09-16 | 呼吁保留推理可监视性 | Anca Dragan 与 Rohin Shah 合著文章,主张有意保留 CoT 以确保可审计性 |
| 日期 | 人物 | 内容 |
|---|---|---|
| 09-18 | swyx | 转推 Jev 发布:ChatGPT 联合发明人 Diogo Almeida 隐身两年后推出新模型 Jev,号称 20-200x 更快、40-400x 更便宜 |
| 09-18 | gdb | 称插件多账号支持是连接上下文的关键小功能 |
| 09-16 | Sam Altman | 本周重点发布推迟至下周,称"值得等待" |
| 09-14 | Sam Altman | 阐述 AI 进展两大风险:失去对未来的控制、权力过度集中 |
| 09-12 | Karpathy | 支持 Dario Amodei 的前沿减速计划 |
| 09-18 | Simon Willison | 比喻:拒绝关注 LLM 的计算机科学家如同拒绝关注刚开放的侏罗纪公园的遗传学家 |
| 日期 | 标题 | 热度 |
|---|---|---|
| 09-18 | Claude Code 无 CLAUDE.md 时读取 AGENTS.md | 476 分 |
| 09-18 | 美军因 AI 生成虚假情报报告险些误判 | 380 分 |
| 09-17 | How to Write with an LLM | 371 分 |
| 09-18 | Cactus Needle 3:8-29MB 自动化模型可匹敌 DeepSeek V4 Flash | 159 分 |
Artificial Analysis — 综合智能
| 排名 | 模型 | 分数 |
|---|---|---|
| 1 | Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) | 53.4 |
| 2 | GPT-6 Astra (max) | 52.8 |
| 3 | GPT-6 Astra (xhigh) | 52.5 |
| 4 | Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) | 49.7 |
| 5 | Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback) | 49.1 |
LMArena — 总体
| 排名 | 模型 | 分数 |
|---|---|---|
| 1 | claude-fable-5 | 1505.68 |
| 2 | claude-opus-4-6-high | 1504.56 |
| 3 | claude-opus-4-7-high | 1501.75 |
Artificial Analysis — Agentic
| 排名 | 模型 | 分数 |
|---|---|---|
| 1 | Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) | 58.0 |
| 2 | Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) | 55.5 |
| 3 | GPT-6 Astra (max) | 51.5 |
Artificial Analysis — Coding
| 排名 | 模型 | 分数 |
|---|---|---|
| 1 | Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) | 81.6 |
| 2 | Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback) | 77.1 |
| 3 | Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) | 77.0 |
SWE-bench Pro (Public)
| 排名 | 模型 | 分数 |
|---|---|---|
| 1 | Muse Spark 1.1* | 61.5 |
| 2 | gpt-5.4 (xHigh)* | 59.1 |
| 3 | Muse Spark* | 55.0 |
SWE-bench Verified
| 排名 | 模型 | 分数 |
|---|---|---|
| 1 | Claude 4.5 Opus (scaffold: Sonar Foundation Agent) | 79.2 |
| 2 | Claude 4.5 Opus medium (scaffold: live-SWE-agent) | 79.2 |
| 3 | Doubao-Seed-Code (scaffold: TRAE) | 78.8 |
本期变动 — SWE-bench Verified
| 模型 | 变化类型 | 前排名 → 现排名 | 分数 |
|---|---|---|---|
| Claude 3.5 Haiku | 排名上升 | 34 → 33 | 40.6(不变) |
| Claude 4 Sonnet + o4-mini | 排名上升 | 10 → 9 | 74.4(不变) |
| GPT-5 | 排名下降 | 9 → 10 | 74.4(不变) |
| LLama 3.1 70B Critic | 排名下降 | 33 → 34 | 40.6(不变) |
注:以上四项均为同分排名微调,分数未变。
数据来源:Artificial Analysis (artificialanalysis.ai) · SWE-bench · Scale AI SEAL · Terminal-Bench · LMArena
Anthropic 与 Accenture 的 10 亿美元独立评估合作——这是 Dario Amodei 9 月 12 日提出"嵌入评估者"承诺后的首笔大规模落地协议,双方各投至少 10 亿美元、五年周期,评估人员将获得"常驻员工级系统访问权限",这意味着第三方可以实时审计模型训练过程而非仅审查发布后产物,在当前前沿实验室中尚属首次。
OpenAI 发布模型失对齐报告框架并附带六份案例——框架明确要求"即使尚未完全解释或缓解也须按时间线披露",且优先发布揭示新失对齐机制或挑战安全假设的案例。这在行业内首次将失对齐事件的披露制度化,比此前各实验室零散发布安全博文更具结构性约束力。
美军因 AI 生成虚假情报报告险些误判(CNN/HN 380 分)——具体细节为 AI 生成了一份关于中国船只的虚假情报报告并险些引发军事反应,说明当前 LLM 幻觉问题在高风险情报场景中的后果已不限于技术讨论层面,而是直接触及国防决策链路。