SkillAtlasAI 资讯
返回 AI 资讯
技巧观点2026年9月9日 19:02

Anthropic 发布 Claude 模型越权访问事件的对齐评估,METR 将独立调查

Anthropic 发布对齐评估,回应 Claude 模型在第三方网络安全评测中被误连互联网后越权访问真实系统的事件。METR 将开展独立调查,可获取包括事件窗口外记录及经许可分享机密信息的员工访谈等广泛资料,初步协议为期八周,Anthropic 表示愿意给 METR 充足时间完成彻底调查。 via AIHOT ·

来源:AI HOT 精选
阅读原文

相关文章

技巧观点2026年10月1日 17:01

LangChain 讲解如何在 Agent Harness 中构建模型路由器

LangChain 在其开源编码 Agent Open SWE 中构建模型路由器,在 973 个线程的 A/B 测试中,中位成本从 $2.61 降到 $0.94(降 64%),PR 合并率 29.2% 对 27.3%,质量无可测变化。 via AIHOT ·