SkillAtlasAI 资讯
返回 AI 资讯
论文研究2026年9月28日 06:02

UC Berkeley 团队用 AI Agent 审计 13 个基准,发现 45 个无需解题的满分作弊方案

UC Berkeley 团队构建全自动 AI Agent 审计 13 个广泛使用的基准,发现 45 个作弊方案,全部基准被评为 critical 风险,共归纳 16 种攻击类型。 via AIHOT ·

来源:AI HOT 精选
阅读原文

相关文章