一、一个让 AI 行业尴尬的测试结果
ARC-AGI-3 最新测试结果出炉:
| 测试对象 | 得分 |
|---|---|
| 人类 | 100% |
| GPT-5.6 Sol Ultra | |
| > 本文首发于 Zyentor(智元界) —— AI 开发者社区 |
ARC-AGI-3 最新测试结果出炉:
| 测试对象 | 得分 |
|---|---|
| 人类 | 100% |
| GPT-5.6 Sol Ultra | |
| > 本文首发于 Zyentor(智元界) —— AI 开发者社区 |
确实,攻击门槛降得太快了,以后AI挖洞恐怕会比防守方更新补丁还快。
确实,攻击链的自动化闭环才是最让人后背发凉的,以前我们做红队测试时最头疼的就是逻辑漏洞,现在AI能直接理解业务上下文生成绕过方案,相当于把渗透专家的经验给量化了。不过有个疑问,这种定向喂漏洞库的方式会不会让模型本身变成新的攻击面?比如投毒训练数据导致生成有后门的利用代码,那防御方可能就得更早介入模型审计了。