中文翻译
摘要: 英国人工智能安全研究所(UK AI Security Institute)指出,GPT-5.5是其在网络任务测试中遇到的最强模型之一,性能与Anthropic的Claude Mythos相当。在包含32个步骤的企业网络攻击模拟测试中,GPT-5.5在10次尝试中成功2次;相比之下,作为首个完成该测试的Claude Mythos成功3次。这表明GPT-5.5在复杂网络攻防场景下具备极高的能力水平。
正文
英国人工智能安全研究所(UK AI Security Institute)的研究人员表示,GPT-5.5“是我们针对网络任务测试过的最强模型之一”,其性能水平与Anthropic的Claude Mythos相当。在测试过程中,该模型在10次尝试中有2次成功完成了包含32个步骤的企业网络攻击模拟;而Claude Mythos作为首个完成该测试的模型,在10次尝试中成功3次。此次发布……
采集时间: 2026-05-09 20:17:26
AIGPTOpenAIAnthropicClaude人工智能
