> 数据图表

如何解释GPT 5.6在Terminal-Bench 2.1测评结果超过Claude Mythos

2026-6-1
如何解释GPT 5.6在Terminal-Bench 2.1测评结果超过Claude Mythos
相较于前代产品,在安全性上,GPT-5.6 Sol 搭载了 Open AI 截至目前最完备的安全防护体系。公司加强了对高风险活动、敏感网络请求和反复滥用的保护,并用数周时间寻找漏洞,进行系统压力测试,并加固其对真实攻击的防御。 在模型能力上,GPT-5.6 旗舰模型 Sol 新增 Max 深度推理机制,赋予模型更长思考周期以实现深度推演同时配套推出 Ultra 模式,通过智能体协同架构突破单智能体能力上限,大幅提升复杂任务处理效率。