
OpenAI时隔两月再推新模型‘GPT-5.5’,性能安全全面升级
据OpenAI于24日发布,最新推出的GPT-5.5专为支持多种现实任务设计,涵盖编程、在线研究、数据分析、文档与电子表格创建以及软件操控等场景。
性能提升也得到证实。在评估知识任务能力的‘GDPval’基准测试中,GPT-5.5得分84.9%,超越了Anthropic的Claude 4.7(80.3%)。
在衡量复杂命令行任务能力的‘Terminal-Bench 2.0’基准测试中,GPT-5.5录得82.7%,表现优于GPT-5.4(75.1%)和Claude 4.7(69.4%)。在评估网络安全能力的‘CyberZoo’基准测试中,GPT-5.5也以81.8%的得分领先Claude 4.7的73.1%。
在评估类似真实开发环境问题解决能力的‘SWE-Bench Pro’基准测试中,GPT-5.5取得了58.6%的成绩,较前代模型有所改进。单次完成的任务比例增加,提升了代码编写、调试、测试和验证等整个开发流程的效率。不过,在这一指标上,GPT-5.5未及Claude 4.7的64.3%。
安全特性也得到加强。GPT-5.5应用了增强防护措施,并针对高危网络请求引入了更严格的拒答标准和额外保护机制。
GPT-5.5将从今日起陆续向ChatGPT Plus、Pro、Business和Enterprise用户推送。高性能版本GPT-5.5 Pro将面向Pro、Business和Enterprise用户提供。API将另行于日后发布。
本文由斯特网原创发布,未经许可,不得转载!
本文链接:https://ttes.yrowe.com/jdez/7619/











