코인정보

OpenAI发布GPT-5.5,推动AI超级应用战略

李智原 기자 2026-04-24 11:13
代理型AI能力提升,加速AI超级应用战略
图片来源:AP·联合通讯社
[图片来源:AP·联合通讯社]

OpenAI发布了最新的人工智能模型“GPT-5.5”,在生成型AI竞争中引发关注。该模型不仅提升了性能,还标志着向“代理型AI”和“超级应用”战略的转变。

据OpenAI 23日(当地时间)消息,GPT-5.5在推理能力和自主性上有显著提升,能够执行复杂任务,如编码、研究和数据分析。其核心在于理解用户意图并自主设计问题解决步骤的“代理型任务执行”能力。

GPT-5.5被视为OpenAI“AI超级应用”战略的核心引擎。它能够识别屏幕并执行点击、输入等实际计算机操作,接近与人类协作的水平。通过这一功能,ChatGPT从简单的对话服务演变为整合工作、搜索和生产力工具的平台。

例如,用户指示“分析最近市场趋势,撰写报告并通过邮件发送”,GPT-5.5会打开浏览器收集信息,撰写文档,并操作邮件客户端完成任务。这显示出AI从提供“答案”扩展为实际“任务执行者”。

在性能方面,GPT-5.5在多文件代码修改、认证系统设计、协作功能实现等开发任务中提高了效率,企业应用如文档撰写和数据分析也得到加强。业内认为,这标志着AI竞争从单纯的模型性能转向“实际任务替代能力”。

OpenAI还大幅加强了安全措施,认为GPT-5.5属于可能被用于网络攻击的“高风险”级别,并进行了前所未有的红队测试。

OpenAI
OpenAI发布的GPT-5.5性能指标报告 [图片来源:OpenAI]

随着Anthropic发布“Claude Mythos”和“Opus 4.7”等新一代模型,竞争将更加激烈。OpenAI的报告显示,GPT-5.5在多项核心性能指标上领先于Opus 4.7。

在“GDPval”实务能力测试中,GPT-5.5得分84.9%,比Opus 4.7高约4个百分点;在“Terminal-Bench 2.0”系统控制能力评估中,得分82.7%,领先约13个百分点;在安全相关指标“CyberGym”中,得分81.8%,远超竞争对手(73.1%)。

然而,在SWE-Bench Pro编码能力评估中,GPT-5.5得分58.6%,低于Opus 4.7的64.3%。对此,OpenAI对竞争模型的数据记忆能力提出质疑,并对评估方式表示异议。

GPT-5.5将整合到ChatGPT等OpenAI的主要服务中,加速向“AI超级应用”演变。生成型AI从简单的辅助工具转变为实际任务执行的“数字同事”,预计将对企业和产业的生产力结构产生重大影响。

OpenAI总裁格雷格·布罗克曼在记者会上表示:“该模型的最大特点是以更少的指令完成更多工作”,并强调“在不完整或模糊问题的自我解读和决策能力上有显著提升”,这将为未来的计算机使用方式和大规模代理型计算奠定基础。




※ 本报道经人工智能(AI)系统翻译与编辑。

《 亚洲日报 》 所有作品受版权保护,未经授权,禁止转载。