4月23日,OpenAI正式发布了GPT-5.5。这款新型前沿模型被定位为公司的“最具能力的智能体系统”,旨在处理复杂多步骤任务,能够自主完成规划、执行与终结全流程,无需人类逐步指导。
GPT-5.5标志着OpenAI从传统聊天机器人向自主执行智能体的战略转变。该模型被描述为能够“审视模糊问题并自主规划后续步骤”,联合创始人Greg Brockman强调其“使用直观性显著提升”,相比前代模型能承担更多实质工作。目前该模型已作为默认系统向多层级用户开放,并在发布六周后推出了专为高强度任务设计的专业版本。
在终端基准测试2.0中,该模型在需要规划、迭代与工具协调的复杂命令行任务中获得82.7%的评分;在涵盖44个知识工作岗位的GDPval评估中达到84.9%;在检验真实计算机环境自主操作能力的OSWorld-Verified测试中取得78.7%的成绩。研究负责人指出,该模型在编码能力方面“无论是基准测试还是合作伙伴反馈都表现卓越”,且在保持与前代相同响应速度的同时,完成任务所需的计算量显著降低。
OpenAI已不再为GPT-5.5提供传统聊天补全接口,其定价体系完全围绕任务执行设计:标准版输入与输出定价分别为每百万单位5美元和30美元,专业版则对应30美元和180美元。这种定价结构针对长上下文、高计算量的智能体部署场景,反映了公司将人工智能深度集成至专业工作流程的战略布局。
此次发布正值行业竞争加剧之际。OpenAI明确表示该模型虽未突破最高风险阈值,但仍需在生物与网络安全领域实施强化防护机制。公司通过向智能体化转型,正构建从交互工具到工作流程核心组件的演进路径,这为其实现长期收入目标提供了关键支撑。
公司负责人在发布当日表示,此次发布秉持“迭代部署”理念,将GPT-5.5定位为持续演进的基础平台而非终极形态,预示着该技术将持续快速发展。