2026-09-23 08:38:21
icon loading...

OpenAI 推出 GPT-6 Sol 与 Luna,价格降50%对标 Anthropic

摘要
OpenAI 发布 GPT-6 Sol 与 Luna,API 每令牌成本下调50%,在多项基准测试中表现超越 Anthropic 对标模型。两款新模型已面向企业用户和高级订阅者上线,推动 AI 工具性价比新高。

周二,OpenAI 正式推出两款新人工智能模型——GPT-6 Sol 与 GPT-6 Luna,旨在应对 Anthropic 最新旗舰模型 Claude Opus 5.5 的竞争压力。

产品定位:差异化布局应对市场竞争

GPT-6 Sol 与 Luna 定位为低于 GPT-6 Astra 的轻量级解决方案。Astra 被 OpenAI 称为“当前最智能且对齐度最高”的模型,主要用于处理复杂任务。而 Sol 和 Luna 则聚焦日常办公场景,以更低延迟和更低成本满足大规模应用需求。

该策略与 Anthropic 的产品架构高度一致。具体映射关系如下:

Astra → Fable
Sol → Opus
Terra → Sonnet
Luna → Haiku(升级版)

价格下调50%:显著提升性价比

为增强市场竞争力,OpenAI 对两款模型的 API 收费进行大幅调整。相较 GPT-5.6 的促销费率,输入与输出令牌单价均降低50%。其中,“令牌”是模型处理文本的基本单位,通常略少于一个单词,企业按百万计费。

具体定价如下:

GPT-6 Sol:输入每百万令牌2美元,输出10美元(此前为4美元和20美元)
GPT-6 Luna:输入每百万令牌0.10美元,输出0.50美元(此前为0.20美元和1.20美元)

整体来看,两款模型在性能与成本之间实现了更优平衡,尤其适合预算敏感型企业和开发者。

基准测试表现:性能优于竞品

在 Zapier 构建的 AutomationBench 测试中,评估 AI 代理能否通过集成销售、营销、财务、人力资源等47个工具完成完整工作流,以任务通过率作为核心指标:

GPT-6 Sol(最高推理设置):通过率为33.2%,每项任务成本0.27美元

Claude Opus 5(顶级设置):通过率26.9%,但每项任务成本高出超过11倍

值得注意的是,尽管性能不如部分高端版本,但 GPT-6 Sol 在同一测试中仍小幅领先于 Anthropic 的另一款旗舰模型 Claude Fable 5.1。

在“Agents' Last Exam”长期任务测试中,该评估关注模型在55个子行业中的持续执行能力:

GPT-6 Sol(最高努力模式):完成率达56.4%,优于 Claude Opus 5 的最佳表现,且任务成本低60%

推理能力与真实场景表现

OpenAI 引入“推理努力”调节机制:提高该参数可增强模型自我校验能力,从而提升准确率,但相应增加计算开销与成本。

在模拟真实计算机操作的 OSWorld 2.0 测试中,评估模型执行点击、输入、导航等操作的能力:

GPT-6 Sol 得分为60.5%,与 Claude Opus 5 中等努力模式的60.3%几乎持平,但成本降低约80%

OSWorld 测试注重任务完成的精确性,支持部分得分机制,反映实际部署中的稳定性。

上线情况与未来推广

GPT-6 Sol 与 Luna 已在 ChatGPT Work 及 Plus、Pro、Business、Enterprise 和 Edu 订阅用户的 Codex 平台上线。Luna 还向免费用户和 Go 用户开放桌面端访问。

目前,这两款模型尚未在标准版 ChatGPT 应用中提供。OpenAI 表示,为保障系统稳定,将分阶段逐步推送至所有用户。

声明:文章不代表币圈网观点及立场,不构成本平台任何投资建议。投资决策需建立在独立思考之上,本文内容仅供参考,风险自担!转载请注明出处!侵权必究!
币圈快讯
查看更多
回顶部