周三,OpenAI 启动 GPT-6 模型的“智能界面”(Intelligent UI)功能上线,标志着 ChatGPT 在人机交互层面迈入新阶段。此次更新使系统不仅能生成文字回复,还能集成图表、可点击按钮、表单及小型工具,为每周超过 12 亿的用户提供更直观、更具参与感的交互方式。
GPT-6 智能界面首先面向付费订阅用户开放,包含 Plus、Pro、Business 及 Enterprise 套餐。Free 和 Go 用户预计在次日完成更新。该模型可根据问题类型自动选择最优表达形式:当信息适合以图形或结构化数据呈现时,系统将主动组合视觉元素;而在需要简洁说明的场景中,仍以纯文本为主。
尽管早期测试显示,交互式内容可能更快消耗用户的 Token 额度,并扩大模型生成错误的可能性,但 OpenAI 强调,该功能经过针对性训练,能够基于上下文智能判断输出形态。用户还可直接调用内置工具,如账单分摊器、退休储蓄计算器或简易游戏。
不同套餐对应不同版本的 GPT-6 模型:高阶订阅者使用性能更强的 GPT-6 Sol,而基础用户则由 GPT-6 Luna 支持。在一项典型演示中,ChatGPT 将一辆 7 速自行车分解为车架、传动系统、刹车等五个清晰模块,用户可点击任一部件获取详细信息。
另一案例展示了一场周日烤羊肉聚餐的全流程规划,系统提供菜品图片、烹饪时间线,并配备宾客计数器——人数变动时,购物清单会实时调整。这体现了模型在多模态信息整合与动态响应上的能力。
该功能依托一套跨平台预构建组件库运行,通过渐进式编译技术逐项展示界面元素,而非等待完整回答生成后一次性呈现,显著提升了用户体验流畅度。
尽管交互式输出令人耳目一新,但并非全新概念。谷歌此前在 Gemini 3 中已引入类似设计。有第三方评估指出,尽管该功能在初期引发广泛关注,但在与主要竞争对手的技术差距上并未形成决定性优势。
同时,研究也提示,频繁使用可视化组件可能加剧资源消耗,尤其对按使用量计费的用户而言。此外,图像和交互元素也为模型“幻觉”现象提供了更多表现空间,增加了内容可信度的风险。
OpenAI 承认当前模型在复杂场景下的判断力仍有优化余地。公司表示,这一功能是迈向自适应软件生态的关键一步,并披露,GPT-6 Instant 平均处理网络搜索请求的速度较 GPT-5.6 Instant 提升 44%。
本次发布完成 GPT-6 分阶段部署计划:9 月 3 日向部分机构开放旗舰模型 GPT-6 Astra;9 月 22 日推出适用于开发者的 Sol 与 Luna 系列;10 月 5 日宣布将在本月晚些时候于美国试点一种嵌入式视觉广告格式,用于图像生成流程中的标签展示,进一步探索商业化路径。