亚洲财经

☰ 搜索

GPT-6将ChatGPT的回答转化为可点击工具,以下是主要变化

OpenAI 发布 GPT-6 智能界面:ChatGPT 迎来交互新体验

周三,OpenAI 开始推出搭载“智能界面”(Intelligent UI)的 GPT-6 版本。这一更新让 ChatGPT 能够超越单纯的文字回复,通过图表、按钮和可操作工具,为每周超过 12 亿的用户提供更丰富的交互体验。

核心亮点与分发策略

GPT-6 智能界面于周三正式面向付费用户开放,免费用户及 Go 套餐用户预计将于周四获得更新。该模型将文本与图形、表单及小型工具相结合,但在适合的场景下,纯文本回答依然是主要形式。

尽管早期报道指出,交互式答案可能会更快消耗用户的 Token 额度,并增加出错的风险,但 OpenAI 在博客文章中宣布了这一发布计划。公司表示,GPT-6 经过训练,能够根据每个问题的特点,从文本、视觉元素和交互组件中组合出最佳答案。现在的回复可以包含图形、可点击按钮、表单和图表。

当纯文本更合适时,系统仍会提供文字回答。此外,用户还可以直接要求使用特定工具,例如账单分摊器、退休储蓄计算器或小型游戏。

分层部署与功能演示

付费订阅者优先获得了访问权限。在 Chat 标签页中,Plus、Pro、Business 和 Enterprise 套餐用户使用的是 GPT-6 Sol 模型;而 Free 和 Go 套餐用户则使用 GPT-6 Luna 模型。

在一项演示中,ChatGPT 将一辆 7 速自行车拆解为五个标记清晰的子系统,包括车架、传动系统和刹车等,用户可以点击这些部分进行深入了解。另一项演示则规划了一场周日烤羊肉餐,展示了每道菜的图片、烹饪时间线以及一个宾客计数器——当人数变化时,购物清单会自动重新计算。

OpenAI 表示,该模型利用了一个跨网页和移动端运行的预构建组件库,并通过编译器逐步展示每个界面,而不是等待完整答案生成后才一次性呈现。

潜在风险与挑战

这种交互方式并非首创。谷歌去年在推出 Gemini 3 模型时便引入了生成式界面。有早期评估指出,虽然 OpenAI 的这一功能在发布初期吸引了大量关注,但并未使其在与竞争对手 AI 实验室的差异化竞争中占据明显优势。同时,评估也警告称,交互式答案可能会加速消耗用户的 Token 配额,且视觉元素也为模型的“幻觉”现象提供了新的空间。

发布时间表与未来展望

OpenAI 承认,模型的设计判断能力仍有提升空间。公司将这一功能描述为迈向自适应软件的重要一步,并表示 GPT-6 Instant 平均回答网络搜索问题的速度比 GPT-5.6 Instant 快 44%。

此次发布标志着 GPT-6 分批推出计划的完成。9 月 3 日,OpenAI 向有限数量的机构开放了其旗舰模型 GPT-6 Astra;随后在 9 月 22 日,为 Work、Codex 和开发者群体添加了较小的 Sol 和 Luna 模型。10 月 5 日,公司宣布将在本月晚些时候在美国对 Free 和 Go 用户测试一种视觉广告格式,在图像生成过程中显示带标签的广告。