AITOP100平台获悉,2026年10月8日,OpenAI正式面向全球ChatGPT用户全量推送新一代旗舰模型GPT-6,逐步接替此前的GPT-5.6 Sol与GPT-5.6 Luna。
此次更新的重头戏并非单纯的模型参数升级,而是ChatGPT首次引入名为“智能UI”(Intelligent UI)的全新交互层——AI的回答不再被限制在纯文本中,而是能够根据问题类型自主选择合适的呈现形态,图文、图表、按钮、表单乃至可直接操作的小界面,都可以在对话窗口中实时生成。
本次GPT-6推送主要针对ChatGPT的Chat体验场景。OpenAI明确表示,Work和Codex当前使用的模型不会随本次发布一起切换,这两个产品线仍在运行此前发布的版本
模型地址:GPT-6官网 (海外网站需要科学上网)

一、推送节奏与双模型策略
升级覆盖范围较广。Plus、Pro、Business和Enterprise用户自10月7日起已陆续收到更新,免费和Go用户则在10月8日之后跟进。
不同套餐对应的模型有所区分:付费用户运行GPT-6 Sol,免费和Go用户使用GPT-6 Luna。两款模型均针对日常对话体验做了专门优化,并非同一套权重直接适配所有用户。
这一双模型策略源自9月22日OpenAI发布的GPT-6系列产品矩阵。当时OpenAI正式推出GPT-6 Sol与GPT-6 Luna,两者吸收了GPT-6 Astra的多项能力升级,同时将API价格永久下调50%。
具体定价方面,GPT-6 Sol每百万Token输入单价由4美元降至2美元,输出单价由20美元降至10美元;GPT-6 Luna每百万Token输入单价由0.2美元降至0.1美元,输出单价由1.2美元降至0.5美元。
至此,OpenAI形成了由旗舰模型GPT-6 Astra、中端模型GPT-6 Sol及轻量模型GPT-6 Luna构成的三层产品矩阵。
值得注意的是,GPT-6 Sol在专业工作流测试中表现不俗。在AutomationBench最高推理设置下,GPT-6 Sol取得33.2%的得分,高于Claude Opus 5在最大努力模式下的26.9%,且单任务成本仅为后者的约九分之一。在Agents‘ Last Exam测试中,GPT-6 Sol取得56.4%的成绩。
二、智能UI:从“读答案”到“操作答案”
真正改变交互体验的是智能UI这层新界面。过去ChatGPT回答问题的方式类似于写文章——一口气输出一段文字。现在,GPT-6会先判断问题的性质,再决定用哪种形式呈现答案。
根据OpenAI官方博客的介绍,GPT-6经过专门训练,能够使用文本、视觉元素和交互组件来组织回答,并基于用户的问题选择这些元素的组合方式。智能UI支持的回答形式包括图形、可点击按钮、表单、图表以及可直接在对话中使用的交互体验。格式的选择取决于用户所问的内容——比较类问题适合并排展示,解释类概念通过交互式图解更容易理解,而简单的问题仍然可以直接用文字回答。
在具体应用场景中,当用户探究飞机机翼如何产生升力时,系统能够生成多张示意图,通过可视化方式展示空气流动、压力差异以及升力形成机制。处理生活场景时,可以生成食谱图片、自行车机械原理图、多日徒步旅行地图及个人储蓄计算器等定制化视觉辅助。更实用的场景下,用户一句话就能让ChatGPT生成计算器、账单分摊工具,甚至在聊天窗口里直接创建可操作的小游戏。
OpenAI产品经理Aarush Selvan表示,ChatGPT长期以来以文本交互为核心,但公司希望帮助用户真正完成任务,无论是规划食谱、安排旅行还是学习新知识。他认为,最有价值的回答往往不只是文字,而是能够帮助用户理解和操作信息的综合体验。
技术上,智能UI基于一个原生可流式传输的组件库和一套编译器构建,编译器在GPT-6生成回答的过程中同步处理界面元素。这意味着交互组件会随着回答的生成逐步显示,而不是等整段回答生成完毕后才一次性呈现。
OpenAI也留有分寸:智能UI不会在每次回答中出现,简单问题仍以纯文本作答,只有在判断确实需要图形或交互元素时才切换形态。用户还可以根据自身偏好调整回复中视觉元素的展示比例,如果更偏好传统文本回复,也可以减少或关闭视觉化元素。
三、响应速度:边想边说
响应速度这一长期困扰推理模型的痛点也被针对性优化。以往推理模型需要完成整段内部思考后才输出第一个字,用户需要等待较长时间。GPT-6采用了“边想边说”的机制——推理在后台推进的同时,回答已经开始流式输出,并随着思考深入逐层补充、修正前面的内容,等待感被明显降低。
OpenAI公布的数据显示,在需要联网搜索的问题上,GPT-6 Instant从接收问题到吐出首个回答的平均等待时间,相比GPT-5.6 Instant缩短了44%。
此外,在内部针对高价值日常Agent任务的评估中,GPT-6 Extra High的响应时间与GPT-5.6 Medium大致相当,但整体得分高于GPT-5.6 Extra High。
四、模型底子:联网搜索与安全能力提升
除交互层和速度优化外,GPT-6在基础能力上也做了多项改进。
联网搜索方面,新模型能更准确地判断何时需要搜索、如何利用搜索结果来支撑回答,回答的可信度有所提升。
安全方面,GPT-6集成了GPT-6 Astra的安全技术改进,强化了针对网络、生物与暴力领域滥用的防护。根据OpenAI发布的部署安全报告,GPT-6 Sol和Luna在网络安全、生物化学领域均达到High能力门槛,尚未达到Critical级别;在AI自我改进领域,两款模型均未达到High水平。
在多轮越狱攻击测试中,GPT-6两个版本在每一档攻击预算下的防守表现均优于GPT-5.6 Sol。在指令层级评测中,Sol和Luna抵抗系统指令被绕过的比率分别达到99.99%和99.79%。事实性方面,OpenAI称两款模型在几乎所有指标上都优于各自的GPT-5.6版本,包括医疗、法律、金融这类答错代价较高的问题领域。
在针对18岁以下用户的专项安全评测中,GPT-6 Luna的“情感依赖”指标从前代GPT-5.6 Luna的0.927下降至0.734,表明新模型在避免让青少年产生过度情感依赖方面有所改善。
GPT-6的发布标志着ChatGPT从一块只会写字的画板,向能自行决定呈现方式、还能边想边说的智能工作台迈出了一步。智能UI将AI的回答从纯文字解放为可交互的界面,使部分原本需要借助专门软件或网页完成的操作,如今通过自然语言对话即可在ChatGPT内完成。在Veo、Sora等视频生成模型持续演进的同期,OpenAI选择在交互层做出突破,也反映出大模型竞争正从“回答质量”向“任务完成效率”延伸。
更多信息请参阅OpenAI官方博客:https://openai.com/index/gpt-6-for-everyone
部署安全报告:https://deploymentsafety.openai.com/gpt-6-october/vision
AITOP100-AI资讯频道将持续关注AI行业新闻资讯消息,带来最新AI内容讯息。
想了解AITOP100平台其它版块的内容,请点击下方超链接查看
AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说
AITOP100平台官方交流社群二维码:










