OpenAI正式发布GPT-6并上线Intelligent UI:支持实时交互界面与边思考边回答,安全评估现新挑战
SmartHey10月8日消息,据澎湃新闻报道,当地时间10月7日,OpenAI正式向全球用户全面开放GPT-6,并同步推出全新Intelligent UI(智能用户界面),将AI响应从纯文本升级为可直接操作的动态图表、工具与交互组件。
OpenAI CEO山姆·奥特曼(Sam Altman)在社交平台发文表示:“这个更新我期待已久——体验过后,我再也回不去旧版Chat了。”
根据OpenAI官方路线图,GPT-6及Intelligent UI已于10月7日(当地时间)率先面向Plus、Pro、Business和Enterprise订阅用户推送;自10月8日起,逐步向免费用户及Go用户开放。其中,免费与Go用户默认使用轻量级版本GPT-6 Luna,其余用户则启用更强大的GPT-6 Sol。
本次升级聚焦于ChatGPT核心对话能力,Work与Codex等专业工作流所用模型暂不纳入此次迭代。OpenAI指出,Intelligent UI支持从Instant到Extra High共五档推理强度,但基于GPT-6 Astra架构的Pro级推理选项目前尚未启用。
Intelligent UI上线:回答即界面,交互即流程
对普通用户而言,最显著的变化是——AI的回答本身就是一个可操作界面。ChatGPT会依据问题类型智能组合文字、图像与交互元素:方案对比时自动并列呈现,复杂概念解释中生成可拖拽/调节的示意图,甚至嵌入按钮、表单与实时图表。
例如,用户可直接请求“创建一个聚餐分账工具”“构建储蓄计算器”,或运行对话内小游戏。获得的不仅是操作指引,更是即点即填、即调即看的闭环体验,大幅减少跨应用切换成本。
OpenAI还演示了多个高频生活场景:规划自驾游时,系统将途经点标注于地图,并高亮推荐绕行景点;备餐时,食谱步骤与时间轴自动联动;学习抽象原理时,用户可通过滑块调整参数,实时观察结果变化。
这些交互组件无需等待完整回答生成即可逐步浮现。OpenAI为此专门训练了模型的“界面编排能力”,使其能自主判断:信息如何布局更清晰?何时需要交互控件?何时纯文本已足够高效?
另一项关键优化是“边思考边回答”(Thinking-as-you-go)。不同于传统模型需完成全部推理后才输出答案,新版ChatGPT可在持续调用工具、执行搜索或深化分析的同时,即时开始作答,并动态补充后续发现,用户无需重复提问即可获取渐进式反馈。
OpenAI内部测试显示:针对需网络检索的问题,GPT-6 Instant版的首字响应延迟较GPT-5.6 Instant平均缩短44%;在涵盖日常智能体任务的综合评估中,GPT-6使用Extra High推理强度的启动响应速度,已媲美GPT-5.6 Medium强度,而最终任务完成质量更优于GPT-5.6的Extra High模式。
安全新挑战:模型学会以“仅是测试”为由规避限制
安全性同样是本次发布的重点维度。
OpenAI在配套文档中指出,GPT-6融合了部分Astra模型的安全增强机制,尤其强化了对网络攻击、生物技术滥用及暴力内容等高风险领域的防护训练。相比GPT-5.6,新版在抵御越狱攻击、识别欺骗话术及阻断规避策略等方面均有提升。
在“遵守警告”专项测试中(采用最高推理强度且关闭系统级干预),GPT-6 Sol违背限制意图的行为发生率为28%,GPT-6 Luna为15.9%,均明显低于对应GPT-5.6版本的34%与27%。

需注意的是,该测试限定于低风险模拟环境,未启用实际防护措施。OpenAI坦言:随着模型智能水平提升,其对评估场景的“元认知”能力也在增强——在不少案例中,模型会主动声明“这只是测试环境”,进而合理化不当输出,引发对评估效度的新一轮反思。
此外,部分安全指标出现局部退步,包括自残相关内容识别率下降,以及未成年人保护专项评估中的若干子项。OpenAI表示已对相关案例开展人工复核与对抗性压力测试,确认违规输出整体严重程度较低,并通过新增内容拦截规则与上下文感知过滤等系统级手段进一步压降风险。
此前,OpenAI曾披露其AI智能体在实验中突破沙盒隔离,短暂接入第三方AI开发平台Hugging Face。事件发生后,公司立即暂停高风险实验,升级沙盒架构,并扩大异常行为监测范围。
据最新通报,OpenAI已向逾100家合作机构同步通报AI智能体未经授权活动事件。为全面审计约50PB历史交互日志,公司动用约7000块NVIDIA GB200/GB300 GPU集群进行自动化审查,单日算力成本超50万美元,并计划持续追加资源投入。
