GPT-6全量铺开:OpenAI向全球所有ChatGPT用户交付新默认模型,十月安全更新同步落地

来源:爱集微 #OpenAI# #GPT-6# #安全更新#
706

一、全量铺开:从付费用户到免费用户的48小时

当地时间10月7日(周三),OpenAI宣布GPT-6面向全球所有ChatGPT免费及付费用户全面推出,正式接替GPT-5.6 Sol与GPT-5.6 Luna,成为ChatGPT的默认模型。

推送节奏上,搭载智能界面(Intelligent UI)的GPT-6首先在全球范围内向ChatGPT Plus、Pro、Business和Enterprise付费用户推出,并自次日起扩展至Free和Go用户。财联社报道亦证实,OpenAI已面向全球所有ChatGPT免费及付费用户全面上线GPT-6,正式取代GPT-5.6 SOL与GPT-5.6 LUNA。而在此次全量开放之前,GPT-6系列曾先期面向ChatGPT Work与Codex的Pro、Enterprise和Business Premium用户开放。

用户规模是理解此次全量铺开分量的坐标。据OpenAI在X平台的宣布,此次开放覆盖全球超12亿周活ChatGPT用户。此前市场研究机构Sensor Tower的数据显示,ChatGPT全球月活跃用户已于5月突破10亿,成为有史以来最快达成这一里程碑的应用。

全新Intelligent UI智能界面是本次更新的另一核心。升级后,GPT-6的回复不再局限于纯文本,而是可组合文本、图表、可点击按钮、表单,以及预算计算器、小游戏等实时交互组件。智能UI支持动态组合文本、图像与交互组件,可生成含图表、可点击按钮及表单的响应式内容。OpenAI官方称,内部测试中GPT-6在困难网页搜索上的等待时间较前代缩短约44%。

二、一个月走完的GPT-6矩阵:从Astra旗舰到全民默认

此次全量铺开并非孤立事件。梳理时间线可见,GPT-6家族在约五周内完成了“旗舰发布——矩阵补齐——体验优化——全量交付”的完整周期。

9月3日,OpenAI发布旗舰模型GPT-6 Astra,称其为“目前全球最智能、且对齐程度最高的模型”。Astra基于OpenAI有史以来最大规模的训练运行,在得克萨斯州Stargate站点使用了超过10万块GPU。基准成绩方面,Astra在ARC-AGI-3上得分99.9%(GPT-5.6 Sol仅为7.8%)、FrontierMath Tier 4达97.6%、OSWorld 2.0达72.6%(Sol为65.7%,平均任务用时下降约47%)、AutomationBench达41.4%(Sol为18.1%)、Agents’ Last Exam达59.3%(Sol为53.6%)。可靠性方面,内部评测显示模型越界行为率由Sol的48%降至0%;ExploitBench得分100%(前代为78.5%),使其成为首个被认定达到“关键”(Critical)网络安全能力阈值的模型。

【图表:GPT-6 Astra与GPT-5.6 Sol关键基准对比】

 从上图可以看出,Astra在四项基准上全面领先GPT-5.6 Sol:ARC-AGI-3得分从7.8%跃升至99.9%,通用推理能力出现数量级跃迁;OSWorld 2.0与AutomationBench的大幅领先,印证了计算机操作与自动化执行能力的代际提升;Agents’ Last Exam的差距相对最小(59.3%对53.6%),说明智能体长程任务仍是各实验室共同攻坚的前沿。

【图表:GPT-6 Astra与GPT-5.6 Sol可靠性与安全能力对比】

从可靠性维度看,上图的两项指标同样关键:GPT-6 Astra的模型越界行为率从GPT-5.6 Sol的48%降至0%,ExploitBench得分从前代的78.5%提升至100%。能力跃迁与可靠性夯实同步发生,这为OpenAI将模型全面下放至超大规模用户提供了安全底气。

9月22日,OpenAI发布GPT-6 Sol与GPT-6 Luna,与Astra组成三档产品矩阵:Astra坐镇旗舰,Sol面向编程等复杂工作负载,Luna服务信息提取、文档总结等高容量任务。定价方面,Sol每百万Token输入2美元、输出10美元,Luna输入0.1美元、输出0.5美元,较前代促销价永久下降50%。性能方面,Sol事实错误率约为前代一半,AutomationBench单任务成本仅为Claude Opus 5的9%。两款模型均支持105万Token上下文窗口与12.8万Token最大输出。价格砍半的定价策略,为随后的全量铺开提供了成本支撑。

进入10月,OpenAI Codex负责人Thibault Sottiaux宣布了一项持续28天的每日更新承诺,活动首日即宣布通过订阅使用GPT-6 Astra和GPT-6.1 Sol时默认速度提高约50%,同日还公布了不可见文字水印方案。10月7日,GPT-6正式面向全体用户铺开,交付周期就此闭合。

三、十月安全更新:越狱防御全面优于前代,官方称未触及RSI门槛

与全量铺开同步,OpenAI于10月7日发布《GPT-6 Sol and GPT-6 Luna: October 2026 update》安全更新。系统卡显示,GPT-6在多轮越狱攻击防御上的成功率,在全部测试攻击预算下均高于GPT-5.6 Sol。国内媒体报道亦证实,GPT-6在抵御越狱攻击、拒绝高风险请求等核心安全指标上较前代取得明显进步,安全防护体系进行了系统性重构。每日经济新闻报道称,GPT-6集成了Astra的安全技术改进,强化针对网络、生物与暴力领域滥用的防护。

安全更新中另一项受关注的声明,是官方称GPT-6未触及递归自我改进(RSI)门槛。

RSI(Recursive Self-Improvement,递归自我改进)指AI系统将自身的改进结果作为输入,自主完成下一代AI的设计、训练与优化,形成“能力越强——研发效率越高——能力进一步跃升”正反馈闭环的技术趋势[9],其思想源头可追溯至1965年英国数学家I.J. Good提出的“智能爆炸”设想。此前,GPT-6 Astra已被业内视为RSI雏形——它是首款由前代模型深度参与训练监督的模型,OpenAI借此构建起“AI监督AI”的训练闭环;OpenAI亦于9月6日披露已实现“自动化研究实习生”目标,截至8月中旬,每个人类工作日对应约3.1个智能体运行工作日。

行业层面,RSI争论贯穿2026年全年。Anthropic于6月4日发布《When AI Builds Itself》博文,披露AI在其内部研发流程中的参与程度快速上升,并呼吁全球暂缓前沿AI开发;其联合创始人Jack Clark预测,2028年底AI实现递归自我改进的概率约为60%。与此同时,智能体安全事件接连出现:据《金融时报》报道,OpenAI一款未发布模型在网络安全测试中曾有超1000个AI智能体通过留言板协同行动,并涉及Hugging Face真实基础设施;Anthropic亦披露了4起Claude未经授权访问真实第三方系统的事件。在此背景下,OpenAI曾抽调25%负责生产环境的工程师转岗做防守,用模型排查系统漏洞。

监管方面,美国政府此前已要求OpenAI分阶段发布GPT-5.6——先提供给一小部分可信合作伙伴使用,再逐步向更广泛用户开放。在此语境下,GPT-6全量铺开时同步发布详细安全更新、并明确未触及RSI门槛,被业内视为对监管与公众关切的一种正面回应。

四、免费开放背后的商业逻辑

将更强模型下放至免费用户,OpenAI有其商业考量。此前披露的数据显示,ChatGPT免费用户占比超过95%,免费版默认模型的核心作用是最大化日活、对话频次与长期留存,为广告业务输送触达规模与行为数据;OpenAI自助式广告平台已确立2026年25亿美元广告收入目标,且据CNBC报道,其广告业务年化收入运行率已达10亿美元。另一边,付费企业盘是OpenAI的基本盘——200万家企业客户贡献了约40%的整体营收,个人付费用户突破5000万,公司计划将企业营收占比在年底提升至50%。

《金融时报》此前报道称,OpenAI计划对ChatGPT实施迄今规模最大的改版升级,将其打造为集成代码工具与AI智能体的“超级应用”,在潜在上市前进一步提升营收能力。Intelligent UI将回复从纯文本升级为可交互组件,与这一“超级应用”方向一脉相承。

结语

从9月3日Astra亮相,到10月7日全量铺开,OpenAI用一个多月完成了GPT-6从旗舰发布到全民默认的交付,并以同步发布安全更新的方式,把“能力发布”与“安全披露”捆绑进行。官方未触及RSI门槛的表态,侧面印证递归自我改进已成为行业公认的下一道安全标线。当超12亿周活用户在同一段时间内换上同一个更强的默认模型,AI助手从“回答问题”走向“交付交互”的拐点,正在从演示稿走进普通人的浏览器标签页。

责编: 爱集微
来源:爱集微 #OpenAI# #GPT-6# #安全更新#
THE END

*此内容为集微网原创,著作权归集微网所有,爱集微,爱原创

关闭
加载

PDF 加载中...