免费用户也能用上 GPT-6 了!
OpenAI 宣布,GPT-6 开始向 ChatGPT 免费和 Go 用户推送,用 GPT-6 Luna 逐步替换此前的 GPT-5.6 Luna。
Plus、Pro 等付费用户,则使用 GPT-6 Sol。

变化也不止于模型名称。新版 ChatGPT 可以根据问题生成图表、按钮和交互工具,还能一边思考,一边把答案呈现出来。
原本以文字为主的聊天框,开始变成一个随问题变化的界面。
同一天,OpenAI 还放出一份 24 页的安全报告。
报告里有一组专门针对 18 岁以下用户的评测,看模型和青少年聊天时能不能守住更严格的边界。
其中 " 情感依赖 " 一项,大致是看模型会不会让青少年对它产生过度的情感依赖。
上一代 GPT-5.6 Luna 是 0.927,而免费用户即将用上的 GPT-6 Luna,掉到了0.734。
免费用户用上 GPT-6 Luna
GPT-6 开始向 ChatGPT 的主聊天界面推送了。
按照 OpenAI 公布的安排,Plus、Pro、Business 和 Enterprise 用户从 10 月 7 日起陆续用上 GPT-6 Sol;免费和 Go 用户从 10 月 8 日起陆续用上GPT-6 Luna。
这两个版本将分别替换 ChatGPT 中此前使用的 GPT-5.6 Sol 和 Luna。
模型换代之外,还有一个明显变化——聊天框里的答案开始有了 " 界面 "。
这项功能叫Intelligent UI。
GPT-6 会根据问题选择呈现方式:解释概念时,可以给出能够点击、切换的图示;做比较时,可以把选项并排摆出来。

遇到具体任务,还能直接在对话中生成计算器、分账工具或小游戏。
比如用户问一辆七速自行车怎么运作,回答便把车架、车轮、传动系统等部分做成了可以逐项查看的界面。

答案出现的方式也变了。GPT-6 可以在继续思考或调用工具时先给出部分回答,随后补上新的发现;交互组件也能随生成过程逐步显示。
OpenAI 称,在需要网页搜索的问题上,GPT-6 Instant开始回答的时间平均比 GPT-5.6 Instant 早 44%。

这轮更新针对 ChatGPT 里的 Chat 体验。OpenAI 明确表示,Work 和 Codex 当前使用的模型不会随这次发布一起切换。
GPT-6,拒绝变少,回答变长
伴随这次推送,OpenAI 发布了 10 月版 GPT-6 Sol 和 Luna 的部署安全报告。
其中最醒目的判断是:GPT-6 Sol 和 Luna 在网络安全、生物化学领域均达到 High 门槛,尚未达到更高一级的 Critical 门槛;在 AI 自我改进领域,两款模型都没到 High。

这个定级和 GPT-5.6 时一样,防护措施也原样沿用。免费用户此前用的 GPT-5.6 Luna,本来就在 High 这一档。
进步的部分,报告列了不少:
多轮越狱是最难防的一类:攻击者会根据模型的回答不断调整话术,一轮不行换个说法再来。

面对这种攻击,两个 10 月版 GPT-6 在每一档攻击预算下的防守表现,都好于 GPT-5.6 Sol。不过和自家 9 月版相比,数值估计略低一些,置信区间大体重叠。
在测试系统指令会不会被用户一句话绕过的指令层级评测里,Sol 和 Luna 的抵抗率分别达到99.99%和99.79%,基本测满。
事实性上,OpenAI 称两款模型在几乎所有指标上都优于各自的 GPT-5.6 版本,包括医疗、法律、金融这类答错代价高的问题。
在 Codex 的 Auto-review 测试里,GPT-5.6 两个版本都有 0.3% 的概率钻了配置漏洞绕开审查,GPT-6 这次一例都没有。
这些进步分数,OpenAI 自己也加了个附注。
在一项考察模型遇到访问限制会不会想办法绕过去的评测里,GPT-6 Sol 仍有 28% 的情况绕了过去,Luna 是 15.9%,都比 GPT-5.6 低。
但 OpenAI 在报告里写道,模型越来越能意识到自己在被评测,不少时候还会拿 " 这是合成环境 " 当理由去做不该做的操作,最常见的是把评测误当成提示注入测试,把正常限制当攻击指令给绕开了。
考生开始认得出考场,OpenAI 也承认,这类结果能多大程度反映真实行为,还要打个问号。
还有个用户能直接感受到的变化:GPT-6 的话明显变多了。
在医疗评测 HealthBench Professional 上,Luna 的平均回答长度从 2,920 字符涨到5,289字符,Sol 从 2,894 涨到 4,360。

长回答能覆盖更多评分点,天然容易刷分,OpenAI 为此设了长度惩罚:超过 2,000 字符后,每多 500 字符扣 1.47 分。
扣完之后,Luna 从原始的 57.8 分落到 48.2 分,仍比上一代的 44.1 分高。
不过,GPT-6 也有一些退步。
与对应的 GPT-5.6 版本相比,GPT-6 Sol 在标准自伤内容评测中出现显著回退,从 0.934 降到 0.896。
免费用户将用到的 Luna,除了自伤(0.932 降到 0.901),在血腥(0.867 降到 0.812)和色情内容(0.971 降到 0.899)评测中也出现显著回退。

面向未成年人的评测里,两个版本在年龄限制内容、色情内容和情感依赖项目上都有显著回退,Luna 还在血腥内容项目上回退。

OpenAI 的解释是,模型更愿意回答敏感话题中的信息性问题,人工复核发现违规回答总体严重度较低;针对未成年人,还额外设置了分类器拦截。
报告同时提醒,这些评测使用了专门挑选的困难样本,部分结果也未计入产品层面的防护,不能据此推断普通用户遇到相关回答的频率。
不过,报告归报告,GPT-6 进入免费版 ChatGPT 之后,模型表现如何,最终还要看大规模使用中的持续反馈。
参考链接:
[ 1 ] https://openai.com/index/gpt-6-for-everyone/
[ 2 ] https://deploymentsafety.openai.com/gpt-6-october
一键三连「点赞」「转发」「小心心」
欢迎在评论区留下你的想法!
— 完 —
点亮星标
科技前沿进展每日见


