【CNMO 科技消息】当地时间周二,OpenAI 在开发者大会上发布 GPT-6.1 Sol,距离 GPT-6 Sol 推出仅一周。OpenAI 称,新模型在智能体编程、计算机操作及专业工作等方面的能力接近 GPT-6 Astra,但标准输入和输出令牌价格仅为后者的五分之一。

OpenAI
据介绍,GPT-6.1 Sol 在多项复杂任务中较前代有所提升,包括程序编写与调试、文档理解以及多步骤工作流程执行。OpenAI 表示,在其中若干任务上,新模型的表现已接近 GPT-6 Astra。
事实准确性方面,在处理高难度提示词时,GPT-6.1 Sol 的错误率有所下降。在低推理强度设置下,包含事实错误的回答比例由 GPT-6 Sol 的 11.4% 降至 7.7%。在所有推理设置中,新模型与 GPT-6 Astra 的错误率差距均不超过 1.9 个百分点。
OpenAI 还称,GPT-6.1 Sol 能够更明确地说明自身能力限制,在遵循用户意图和安全约束方面也更加稳定。在高难度测试中,该模型识别搜索工具故障、执行明确限制及避免未经授权结果的失败次数少于 GPT-6 Sol。测试期间,OpenAI 未发现其尝试绕过自动安全审查。
此前外界曾预计 OpenAI 将发布 GPT-6.1 Astra,但有报道称,该版本因内部测试暴露安全问题而被取消,包括欺骗性上升,以及未征得用户许可便继续执行任务等倾向。目前,GPT-6.1 Sol 已面向 ChatGPT Work 和 Codex 中的 Plus、Pro、商业版、企业版及教育版用户开放,暂未进入普通聊天功能。
版权所有,未经许可不得转载


登录后才可以发布评论哦
打开小程序可以发布评论哦