星途科讯 2小时前
SpaceXAI发布Grok 4.6:推理能力升级,定价低于竞品
index.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

SpaceXAI 近日正式发布大型语言模型 Grok 4.6。该公司表示,新模型在特定领域的表现已超越 Anthropic 的 Claude Fable 5。

SpaceXAI 前身为 xAI,上月因被 SpaceX 收购而完成品牌重塑,并于今年 6 月在纳斯达克创下 IPO 纪录。此次 Grok 4.6 的推出,距离其上一代旗舰模型发布仅间隔一个月。

训练升级与流程优化

据 SpaceXAI 介绍,Grok 4.6 的核心改进在于延长了训练周期,并利用人工智能生成的数据集强化推理能力,同时引入了高质量工程数据。在初始训练后,模型还经历了监督微调(SFT)和强化学习两个开发阶段。

SFT 阶段利用示例提示和预打包答案优化输出格式,重点提升科学和编程任务的处理能力。值得注意的是,SpaceXAI 使用前代模型 Grok 4.5 辅助优化了 Grok 4.6 的 SFT 训练流程。

基准测试与性能表现

在 Artificial Analysis Intelligence Index 评估中,Grok 4.6 获得 61 分,与 OpenAI 的 GPT-5.6 Sol 持平,仅比 Claude Fable 5 低一分。此外,在另外九项基准测试中,Grok 4.6 在三项上表现优于 Claude Fable 5,其中包括评估复杂知识工作能力的 AA-Briefcase,以及涵盖多个行业任务的测试。

SpaceXAI 指出,Grok 4.6 在根据高层描述生成软件原型、创建界面等视觉资产方面表现出色,且在处理长周期项目时具备更强的自我纠错能力。

定价与获取渠道

Grok 4.6 标准版定价为每百万输入令牌 2 美元,输出令牌 6 美元;高速版价格翻倍。开发者可通过编程平台 Cursor(SpaceXAI 于今年 6 月以 600 亿美元收购)及内部工具 Grok Build 使用该模型。

【星途科讯 图文丨伊贝 首发于 ZAKER 科技,转载请注明出处】

评论
大家都在看