8 月 12 日深夜,梁文锋的 DeepSeek 与马斯克的 SpaceXAI 同日上新模型,两者在关键评测中各有所长,综合实力旗鼓相当,均逼近全球头部水平。
一、模型性能对比
DeepSeek-V4-Pro:在多项智能体(Agent)相关测试中超过 Anthropic 的 Claude Opus 4.8,表现亮眼
Grok 4.6:在 Artificial Analysis 智能指数中追平 OpenAI 旗舰模型 GPT-5.6 Sol,实力不容小觑
核心差异:DeepSeek 在智能体任务上更突出,Grok 则在通用智能指数对标顶级闭源模型,侧重点不同
二、价格与性价比变化
中美价差收窄:摩根士丹利研报指出,中国大模型 API 价格过去一年上涨,美国闭源模型价格持续下降,双方差距缩小
实际成本:DeepSeek-V4-Pro 暂未涨价,Grok 4.6 单任务成本与 Kimi K3 持平,两款模型均主打高性价比
竞争重心转移:中国大模型市场正从 " 价格战 " 转向 " 智力战 "
三、综合实力判断
结论:两款模型综合实力相当,均大幅逼近全球一线水平,难分伯仲
受益方:压力主要落在 OpenAI 和 Anthropic 等头部厂商身上,行业竞争进一步白热化
观察点:后续需关注双方在落地场景和生态建设上的表现,而非单纯比拼单项评测分数

本文由 AI 生成


登录后才可以发布评论哦
打开小程序可以发布评论哦