云头条 20小时前
DeepSeek 又将 AI 价格打穿了!单项任务仅 2 分:Fable 5 高达 21 元
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

2026 年 8 月 3 日,AI 评测机构 Artificial Analysis 发布的数据显示,DeepSeek-V4-Flash 已成为全球主流大模型中运行成本最低的模型,其完成一轮标准化基准测试的平均费用仅约 0.03 美元,明显低于其他模型。

Artificial Analysis 测试显示,DeepSeek V4 Flash 0731 智能指数为 50 分,输出速度约为每秒 55 个 Token,完成一项 Intelligence Index 标准任务的加权平均成本仅为 0.03 美元(0.2 元)。

按照 DeepSeek 公布的 API 价格,V4-Flash 每百万输入 Token 收费 0.14 美元,每百万输出 Token 收费 0.28 美元。

Artificial Analysis 结合不同测试所消耗的输入、输出及缓存 Token,计算了各模型完成同一组评测任务的实际费用。

结果显示,DeepSeek-V4-Flash 跑完测试平均仅需 0.03 美元。

相比之下,月之暗面 Kimi K3 约为 0.86 美元,是其约 29 倍;OpenAI GPT-5.6 Sol 约为 1.86 美元,是其 62 倍;Anthropic Claude Fable 5 约为 3.15 美元(21.27 元),超过其 100 倍。

需要注意的是,这里的 0.03 美元并非用户每次调用模型的固定价格,而是 Artificial Analysis 按照统一基准测试任务的 Token 消耗量计算出的平均运行费用,主要用于比较不同模型完成相同任务时的成本。

Artificial Analysis 数据显示,DeepSeek V4 Flash 完整跑完 Intelligence Index 全部评测仅需 72 美元,而 GPT-5.6 Sol、Claude Opus 4.8 和 Claude Fable 5 分别需要 2824 美元、3836 美元和 5631 美元,最高相差约 78 倍。

低价并未完全以牺牲性能为代价。

Artificial Analysis 评测结果称,V4-Flash 在其 Intelligence Index 智能指数中获得 50 分,与 Google Gemini 3.6 Flash 相当,略低于 Meta Muse Spark 1.1 和智谱 GLM-5.2。

Artificial Analysis 的智能指数综合多项知识、科学推理、编程、工具调用和长上下文测试。其价格指标则会按照缓存输入、普通输入和输出 Token 的不同比例计算综合成本,并非只比较厂商公布的单一输出价格。该机构当前默认采用 7 ∶ 2 ∶ 1 的缓存输入、普通输入和输出比例计算综合价格。

DeepSeek 于 4 月发布 V4 系列,其中 V4-Flash 总参数量为 2840 亿,每次推理激活 130 亿参数,定位为高速、低成本版本;V4-Pro 总参数量为 1.6 万亿,每次激活 490 亿参数,面向更复杂的推理任务。两款模型均支持最高 100 万 Token 上下文,并开放模型权重。

Artificial Analysis 的最新追踪页面显示,按照其 7 ∶ 2 ∶ 1 综合价格口径,V4-Flash 每百万 Token 的综合成本约为 0.06 美元,输出速度约为每秒 107 个 Token;开启更高推理强度后,速度最高可达到每秒 113 个 Token。

DeepSeek 此前已凭借低价 API 和开放权重模型推动行业降价。

V4-Flash 进一步将主流模型的运行成本压低至几美分水平,使大规模客服、内容处理、搜索、编程辅助和智能体任务的部署成本继续下降。

与此同时,国内大模型价格竞争持续加剧。

月之暗面、MiniMax、智谱、字节跳动和阿里巴巴均在加快模型更新。

8 月 3 日,阿里巴巴还发布了 Qwen3.8-Max。《阿里放出 Qwen3.8-Max:市值暴涨 1285 亿》

云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai flash
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论