三易生活 16小时前
DeepSeek V4.1 Flash发布,V4 Pro即将下线
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

今天,DeepSeek 宣布推出 DeepSeek   V4.1 Flash,并对现有产品及服务进行调整。据官方透露,经内部及外部多方测试,DeepSeek V4.1 Flash 在性能、费用、速度及任务总用时等指标上,均已超越 DeepSeek V4 Pro。同时,DeepSeek 还将原有快速模式、专家模式和识图模式合并为统一的智能模式,模型可根据任务复杂程度自动调整处理能力。

据了解,DeepSeek V4.1 Flash 是 DeepSeek 全新模型结构系列中尺寸最小的模型,参数规模为 552B,采用 MoE 架构和全新的 Causal-Encoder-Decoder 结构,其输入激活参数为 8B、输出激活参数则是 16B。

该模型支持原生多模态视觉理解,并采用了新的预训练方式以及更大规模的强化学习后训练。缓存方面,DeepSeek V4.1 Flash 大幅缩减了 KV Cache 缓存大小,相较上一代模型对 HBM 的需求减少至 1/4,对 SSD 的需求降低至 1/8。

DeepSeek 此次更新,还涉及 DeepSeek V4 Pro。据官方透露,DeepSeek V4 Pro 将于 9 月 14 日 12 时正式下线,届时现有的 V4 Pro 服务将自动路由至 V4.1 Flash,并按后者的标准计费,但在 V4 Pro 下线前,其价格保持不变。

价格方面,DeepSeek V4.1 Flash 的价格已于 9 月 10 日 12 时生效,其空闲时段每百万 Tokens 输入缓存命中、缓存未命中及输出的价格分别为 0.02 元、1 元和 4 元,高峰时段分别是 0.04 元、2 元和 8 元。

近期,DeepSeek 方面持续更新 V4 系列模型及 API 服务。此前在 7 月 31 日,DeepSeek V4 Flash 正式版 API 上线公测,其 Agent 能力得到增强,并支持 Responses API 与 Codex 接入。8 月 13 日,DeepSeek V4 Pro 正式版发布,新增可调节的推理强度,同时支持 OpenAI Responses API。

8 月 17 日,DeepSeek 宣布实施峰谷定价机制,并大幅上调 API 调用价格。其中,北京时间 9:00-12:00 和 14:00-18:00 为高峰时段,其余为低谷时段,价格为高峰期的一半。不久后在 8 月 23 日,DeepSeek 方面宣布周六与周日全天统一按低谷时段收费。

【本文图片来自网络】

加入收藏 点赞 ( 0 ) 踩 ( 0 )

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

flash 元和 高峰 ssd
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论