
就在刚刚,尽管超过了 " 中旬 ",但 " 梁圣 " 也依然在 7 月公布了正式版。
智能纪元 AGI 7 月 31 日消息,一小时前,Deepseek 网站公布,DeepSeek V4 Flash 更新到正式版,Agent 能力大幅提升,针对 Codex 做了适配,性能超过了 V4 Pro 的 Preview 版本。
具体来说,DeepSeek-V4 新版本原生支持 Responses API,单模型结构和参数规模没有变化,主要重新进行了后训练。
DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练。而本次只升级 API 接口,DeepSeek App 和网页端没有更新。V4-Pro 正式版仍未发布,官方称将尽快上线。
评测成绩方面如下:
- Terminal Bench 2.1: 82.7
- NL2Repo: 54.2
- Cybergym: 76.7
- DeepSWE: 54.4
- Toolathlon verified: 70.3
- Agent Last Exam: 25.2
- Automation Bench ( Public ) : 25.1
- DSBench-FullStack: 68.7
- DSBench-Hard: 59.6
先回顾一下,DeepSeek-V4 这几个月发生了什么。
4 月 24 日:V4 预览版发布,权重开源
Pro 和 Flash 一起放出来,全系百万上下文,权重直接开源,适配了国产芯片。开发者圈子里当天就开始拉代码跑起来。从这天起,DeepSeek 不再只是梁文锋自己的实验室了。
4 月底到 5 月:开始找外面的钱
此前 DeepSeek 只花母公司自有资金。算力、招人、机房三头烧钱,顶不住了,首轮对外融资启动,头部机构陆续进场。
5 月 22 日:API 降价四分之三
V4-Pro 接口价格直接砍到原来四分之一。企业端和独立开发者涌入,国内模型接口价格被拉到新的基准线。
6 月中旬:首轮融资关闭
约 500 亿人民币,投后估值超 500 亿美元。DeepSeek 梁文锋本人是最大出资方,超过 200 亿元;腾讯、宁德时代跟投。股权结构上创始人保留强控制。钱到账后,算力基建和 IDC 岗位大规模开招,自建数据中心进入实质筹备。
6 月底:Pre-IPO 消息传出,同时推峰谷计费
首轮融资刚关六周,市场传出第二轮消息,目标至少 100 亿,估值继续往上抬。找会计师事务所进场整理账目,IPO 准备已经开始。同一时段,V4 正式版规划对外公布,工作日高峰时段接口价格翻倍,用价格杠杆缓解算力挤兑。
7 月 19 日到 31 日:V4 正式版灰度上线
Flash 正式版先开放公测,Pro 版还在打磨。老版本模型进入下线倒计时。
7 月 26 日:第二轮融资暂停
梁文锋口头通知部分投资方,融资协议签署暂时搁置。没有说终止,但一级市场上已经炸开了锅。
今天还有两个消息:一个是 DeepSeek 计划在内蒙古建设大型 AI 数据中心,增加 1GW 算力;二是梁文锋的幻方投资了长鑫科技,得到了超过 8 亿的回报。
过去三个月时间线,我们拆开看:产品从 Preview 到正式版,一路开源降价抢开发者。资本侧从零外部融资到首战 500 亿,六周后就推进 Pre-IPO,中间插进来第二轮被迫踩刹车。几条线全撞在一起了。
当前,DeepSeek 面临两个重要事件:
1、Kimi K3 重现了 DeepSeek 时刻,对于梁文锋来说,这是一个紧迫找回 " 主场 " 的时刻。尤其国内对于开源 AI 模型的支持力度,这会影响接下来 DeepSeek 商业化。
2、智谱 GLM 上调接口定价、MiniMax 全新 H3 模型落地,行业竞争持续收紧,DeepSeek 虽仍稳坐第一梯队牌桌,但被动挤压的态势已然显现。在此局面下,它必须推出具备足够冲击力的产品,打通商业化营收闭环,为后续上市进程进行铺路。
最后谈一下,V4 这四个月,从预览到 Flash 正式公测,没有发布会,没有高管站台。
但技术取舍很清晰:每一步都在换东西,开发者数量,或者资本市场的信心。
先看技术侧做了什么。百万上下文铺到全系,Pro 和 Flash 双线并行,重度研发和轻量商用各走一条。MoE 架构压推理成本,KV 缓存做减法。
而且,国产芯片适配同步完成。
放在 2026 年 4 月的时间点上,长文本太贵、私有化部署难、国产算力跑不动这三个老问题,V4 一次性给了答案。
但答案不是免费的。
API 定价一度砍到原来四分之一,Flash 定价更低,先把中小开发者拉进来。后面再上峰谷调价,高峰翻倍,用价格手段削峰填谷。
逻辑很直白:开发者拿开源权重做二次开发,调用链留在 DeepSeek 的 API 上,每跑一次都是流水。这笔账,养的是未来算力业务的底盘。
产品节奏和融资节奏完全同步。4 月预览版发布、降价、开源,同一个月启动首轮外部融资谈判。6 月 500 亿融资到账,算力扩张等着花钱。7 月 Flash 正式版加速推送,补 Agent 能力,补代码自动化,全是企业客户掏钱买的场景。技术迭代不再跟实验室排期走,它跟钱到账的时间走。
Flash 先上、Pro 后上的顺序也说明问题。轻量版抢先公测,旗舰版继续打磨。
算力就这么多,先保能带来现金流的产品线,高成本的精品往后排。技术优先级排不过商业优先级。
这就撞上了开源模型的结构性矛盾。
你开源,全行业拿去用,自己的技术壁垒就薄了,只能靠 API 调用和私有化部署赚钱。但扩张算力、抢芯片、招人,全要靠融资续命。
对行业敞开底牌,对资本交出估值,两边同时喂,技术路线只能来回摆。
但 PPIO(派想未来)创始人、CEO 姚欣告诉我,梁文锋的 DeepSeek 进行融资,绝不是为了钱,其个人财务、企业体量早已无需依靠商业化、上市获利,融资的核心、初心始终是落地 AGI,而非追逐商业利益。
" 留住人才、做 Coding,梁文锋的这两个判断跟我的看法是很像的。奔向 AGI,不止是模型,今天要有辅助手段:第一个需要有资本化上市用激励团队,第二个需要 Harness、Agent 形成收入,才能实现 AGI。我觉得他的初心和方向和路径依然没有变,他有能力商业化,但不是追求最大商业化,这跟其他纯商业型公司背后有大量 VC 投入、一轮轮涨估值,然后要去讲一个更大的故事,还不太一样。" 姚欣称。
在姚欣看来,DeepSeek V4 系列模型大幅降价 75% 的背后,不是抢占市场、收割利润,而是倒逼行业加速迭代、推动 AI 技术全民普及,推动整个国内 AI 产业快速成熟。
当 DeepSeek V4 跑到了国产开源模型能摸到的最高位置。但它证明的事情可能让人不太舒服:
今天做大模型,技术本身不再是目的,它是资源调度的中间变量。
DeepSeek 算力账、人才账、融资周期,决定你先做什么、后做什么、不做什么。
你怎么看 DeepSeek V4 更新?
© 本文为原创内容
未经授权,禁止转载


登录后才可以发布评论哦
打开小程序可以发布评论哦