经济观察报 见习记者 刘思璇
7 月至今,不少 DeepSeek 用户在社交媒体发帖称,在 APP 内使用专家模式对话,模型常会在整点时刻弹出 " 服务器繁忙 ",对话中断几分钟至十余分钟不等。
一位经常在深夜时段使用 DeepSeek 的用户称,这一现象并非开始于 7 月,但从 7 月中旬起服务崩溃越发频繁,常发生于每天 0 点至 5 点之间的整点时刻," 主要出现在使用专家模式时,白天发生的概率比晚上低很多。" 另有用户记录,7 月 18 日至 8 月 4 日,18 天内,她共遭遇 20 次 " 服务器繁忙 ",其中 14 次为整点或整点前后 5 分钟内。
经济观察报记者实测发现,在 APP 内使用快速模式,通常不会有类似情况发生;在专家模式聊到一半,如果遭遇服务器繁忙,新建对话且提出较短问题,较大概率能得到模型回复。
" 夜里使用 DeepSeek 一般是要赶工作进度,或者探讨一些生活中遇到的问题,上下文会很长,新建对话要重新描述背景信息,描述一长,服务器又会繁忙。" 前述用户表示,遇到这种情况,除了不断刷新回答、等待服务器恢复,基本没有别的办法;APP 会建议用户尝试转用快速模式,但模式选择发生在对话建立前,对话中 APP 并未提供切换模式按钮," 直接输入文字让 DeepSeek 切换模式,有可能成功 "。
在 DeepSeek 官方表述中,快速模式适用于日常对话,可做到即时响应;专家模式擅长处理复杂问题,但 " 资源紧张 "。
为何 DeepSeek 专家模式会在特定时段容易响应失败?一位大模型产品经理告诉记者,这与 C 端用户的使用习惯有关,专家模式消耗更大算力,使用人数会在某些时点明显集中,造成临时性的资源紧张。" 比如下午两点、三点,大多数用户在上班,要用模型处理工作;深夜零点,一些人设置的定时任务启动了,AI Agent(智能体)自动跑任务 "。
有调用 DeepSeek API 的用户表示,与 APP 相比,API 的调用更稳定些,遭遇服务器繁忙频次较低。前述产品经理称,API 需要用户付费调用,资源分配上的优先级一般比免费版更高。
不过,API 即将迎来大幅涨价。8 月 6 日, DeepSeek 在开发者后台挂出一则预告:计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大。
这是近 4 个月来 DeepSeek 启动的第 4 次调价:4 月底,V4 上线,被称为 "Token(词元)价格屠夫 ";5 月 22 日,V4 模型的 " 限时 2.5 折优惠 " 转为永久降价,输入价格降至原定价 1/4;6 月底,引入峰谷定价,工作日高峰时段,所有 API 调用计费项翻倍,夜间等平峰期维持原价。以 V4-Flash 为例,非高峰时段缓存未命中输入 1 元 / 百万 Token、输出 2 元 / 百万 Token;高峰时段这两项变为 2 元和 4 元。
极低的价格,让 DeepSeek 收获一批用户,吞吐量呈指数级爆发。全球模型 API 分发平台 OpenRouter 数据显示,7 月 27 日至 8 月 2 日,DeepSeek V4 Flash 以 7.22 万亿 Token 的周调用量位居第一。
直到 8 月 4 日上午,DeepSeek 系统 " 因前所未有的访问量而出现容量不足问题 ",算力集群承压再次显现。环顾行业第一梯队,阿里、腾讯、字节等厂商拥有规模更大的 GPU 集群,而 DeepSeek 长期依赖租用 / 第三方算力为主,服务侧承压。
有消息称,DeepSeek 正计划在内蒙古乌兰察布建设一座约 1 吉瓦(GW)的 AI 数据中心,采用自建与外部租赁并行的模式,部分算力预计 2027 年底至 2028 年初上线。
(作者 刘思璇)
免责声明:本文观点仅代表作者本人,供参考、交流,不构成任何建议。


登录后才可以发布评论哦
打开小程序可以发布评论哦