经济观察报 见习记者 刘思璇
7月至今,不少DeepSeek用户在社交媒体发帖称,在APP内使用专家模式对话,模型常会在整点时刻弹出“服务器繁忙”,对话中断几分钟至十余分钟不等。
一位经常在深夜时段使用DeepSeek的用户称,这一现象并非开始于7月,但从7月中旬起服务崩溃越发频繁,常发生于每天0点至5点之间的整点时刻,“主要出现在使用专家模式时,白天发生的概率比晚上低很多。”另有用户记录,7月18日至8月4日,18天内,她共遭遇20次“服务器繁忙”,其中14次为整点或整点前后5分钟内。
经济观察报记者实测发现,在APP内使用快速模式,通常不会有类似情况发生;在专家模式聊到一半,如果遭遇服务器繁忙,新建对话且提出较短问题,较大概率能得到模型回复。
“夜里使用DeepSeek一般是要赶工作进度,或者探讨一些生活中遇到的问题,上下文会很长,新建对话要重新描述背景信息,描述一长,服务器又会繁忙。”前述用户表示,遇到这种情况,除了不断刷新回答、等待服务器恢复,基本没有别的办法;APP会建议用户尝试转用快速模式,但模式选择发生在对话建立前,对话中APP并未提供切换模式按钮,“直接输入文字让DeepSeek切换模式,有可能成功”。
在DeepSeek官方表述中,快速模式适用于日常对话,可做到即时响应;专家模式擅长处理复杂问题,但“资源紧张”。
为何DeepSeek专家模式会在特定时段容易响应失败?一位大模型产品经理告诉记者,这与C端用户的使用习惯有关,专家模式消耗更大算力,使用人数会在某些时点明显集中,造成临时性的资源紧张。“比如下午两点、三点,大多数用户在上班,要用模型处理工作;深夜零点,一些人设置的定时任务启动了,AI Agent(智能体)自动跑任务”。
有调用DeepSeek API的用户表示,与APP相比,API的调用更稳定些,遭遇服务器繁忙频次较低。前述产品经理称,API需要用户付费调用,资源分配上的优先级一般比免费版更高。
不过,API即将迎来大幅涨价。8月6日, DeepSeek在开发者后台挂出一则预告:计划近期整体上调DeepSeek API服务的定价,预计涨幅较大。
这是近4个月来DeepSeek启动的第4次调价:4月底,V4上线,被称为“Token(词元)价格屠夫”;5月22日,V4模型的“限时2.5折优惠”转为永久降价,输入价格降至原定价1/4;6月底,引入峰谷定价,工作日高峰时段,所有API调用计费项翻倍,夜间等平峰期维持原价。以V4-Flash为例,非高峰时段缓存未命中输入1元/百万Token、输出2元/百万Token;高峰时段这两项变为2元和4元。
极低的价格,让DeepSeek收获一批用户,吞吐量呈指数级爆发。全球模型API分发平台OpenRouter数据显示,7月27日至8月2日,DeepSeek V4 Flash以7.22万亿Token的周调用量位居第一。
直到8月4日上午,DeepSeek系统“因前所未有的访问量而出现容量不足问题”,算力集群承压再次显现。环顾行业第一梯队,阿里、腾讯、字节等厂商拥有规模更大的GPU集群,而DeepSeek长期依赖租用/第三方算力为主,服务侧承压。
有消息称,DeepSeek正计划在内蒙古乌兰察布建设一座约1吉瓦(GW)的AI数据中心,采用自建与外部租赁并行的模式,部分算力预计2027年底至2028年初上线。

