2026年8月6日,国产大模型厂商DeepSeek通过用户后台发布公告,宣布计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,并提醒用户合理安排调用策略、控制充值金额。公告同时强调,具体调价方案与生效时间将以官方正式通知为准。

此次调价之所以引发行业高度关注,与DeepSeek此前在API定价上的激进策略密不可分。自V4系列模型上线以来,DeepSeek凭借远低于海外竞品的价格迅速抢占开发者市场,被业内称为"斩杀线"——以V4-Flash为例,其输出价格仅为2元/百万Token,缓存命中输入更是低至0.02元/百万Token,完成同等基准测试任务的成本仅为Anthropic Claude Fable 5的约百分之一、OpenAI GPT-5.6 Sol的数十分之一。

然而,极致低价的背后是巨大的算力压力。V4-Flash上线后,单模型周调用量一度突破数万亿Token,多次登顶全球调用榜首,工作日高峰时段接口超时、卡顿频发。为此,DeepSeek在7月中旬率先引入了峰谷定价机制——工作日9:00–12:00和14:00–18:00高峰时段全部价格翻倍,凌晨及周末执行平峰原价,试图通过价格杠杆引导非紧急任务错峰运行。

此次整体调价,可视为DeepSeek在"用户规模扩张"与"算力资源可持续性"之间寻求新平衡的进一步举措。官方公告也明确指出,调价旨在优化资源投入与服务可持续性。

一方面,此前国产大模型经历了多轮"价格战",从阿里Qwen、字节豆包到月之暗面Kimi,各家纷纷以低价抢占市场份额。但当模型能力逐渐趋同、算力成本成为硬约束时,持续低价的商业模式面临严峻考验。棱镜咨询创始人况玉清指出:"当模型能力相差不大时,竞争核心转向性价比,这将直接压缩头部厂商的定价能力和盈利空间。"

另一方面,燕基空间研究中心何基永提醒,价格只是"入场券",企业最终比较的不是每百万Token的标价,而是完成一项任务的总成本——包括准确率、响应速度、重试次数和人工干预成本。"单位有效产出成本"才是衡量大模型服务价值的真正标尺。