一、案例背景
(一)事件概述
2026年9月9日,中国人工智能大模型领域的头部企业DeepSeek在官方开放平台宣布,将于北京时间2026年9月10日12:00起,调整其flash系列模型的API定价。根据公告,空闲时段输入缓存命中单价降至0.02元/百万Tokens,输入缓存未命中单价降至1元/百万Tokens,输出单价降至4元/百万Tokens;高峰时段价格为空闲时段价格的2倍。
这一调价举措之所以引发广泛关注,是因为距离DeepSeek上一轮大幅涨价(8月13日,V4 Pro正式版上线时宣布API涨价,最高涨幅达11倍)还不到一个月。此次降价被市场普遍解读为对上一轮涨价策略的”部分回调”——缓存命中输入价格降幅达60%,缓存未命中输入价格降幅约33%,输出价格降幅约11%。有开发者根据自身Agent工作流估算,综合调用成本可能下降约40%。
值得注意的是,此次降价并非全面回到涨价前水平。与8月涨价前相比,flash系列的缓存命中和未命中输入价格已在空闲时段回到此前的0.02元和1元,但输出价格仍由此前的2元上涨至4元,维持在涨价后的水平。这一”有选择性”的调价策略,折射出DeepSeek在市场竞争与商业变现之间的微妙平衡。
(二)企业背景
DeepSeek是中国领先的人工智能大模型研发企业,专注于通用人工智能(AGI)技术的研发与应用。自2024年发布DeepSeek-V2系列模型以来,公司凭借出色的技术能力和极具竞争力的定价策略,迅速在AI大模型市场中占据重要地位。其API服务面向全球开发者,广泛应用于自然语言处理、计算机视觉、代码生成、智能客服等多个领域。
DeepSeek的商业模式主要依托于API调用收费,按Token使用量计费,同时采用”峰谷分时定价”策略——工作日9:00-12:00、14:00-18:00为高峰时段,其余时间为闲时时段。这种定价模式在AI大模型行业中较为独特,旨在引导开发者将非实时性任务调度至闲时执行,以优化算力资源利用效率。
……