DeepSeek下调Flash系列模型调用价格,最高降幅60%
9月9日,DeepSeek开放平台发布公告,宣布将于北京时间2026年9月10日12时起下调Flash系列模型调用价格。
调整后,空闲时段输入缓存命中价格由每百万Token 0.05元降至0.02元,降幅60%;输入缓存未命中价格由1.5元降至1元,降幅约33%;输出价格由4.5元降至4元,降幅约11%。
高峰时段各项价格均为空闲时段价格的两倍,其中输入缓存命中由0.1元降至0.04元,输入缓存未命中由3元降至2元,输出由9元降至8元。高峰时段为北京时间周一至周五9时至12时、14时至18时。
此次调价涉及deepseek-v4-flash和deepseek-v4-flash-vision-exp两款模型,两款模型执行相同的价格调整标准。有开发者根据自身Agent工作流估算,综合调用成本可能下降约40%,实际降幅仍取决于缓存命中率、输入输出Token占比等因素。
此次降价距离DeepSeek上次涨价不到一个月,8月13日,DeepSeek V4 Pro正式版上线时,API价格曾大幅上调。
与8月涨价前相比,此次flash系列的缓存命中和未命中输入价格已回到此前的0.02元和1元,但输出价格仍由此前的2元上涨至4元。
降价前一天,DeepSeek在官方群宣布开始v4.1 flash中间版本内测,称新模型能力更强、速度更快、成本更低。
[本文作者i黑马,i黑马原创。如需转载请联系微信公众号(ID:iheima)授权,未经授权,转载必究。]



