做AI小工具的模型成本:DeepSeek输入缓存未命中空闲时段1元起,高峰时段价格翻倍

按 DeepSeek 官方 API 文档2026年10月1日页面,deepseek-flash 输入缓存未命中价为空闲时段每百万 tokens 1元、高峰时段每百万 tokens 2元;空闲时段价格是高峰时段的一半。做 AI 小工具时,调用时段会直接影响模型成本,DeepSeek 与阿里云百炼的计费方式也不同。

DeepSeek的不同时段怎么收费?

DeepSeek 官方定价页按北京时间划分高峰与空闲时段:

时段 时间范围 定价关系
高峰时段 周一至周五,不含法定节假日,9:00—12:00、14:00—18:00 标准价格
空闲时段 其余时段,包括周末及法定节假日全天 高峰时段价格的一半

以上为 DeepSeek 官方 API 文档2026年10月1日页面所示规则,价格可能变动,应以平台后台当前页面为准。

缓存未命中和输出,分别多少钱?

截至2026年10月1日,DeepSeek 官方定价页列示:

模型 Token 类型 空闲时段 高峰时段
deepseek-flash 输入缓存未命中 每百万 tokens 1元 每百万 tokens 2元
deepseek-flash 输出 每百万 tokens 4元 每百万 tokens 8元
deepseek-v4-pro 输入缓存未命中 每百万 tokens 4.5元 每百万 tokens 9.0元
deepseek-v4-pro 输出 每百万 tokens 13.5元 每百万 tokens 27.0元

这组价格来自 DeepSeek 官方 API 文档,抓取日为2026年10月1日。平台明确保留修改价格的权利,实际使用时应重新查看官方页面,不能把这张表当成固定报价。

DeepSeek实际怎么扣费?

DeepSeek 的扣减费用等于 token 消耗量乘以模型单价,从充值余额或赠送余额中扣除。两种余额同时存在时,优先扣赠送余额。

按照 DeepSeek 官方 API 文档2026年10月1日页面的建议,应根据实际用量按需充值,并定期查看价格页。计费的关键不只是选模型,还要同时看输入与输出类型、缓存是否命中,以及调用发生在高峰时段还是空闲时段。

阿里云百炼为什么不能只按输入估算?

阿里云百炼按输入 Token 和输出 Token 分别计费。阿里云帮助中心官方价格页2026年10月1日显示,支持 Batch 调用的模型,其输入和输出 Token 单价均按实时推理价格的50%计费。

如果模型支持上下文缓存,则只有输入 Token 享有折扣;Batch 折扣与上下文缓存折扣不能同时生效。因此,比较调用方案时,要把实时推理、Batch 和上下文缓存分开看,不能把两种优惠直接叠加。

百炼的免费额度适用于所有用户吗?

不是。阿里云帮助中心官方价格页2026年10月1日页面注明,相关免费额度仅限华北2(北京)地域,其他地域均无免费额度。

免费额度的有效期为开通百炼、模型发布或申请通过之日起90天内,以较晚者为准。免费额度不能作为其他地域的通用成本依据,实际可用额度仍应查看阿里云当前页面。

除了模型调用,还要看哪些成本?

服务器、域名、客服与获客成本没有统一公开报价,各地、各家不同,应分别看报价。评估 AI 小工具时,也不要遗漏合规成本和运营要求:

Kimi、智谱、字节火山方舟、腾讯混元等其他模型 API 的价格,本页没有取得对应官方价格页原文,因此不作比较。阿里云百炼具体模型逐档单价也不在这里引用,以免把无法可靠对应的表格行列当成准确报价。

常见问题

空闲时段调用一定比高峰时段便宜一半吗?

DeepSeek 官方定价页写明,空闲时段价格为高峰时段价格的一半。适用时段按北京时间划分,周末及法定节假日全天属于空闲时段。具体价格仍以2026年10月1日抓取的官方页面为参考,并以平台当前页面为准。

输入和输出能按同一单价计算吗?

不能。DeepSeek 对输入缓存未命中和输出分别标价;阿里云百炼也明确按输入 Token 和输出 Token 计费。两家平台的价格口径不同,比较时不能只看一个统一单价。

百炼的Batch折扣可以和上下文缓存同时使用吗?

不可以。阿里云帮助中心2026年10月1日页面明确,Batch 折扣与上下文缓存折扣不能同时生效。

百炼其他地域也有免费额度吗?

没有。阿里云帮助中心2026年10月1日页面注明,免费额度仅限华北2(北京)地域,其他地域均无免费额度。

做完模型成本表就能确定小工具的全部支出吗?

还不能。服务器、域名、客服和获客成本因地区与供应商而异,应看报价;面向公众提供生成式 AI 服务涉及的备案与合规要求,也不能仅凭模型价格判断。

资料来源