发布于 · 更新于 · AI 生成,已对照实时价目自动事实核查 · English

DeepSeek V3.2 API 定价详解:百万令牌的真实成本

太长不看: 在 TokShop 上使用 DeepSeek V3.2,处理百万令牌(约 75 万字)的成本为:输入 0.42 美元,输出 0.63 美元。对于单个任务(例如 35,500 令牌的分析),成本仅为几分钱,性价比极高。总账单取决于您的使用场景:输入密集型应用(如文档分析)主要受输入费率影响,而输出密集型任务(如代码生成)则主要由输出费率驱动。

百万令牌在实践中意味着什么?

首先快速回顾一下:令牌是文本块。在英语中,一个令牌大约相当于 0.75 个单词。一百万个令牌大约是 75 万个单词——大约相当于整个《哈利·波特》系列(七本书)的总长度。

但你很少在单次 API 调用中使用一百万个令牌。TokShop 上的 DeepSeek V3.2 模型上下文窗口为 128,000 个令牌。这是你一次请求中可以发送的最大值,包括你的提示词和模型生成的回复。

一次满上下文调用可以容纳的内容:

  • 一份 50 页的技术报告(约 30,000 令牌)
  • 加上一个详细的问题和指令(约 500 令牌)
  • 模型生成一份 5,000 令牌的分析
  • 总计:该次调用使用了约 35,500 个令牌

按照 DeepSeek V3.2 每百万令牌 0.42 美元的输入费率,那 30,500 个令牌的输入成本为 0.0128 美元。5,000 个令牌的输出按每百万令牌 0.63 美元计算,成本为 0.00315 美元。一次彻底的分析:大约 1.6 美分。

这是关键点:对于大多数单个任务,成本仅为几分钱。百万令牌的价格只有在规模化处理时才变得相关。

拆解输入与输出成本

定价的不对称性很重要。DeepSeek V3.2 对每百万输入令牌收费 0.42 美元,对每百万输出令牌收费 0.63 美元——生成成本是输入的 1.5 倍。

为什么会有差异?生成令牌比处理现有文本需要更多的计算。模型必须顺序预测每个单词,这本质上比输入嵌入的并行处理更昂贵。

对于一个典型的聊天机器人会话:

  • 输入密集型用例(例如,文档分析):你发送一个 10,000 令牌的文档并提出一个 200 令牌的问题。模型回复 500 个令牌。总成本:(10,200 × 0.42 美元/百万) + (500 × 0.63 美元/百万) = 0.00428 美元 + 0.000315 美元 = 0.0046 美元。几乎全是输入成本。

  • 输出密集型用例(例如,代码生成):你发送一个 500 令牌的提示词,要求生成一个复杂函数。模型生成 4,000 令牌的代码。总成本:(500 × 0.42 美元/百万) + (4,000 × 0.63 美元/百万) = 0.00021 美元 + 0.00252 美元 = 0.00273 美元。现在输出占主导。

如果你的应用程序生成长响应(摘要、翻译、创意写作),输出费率将是你的主要成本驱动因素。对于需要注入大量上下文文档的 RAG(检索增强生成)流程,输入费率则更为重要。

如何追踪你的实际令牌消耗

TokShop 提供每次 API 调用的精确成本追踪。每个响应都包含令牌计数和精确的美元扣款。你可以在仪表板中或通过编程方式查看。

这是一个使用 OpenAI SDK 检查余额并记录每次调用成本的最小 Python 脚本示例:

from openai import OpenAI

client = OpenAI(
    base_url="https://tokshop.xyz/v1",
    api_key="sk-tok-your-key-here"
)

# 首先检查剩余余额
balance = client.balance.retrieve()  # 注意:请查阅 TokShop 文档获取确切端点
print(f"Remaining credits: ${balance.amount:.2f}")

# 发起调用并查看成本
response = client.chat.completions.create(
    model="deepseek-v3.2",
    messages=[
        {"role": "user", "content": "Explain token pricing in two sentences."}
    ],
    max_tokens=100
)

usage = response.usage
input_cost = (usage.prompt_tokens / 1_000_000) * 0.42
output_cost = (usage.completion_tokens / 1_000_000) * 0.63
total_cost = input_cost + output_cost

print(f"Input: {usage.prompt_tokens} tokens → ${input_cost:.6f}")
print(f"Output: {usage.completion_tokens} tokens → ${output_cost:.6f}")
print(f"Total: ${total_cost:.6f}")

来自 TokShop 的 OpenAI 兼容 API 的响应对象包含 usage.prompt_tokensusage.completion_tokens,与标准 OpenAI 格式相同。你可以记录这些数据以实时监控支出。

对于重度使用,可以考虑批处理请求或缓存常见响应。按照 DeepSeek V3.2 的费率,一百万令牌的输入成本为 0.42 美元——这意味着在输入成本达到 0.42 美元之前,你可以进行大约 13 次满上下文(128k 令牌)请求。

TokShop 上 DeepSeek V3.2 与其他模型的对比

TokShop 除了 DeepSeek V3.2 外还提供多种开源模型。定价差异反映了模型架构、训练数据和推理优化的不同。以下是根据 TokShop 定价页面 进行的直接比较:

模型 输入 (美元/百万令牌) 输出 (美元/百万令牌) 上下文窗口
DeepSeek V3.2 $0.42 $0.63 128k
GLM 4.6 $0.90 $3.30 200k
Kimi K2 $0.855 $3.45 131k
Qwen3 Coder $2.25 $11.25 262k

DeepSeek V3.2 是该平台上价格最低的模型,优势显著——输入成本大约是次便宜的模型(Kimi K2)的一半,输出成本是其五分之一。

但价格并非一切。Qwen3 Coder 每百万令牌定价 2.25 美元/11.25 美元,专门针对代码生成,并提供 262k 的上下文窗口。如果你要处理整个代码库,更大的上下文可能值得支付溢价。GLM 4.6 和 Kimi K2 处于中间位置,其中 Kimi K2 是一个强大的通用模型。

对于成本敏感型应用——聊天机器人、内容摘要、数据提取——DeepSeek V3.2 的定价很难被超越。128k 的上下文足以舒适地覆盖大多数文档和对话。

计费机制:预付费积分和 HTTP 402

TokShop 使用预付费积分系统。你将美元存入账户,每次 API 调用都会从该余额中扣除。如果你的余额降至零,API 将返回 HTTP 402 Payment Required 错误,并附带 insufficient_balance 状态。

这与一些提供商提供的后付费计费(月度发票)不同。优点是没有意外账单——你只能花费已存入的金额。代价是你需要监控余额并在其耗尽前充值。

对于一个小项目,10 美元的积分在 DeepSeek V3.2 上可以走得很远。按每百万输入令牌 0.42 美元计算,10 美元可以购买大约 2380 万输入令牌——足以处理大约 186 次满上下文(128k 令牌)输入。如果你按相同比例生成输出,10 美元预计可获得约 1590 万输出令牌。

一个实用建议:通过 API 定期检查余额来设置低余额警报。TokShop 的仪表板显示你的剩余积分,你可以在进行昂贵的批量调用之前以编程方式检查。

结论

DeepSeek V3.2 每百万输入令牌 0.42 美元和每百万输出令牌 0.63 美元的定价,对于一个拥有 128k 上下文窗口的开放权重模型来说,性价比极高。一次复杂的查询成本仅为几分钱,而一百万令牌大约相当于处理 75 万个单词。

实际成本取决于你的使用模式:输入密集型应用(RAG、文档分析)主要由 0.42 美元的费率主导,而输出密集型任务(代码生成、长文内容)则将平衡转向 0.63 美元的输出费率。无论哪种方式,DeepSeek V3.2 目前都是 TokShop 平台上最实惠的模型。

要查看所有可用模型的详细定价,请查阅 TokShop 定价页面。如果你准备开始,请在 TokShop 注册,生成一个 API 密钥,并将你的 OpenAI 兼容客户端指向 https://tokshop.xyz/v1。令牌计算很简单——而且在这个费率下,你可能会惊讶于几美元能走多远。

常见问题

一次典型的 DeepSeek V3.2 API 调用成本是多少?

一次典型调用,例如分析一份 30,500 令牌的文档并生成 5,000 令牌的回复,成本约为 1.6 美分。对于大多数单个任务,成本仅为几分钱,百万令牌的定价主要在规模化时才变得相关。

为什么 DeepSeek V3.2 的输出比输入更贵?

输出成本更高(每百万令牌 0.63 美元 vs. 输入 0.42 美元)是因为生成令牌需要更多的计算能力。模型必须顺序预测每个单词,这本质上比用于输入嵌入的并行处理更昂贵。

TokShop 的计费系统如何运作?

TokShop 使用预付费积分系统,你存入美元,每次 API 调用都会从该余额中扣除。如果你的余额降至零,API 将返回 HTTP 402 Payment Required 错误。这可以防止意外账单,但需要你监控余额并在需要时充值。

立即体验

文中提到的模型都已上线我们的 OpenAI 兼容 API,按 token 透明计价。 查看价格并获取 API Key →

相关文章