发布于 · AI 生成,已对照实时价目自动事实核查 · English
腾讯AI模型在OpenAI兼容API上的应用
太长不看: 腾讯的开源AI模型(如Qwen3 Coder)可通过TokShop等第三方OpenAI兼容API提供商获取,让您无需自建基础设施。按token付费,无最低消费承诺,使用标准OpenAI SDK即可在几分钟内完成集成。本文介绍如何访问腾讯模型、费用多少,以及与其他替代方案的比较。
是什么推动了“腾讯”搜索热潮?
阿里巴巴股价近期下跌5%,净利润下降75%——主要源于巨额AI基础设施投入——这促使投资者和开发者纷纷审视中国科技巨头的AI战略。当人们搜索“腾讯”时,通常想问:腾讯在AI领域做了什么,我该如何使用?
腾讯一直在悄然发布具有竞争力的开源权重模型,尤其是Qwen系列(腾讯通过投资阿里巴巴云部门共同开发)。对开发者而言,实际意义在于:无需接触中国云平台或处理跨境支付障碍,就能试验这些模型。OpenAI兼容API聚合商现已列出多款腾讯关联模型,与其他开源选项并列。
如何通过API访问腾讯模型?
最简单的途径是通过托管开源权重模型的OpenAI兼容API提供商。 例如,TokShop在https://tokshop.xyz/v1提供腾讯的Qwen3 Coder——与OpenAI API相同的base URL模式。
以下是使用标准openai库的最小Python示例:
from openai import OpenAI
client = OpenAI(
base_url="https://tokshop.xyz/v1",
api_key="sk-tok-..." # 来自您的TokShop仪表板
)
response = client.chat.completions.create(
model="qwen3-coder",
messages=[
{"role": "user", "content": "编写一个Python函数来检查字符串是否为回文。"}
]
)
print(response.choices[0].message.content)
同样的调用适用于任何OpenAI SDK——JavaScript、Go、Ruby——或通过纯curl:
curl https://tokshop.xyz/v1/chat/completions \
-H "Authorization: Bearer sk-tok-..." \
-H "Content-Type: application/json" \
-d '{"model": "qwen3-coder", "messages": [{"role": "user", "content": "Hello"}]}'
您只需在https://tokshop.xyz/register使用邮箱和密码注册,然后在仪表板生成API密钥。密钥仅显示一次——请妥善保存。
哪些腾讯模型可用,费用如何?
截至本文撰写时,TokShop上主要的腾讯关联模型是Qwen3 Coder,定价为每百万输入token $2.25,每百万输出token $11.25。 Qwen系列由阿里巴巴开发,但腾讯对其生态系统贡献显著,并在内部使用。
以下是同一平台上与其他开源模型的比较:
| 模型 | 输入(每百万token) | 输出(每百万token) | 上下文窗口 |
|---|---|---|---|
| Qwen3 Coder | $2.25 | $11.25 | 262,144 tokens |
| DeepSeek V3.2 | $0.42 | $0.63 | 128,000 tokens |
| GLM 4.6 | $0.90 | $3.30 | 200,000 tokens |
| Kimi K2 | $0.855 | $3.45 | 131,072 tokens |
定价为预付费积分制,按需付费。每次API调用都会记录精确的token数和USD成本,便于精确追踪支出。如果积分余额归零,您会收到HTTP 402 insufficient_balance错误——不会产生意外账单。
Qwen3 Coder是否值得比更便宜模型多付的溢价?
Qwen3 Coder每token成本约为DeepSeek V3.2的5-18倍,因此仅在确实需要其优势时才应选用。 该模型专精代码生成和软件工程任务,262K上下文窗口可让您在单次请求中传入整个代码库或大型差异。
在以下场景使用Qwen3 Coder:
- 您正在处理跨多个文件的复杂重构
- 您需要分析或修改大型现有代码库
- 您需要专为编程而非通用聊天调优的模型
在以下场景选择DeepSeek V3.2等更便宜的替代方案:
- 您在处理高量、简单任务(样板代码、格式化、文档)
- 每token成本比代码特定质量更重要
- 您的上下文需求在128K tokens以内
对于混合工作负载,许多开发者将简单请求路由到更便宜的模型,将复杂编码任务升级到Qwen3 Coder。由于TokShop使用OpenAI兼容端点,您只需更改model参数即可切换模型——无需修改代码。
通过聚合商使用腾讯模型的诚实权衡是什么?
主要权衡是便利性与控制力。 使用TokShop等第三方API意味着您无需管理基础设施,但依赖其正常运行时间、速率限制和数据处理政策。
优点:
- 零设置——无需GPU集群,无需下载模型权重
- 标准OpenAI SDK兼容性意味着集成工作量最小
- 透明的按token定价,无最低消费
缺点:
- 您将代码和数据发送给第三方服务
- 模型可用性取决于提供商的目录
- 无法获得微调访问权限(至少通过此途径不行)
如果您的组织有严格的数据驻留要求,通过vLLM或Ollama自托管可能是必要的。对于大多数开发工作流、实验和生产原型设计,API路线实施速度要快得多。
常见问题
Qwen3 Coder真的是腾讯模型吗?
Qwen主要由阿里巴巴开发,但腾讯对其生态系统有贡献,并在生产服务中使用Qwen模型。如果您特别需要腾讯的专有模型(如Hunyuan),这些目前未在TokShop上列出——请查看定价页面获取最新目录。
我可以使用OpenAI Python SDK使用腾讯模型吗?
可以。任何OpenAI兼容SDK都可通过将base_url设置为https://tokshop.xyz/v1并传入您的TokShop API密钥来工作。openai Python包、JavaScript SDK等都支持自定义base URL。
使用Qwen3 Coder进行典型编码会话需要多少费用?
生成2,000个输出token的典型会话约需$0.0225(2,000 × $11.25 / 1,000,000)。几个文件上下文的输入token可能额外增加$0.01–$0.05,具体取决于大小。相比之下,DeepSeek V3.2上的相同会话约需$0.002–$0.005——便宜一个数量级,但代码特定调优较少。
文中提到的模型都已上线我们的 OpenAI 兼容 API,按 token 透明计价。 查看价格并获取 API Key →