快速开始

TokModel 提供与 OpenAI 完全兼容的 API。只需把 base_url 指向 TokModel、换成你的 API Key,现有代码即可运行。三步完成首次调用:

获取 API Key

登录 控制台 → API Keys → 创建 Key。Key 仅显示一次,请立即保存。

指向 TokModel

把 base_url 设为 https://tokmodel.cn/v1,无需改动其它代码。

发起调用

选择任意模型 ID 发起请求,实时计费,按量付费。

python · 首次调用
from openai import OpenAI

client = OpenAI(
    base_url="https://tokmodel.cn/v1",
    api_key="tm_your_saved_key",
)

resp = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)
可通过 OpenAI SDK 配置自定义 base_url 接入;具体参数及能力以所选模型支持情况为准。

认证方式 #

所有请求通过 HTTP Header 中的 Authorization 携带 API Key 进行认证,格式为 Bearer Token:

http header
Authorization: Bearer tm_your_saved_key
请勿将 API Key 提交到客户端代码或公开仓库。建议在服务端保管,并通过环境变量注入。

模型列表 #

调用时在 model 字段填入当前可用的模型 ID。可用型号及能力以模型列表和账号权限为准。下方代码中的型号仅作示例,调用前请核对。

完整模型与实时价格见 模型列表 页面,也可通过 API 查询:

GET /v1/models

对话补全 #

核心接口,与 OpenAI chat.completions 一致。

POST /v1/chat/completions

请求体

参数类型说明
model必填string模型 ID,如 deepseek-v4.1-flash
messages必填array对话消息数组,含 role 与 content
stream可选boolean是否流式返回,默认 false
temperature可选number采样温度,0–2,默认 1
max_tokens可选integer最大生成 tokens

流式输出 #

设置 stream: true 后,响应以 Server-Sent Events(SSE)逐 token 推送,适合对话界面实时渲染。

python · 流式
stream = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "写一首关于春天的诗"}],
    stream=True,
)
for chunk in stream:
    delta = chunk.choices[0].delta.content
    if delta:
        print(delta, end="")

请求参数 #

对话补全的完整参数说明见上方 对话补全 一节。多模态与视频生成模型的参数略有不同,参考对应模型详情。

Python 示例 #

安装官方 SDK:pip install openai

python
import os
from openai import OpenAI

client = OpenAI(
    base_url="https://tokmodel.cn/v1",
    api_key=os.environ["TOKMODEL_KEY"],
)

resp = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[
        {"role": "system", "content": "你是专业翻译"},
        {"role": "user", "content": "把这段话译成英文:人工智能正在改变世界"},
    ],
    temperature=0.3,
)
print(resp.choices[0].message.content)
print(f"本次消耗: {resp.usage.total_tokens} tokens")

Node.js 示例 #

安装:npm install openai

javascript
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://tokmodel.cn/v1",
  apiKey: process.env.TOKMODEL_KEY,
});

const resp = await client.chat.completions.create({
  model: "deepseek-v4.1-flash",
  messages: [{ role: "user", content: "你好" }],
});
console.log(resp.choices[0].message.content);

cURL 示例 #

bash
curl https://tokmodel.cn/v1/chat/completions \
  -H "Authorization: Bearer $TOKMODEL_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4.1-flash",
    "messages": [{"role": "user", "content": "你好"}]
  }'

错误码 #

出错时返回标准 HTTP 状态码与 JSON 错误体。失败调用不计费。

状态码含义处理建议
400请求参数错误检查 model、messages 格式
401API Key 无效或已禁用检查 Key 是否正确、是否过期
402余额不足前往控制台充值
403无权访问该模型检查 Key 的模型权限范围
429触发限流降低并发,指数退避重试
500上游模型异常稍后重试,或切换备用模型

计费说明 #

  • 按量付费:仅按实际消耗的 tokens 计费,无月费、无最低消费。
  • 输入 / 输出分开计费:缓存命中部分按更低费率计算。
  • 失败不计费:任何返回错误的调用都不产生费用。
  • 实时账单:每次调用的费用可在控制台「使用日志」中追溯。

价格见 模型列表,账单见 控制台。

常见问题 #

支持哪些模型?

当前在售型号请查看 模型列表;可调用范围以账号权限及接口返回为准。

和官方 API 有区别吗?

对话接口采用 OpenAI 兼容格式;具体参数与能力请核对当前模型。

数据安全吗?

请求内容仅用于转发,不用于模型训练或出售;国内部署,数据不出境。

更多问题见 常见问题页,或联系 技术支持。