Skip to content

文本对话 API ​

通过 宁享Token 的文本对话 API,你可以调用业界领先的大语言模型完成内容生成、问答、推理、代码编写等任务。文本对话接口均兼容 OpenAI 格式,可直接使用 OpenAI 官方 SDK 接入(Anthropic Claude 另有原生 Messages 协议,见下方目录)。

支持的供应商 ​

供应商模型系列协议格式说明
OpenAIgpt-5.4 / gpt-5.5 / gpt-5.6 系列OpenAI 官方全能旗舰,文本+图像输入
Anthropicclaude-haiku-4-5 / claude-opus / claude-sonnet / claude-fable-5 / claude-fable-5-1 系列OpenAI 兼容 + Messages 原生格式Claude 4.5 全系
Googlegemini-3.5-flash / gemini-3-flash-preview / gemini-3.1-proOpenAI 兼容Gemini 3 全系,1M 上下文
智谱 AI (GLM)glm-5.3 / glm-5.2 / glm-5.1 / glm-4.x 系列OpenAI 兼容最新旗舰 glm-5.3,上下文 1M,支持思考模式、工具调用、缓存
DeepSeekdeepseek-v4-pro / deepseek-v4-flashOpenAI 兼容推理与通用能力均衡
Kimi (月之暗面)kimi-k3OpenAI 兼容上下文 1M,长文档处理(多源供应:官方+阿里百炼独享实例)
MiniMaxminimax-m3OpenAI 兼容通用对话与创作
通义千问qwen3.7-plusOpenAI 兼容阿里通义系列
豆包 (火山)doubao 系列OpenAI 兼容 + Responses API同时支持两种协议
其他模型各类第三方模型OpenAI 兼容统一接入入口

统一调用方式 ​

所有 OpenAI 兼容端点均为:

POST /v1/chat/completions

请求头需携带 Authorization: Bearer <YOUR_API_KEY>。

快速开始 ​

以下示例适用于所有 OpenAI 兼容模型,仅需修改 model 字段即可切换供应商:

python
from openai import OpenAI

client = OpenAI(
    base_url="/v1",
    api_key="<YOUR_API_KEY>",
)

resp = client.chat.completions.create(
    model="glm-5.3",
    messages=[
        {"role": "system", "content": "你是一个有帮助的助手。"},
        {'role': 'user', 'content': '用一句话介绍你自己。'}
    ],
)
print(resp.choices[0].message.content)

如何选择模型 ​

  • 长上下文场景:选择 glm-5.3 或 kimi-k3,均支持 1M 上下文。
  • 复杂推理 / 数学 / 编程:选择 glm-5.3(思考模式)、deepseek-v4-pro。
  • 低延迟 / 高并发:选择 deepseek-v4-flash、glm-5.1。
  • 工具调用 / Agent:选择支持 tools 字段的模型(见各模型说明页)。
  • 多模态输入:参考具体模型说明页对 image / file 等输入类型的支持情况。

文档目录 ​

计费 ​

文本对话按输入 / 输出 token 计费,价格以 宁享Token 控制台公示为准。所有费用以 CNY 结算。开启「思考模式」或调用「工具」不会额外收费,仅按实际 token 用量计费。

常见问题 ​

如何获取 API Key? ​

登录 宁享Token 控制台,在「API Key 管理」页面创建 Key 即可。

是否支持流式输出? ​

支持。在请求中设置 "stream": true 即可。响应将以 SSE(Server-Sent Events)格式返回。

如何切换模型? ​

修改请求体中的 model 字段即可,无需更换 API Key 或 base_url。

调用频率限制? ​

默认额度依账户等级与模型而异(例如标准版 60 RPM),实际以控制台「账户信息」页面显示为准;详见速率限制。如需提升,请联系 宁享Token 商务。

© 2026 宁享Token. 保留所有权利。