术语表
本表收录 宁享Token 文档中使用的专业术语,便于开发者理解 API 概念。
基础概念
| 术语 | 英文 | 说明 |
|---|---|---|
| API Key | API Key | 访问 宁享Token API 的密钥,在控制台创建 |
| Base URL | Base URL | API 访问基础地址,宁享Token 为 `` |
| 白标 | White-label | 平台名称、货币、URL 等可自定义的机制 |
| 端点 | Endpoint | API 的具体路径,如 /v1/chat/completions |
| SDK | Software Development Kit | 官方提供的开发工具包,如 OpenAI Python SDK |
Token 相关
| 术语 | 英文 | 说明 |
|---|---|---|
| Token | Token | 模型处理文本的最小单位,约等于 0.5~1 个汉字或 0.25 个英文单词 |
| Prompt | Prompt | 输入给模型的提示文本,包括 system / user / assistant 消息 |
| Completion | Completion | 模型生成的内容 |
| 输入 Token | Input Token / Prompt Token | 请求中所有消息(system + 历史 + 当前)消耗的 Token 数 |
| 输出 Token | Output Token / Completion Token | 模型响应生成的 Token 数 |
| 思考 Token | Thinking Token | 思考模式下模型推理过程消耗的 Token,计入输出 Token |
| 上下文 | Context | 一次请求中模型能看到的全部文本,包括 system prompt 和历史消息 |
| 上下文长度 | Context Length | 模型单次能处理的最大 Token 数,如 glm-5.2 支持 1M |
| 最大输出 | Max Output | 模型单次响应能生成的最大 Token 数,受 max_tokens 参数限制 |
| 上下文缓存 | Context Cache | 对相同前缀的上下文进行缓存以降低费用,命中部分按缓存价计费 |
对话相关
| 术语 | 英文 | 说明 |
|---|---|---|
| 消息 | Message | 对话中的单条内容,包含 role 和 content |
| 角色 | Role | 消息的角色:system / user / assistant / tool |
| System Prompt | System Prompt | 系统提示词,定义助手的行为约束 |
| 流式输出 | Streaming | 响应以 SSE 格式逐步返回,而非一次性返回 |
| SSE | Server-Sent Events | 流式输出的传输协议 |
| 思考模式 | Thinking Mode | 模型在回答前进行显式推理,输出包含 <think> 标签 |
| Function Calling | Function Calling / Tool Use | 模型根据工具定义生成调用参数的能力 |
| JSON 模式 | JSON Mode | 强制模型输出合法 JSON 格式 |
| 多模态 | Multimodal | 模型能同时处理文本、图像、音频等多种输入 |
限流相关
| 术语 | 英文 | 说明 |
|---|---|---|
| RPM | Requests Per Minute | 每分钟请求数 |
| TPM | Tokens Per Minute | 每分钟 Token 数(输入+输出) |
| 并发数 | Concurrency | 同时处理中的请求数 |
| 速率限制 | Rate Limit | 对 RPM / TPM / 并发数的限制 |
| 指数退避 | Exponential Backoff | 重试策略,每次失败后等待时间翻倍 |
模型相关
| 术语 | 英文 | 说明 |
|---|---|---|
| LLM | Large Language Model | 大语言模型,如 glm-5.2、deepseek-v4-pro |
| TTS | Text-to-Speech | 语音合成,将文本转为语音 |
| ASR | Automatic Speech Recognition | 语音识别,将语音转为文本 |
| Embedding | Embedding | 嵌入向量,将文本转为向量用于检索 / 聚类 |
| Rerank | Rerank | 重排,对检索结果重新排序 |
| 文生图 | Text-to-Image | 输入文本生成图像 |
| 图像编辑 | Image Edit | 在原图基础上进行修改 |
| 文生视频 | Text-to-Video | 输入文本生成视频 |
| 图生视频 | Image-to-Video | 输入图片生成视频 |
| 首尾帧 | First/Last Frame | 指定视频开头和结尾的帧图片,控制视频走向 |
| 音频驱动 | Audio-Driven | 用音频驱动图片中的人物 / 形象动起来 |
计费相关
| 术语 | 英文 | 说明 |
|---|---|---|
| 计费单位 | Billing Unit | 计费的粒度:Token / 次 / 字符 / 时长 |
| 按字符计费 | Per Character | TTS 常用,按生成语音的字符数计费 |
| 按时长计费 | Per Duration | ASR 常用,按音频时长(秒/分钟)计费 |
| 按次计费 | Per Request | 图像 / 视频 / 音乐常用,按每次生成计费 |
| 按 Token 计费 | Per Token | 文本对话常用,按输入/输出 Token 数计费 |
| 缓存价 | Cache Price | 命中上下文缓存的输入部分按优惠价计费;缓存命中价因模型而异,以平台定价页为准 |
| 退款 | Refund | 按上游厂商官方返回的计费信息核算:官方明确不计费(或任务未被上游受理)时退还预扣额度;官方已计费的维持计费 |
异步任务
| 术语 | 英文 | 说明 |
|---|---|---|
| 异步任务 | Async Task | 需要较长时间处理的任务,如视频生成 |
| 任务 ID | Task ID | 异步任务的唯一标识 |
| 轮询 | Polling | 客户端定期查询任务状态 |
| 任务状态 | Task Status | processing / succeeded / failed / cancelled |
协议相关
| 术语 | 英文 | 说明 |
|---|---|---|
| OpenAI 兼容 | OpenAI Compatible | API 格式与 OpenAI 官方一致,可直接用 OpenAI SDK 接入 |
| Anthropic 兼容 | Anthropic Compatible | API 格式与 Anthropic 官方一致 |
| Gemini 兼容 | Gemini Compatible | API 格式与 Google Gemini 官方一致 |
| Responses API | Responses API | OpenAI 新一代对话端点,部分模型支持 |
素材库相关
| 术语 | 英文 | 说明 |
|---|---|---|
| 素材 | Asset | 图片、视频、音频等媒体文件 |
| 素材组 | Asset Group | 素材的逻辑分组,如真人组、AIGC 组 |
| client_key | Client Key | 即 API Key,素材按此隔离 |
| 活体认证 | Liveness | 真人活体检测,用于真人音色 / 形象认证 |
