Skip to content

文本模型 ​

宁享Token 接入了多家主流大模型厂商的文本对话模型,全部通过 OpenAI 兼容协议(/v1/chat/completions)统一暴露,调用方只需切换 model 字段即可在不同厂商之间无缝迁移。

模型清单 ​

文本模型

模型厂商输入 (¥/M)输出 (¥/M)思考工具缓存
claude-opus-5Anthropic35175✓✓✓
claude-opus-4-8Anthropic35175✓✓✓
claude-opus-4-7Anthropic35175✓✓✓
claude-opus-4-6Anthropic35175✓✓✓
claude-sonnet-5Anthropic1470✓✓✓
claude-sonnet-4-6Anthropic21105✓✓✓
claude-haiku-4-5Anthropic735✓✓✓
claude-haiku-4-5-20251001Anthropic735✓✓✓
claude-fable-5Anthropic70350✓✓✓
claude-fable-5-1Anthropic70350✓✓✓
gpt-6-astraOpenAI21105—✓✓
gpt-5.6-solOpenAI28140✓✓✓
gpt-5.6-terraOpenAI1484✓✓✓
gpt-5.6-lunaOpenAI1.48.4✓✓✓
gpt-5.5OpenAI35210✓✓✓
gpt-5.4OpenAI17.5105✓✓✓
gpt-4oOpenAI17.570—✓✓
gemini-3.1-proGoogle1484✓✓✓
gemini-3.1-pro-previewGoogle1484✓✓✓
gemini-3.6-flashGoogle5.2526.25✓✓✓
gemini-3.5-flashGoogle10.563✓✓✓
gemini-3-flashGoogle3.521✓✓✓
gemini-3-flash-previewGoogle3.521✓✓✓
gemini-3.1-flash-liteGoogle1.7510.5✓✓✓
deepseek-v4-pro深度求索927✓✓✓
deepseek-v4-pro-0813深度求索927✓✓✓
deepseek-v4-flash深度求索28✓✓✓
deepseek-v4-flash-0731深度求索28✓✓✓
deepseek-v4.1-flash深度求索28✓✓✓
deepseek-v4.1-flash/tx深度求索28✓✓✓
glm-5.3-flash智谱0.82.8✓✓✓
glm-5.3智谱828✓✓✓
glm-5.2智谱828✓✓✓
glm-5.1智谱624✓✓✓
glm-5智谱418✓✓✓
glm-4.7智谱28✓✓✓
kimi-k3月之暗面20100✓✓✓
kimi-k2.6月之暗面6.527✓✓✓
kimi-k2.7-code月之暗面6.527✓✓✓
kimi-k2.5月之暗面421✓✓✓
minimax-m3MiniMax2.18.4✓✓✓
minimax-m2.7MiniMax2.18.4✓✓✓
minimax-m2.5MiniMax2.18.4✓✓✓
qwen3.8-max阿里云1236✓✓✓
qwen3.7-plus阿里云28✓✓✓
qwen3.6-plus阿里云212✓✓✓
doubao-seed-2.0-pro字节跳动3.216✓✓✓
doubao-seed-2.0-code字节跳动3.216✓✓✓
doubao-seed-2.0-lite字节跳动0.63.6✓✓✓
doubao-seed-2.0-mini字节跳动0.22✓✓✓

以下价格均为各厂商官方公开标准价(元/百万 tokens,CNY)。平台折扣(如中邮建专项折扣)通过用户/分组特别配置实现,不在基准价中体现。

分档与峰谷说明 ​

DeepSeek 系峰谷时段:高峰 = 北京时间周一至周五 09:00-12:00、14:00-18:00;空闲(谷)时段 = 上述峰段之外的时间,以及周六/周日全天,输入/输出均为上表价格的 5 折。上表所列为高峰价。日期类型按星期判定:法定节假日不再自动按空闲(谷)计费,如需对某日按节假日口径计费,须在后台为该日期显式配置节假日时段;未配置时按该日所在星期计价(例:落在周一至周五的法定假日,09:00-12:00 / 14:00-18:00 按高峰价计费)。官方定价页参考:api-docs.deepseek.com。

  • deepseek-v4-pro / deepseek-v4-pro-0813:谷时半价 4.5/13.5
  • deepseek-v4-flash:谷时半价 1/4
  • deepseek-v4-flash-vision-exp:已下架/暂未开放(基准 /v1/models 未上架);历史口径为与 deepseek-v4-flash 同价同峰谷(谷时半价 1/4)
  • glm-5.1:<32K 档;≥32K 为 8/28
  • glm-5:<32K 档;≥32K 为 6/22
  • minimax-m3:≤512K 档;>512K 为 4.2/16.8
  • qwen3.7-plus:≤256K 档;256K-1M 为 6/24
  • qwen3.6-plus:≤256K 档;256K-1M 为 8/48
  • doubao-seed-2.0-pro:≤32K 档;32K-128K 4.8/24;128K-256K 9.6/48
  • doubao-seed-2.0-code:同 doubao-seed-2.0-pro 三档
  • doubao-seed-2.0-lite:≤32K 档;32K-128K 0.9/5.4;128K-256K 1.8/10.8

缓存计费 ​

缓存命中的输入部分按缓存价计费;缓存命中价因模型而异,以平台定价页为准。

厂商原生格式 ​

除 OpenAI 兼容格式外,还支持以下厂商原生协议:

  • Anthropic:/v1/messages(Claude 原生格式)
  • Google:/v1beta/models/*(Gemini 原生格式)

下一步 ​

© 2026 宁享Token. 保留所有权利。