Large Model API Pricing

Explore pricing for our model APIs. Find the right plan for your needs with transparent rates and flexible options.

Anthropic logo

Anthropic

Anthropic的Claude模型提供先进的安全AI能力,专注于有用、无害、诚实的AI助手,具有强大的推理和对话能力。

模型名称Input Token Range上下文Input(/Mt)Cache Write(/Mt)Cache Read(/Mt)Output(/Mt)操作
claude-fable-5官方资源-1M$10$12.5(5m)·$20(1h)$1$50
claude-opus-4-7官方资源-1M
$4.75$5
$5.9375(5m)·$9.5(1h)$6.25(5m)·$10(1h)
$0.475$0.5
$23.75$25
claude-opus-5官方资源-1M$5$6.25(5m)·$10(1h)$0.5$25
claude-sonnet-5官方资源-1M$2$2.5(5m)·$4(1h)$0.2$10
claude-opus-4-8官方资源-1M
$4.75$5
$5.9375(5m)·$9.5(1h)$6.25(5m)·$10(1h)
$0.475$0.5
$23.75$25
claude-opus-4-8-r低价专区-1M
$1$5
$1.25(5m)·$2(1h)$6.25(5m)·$10(1h)
$0.1$0.5
$5$25
claude-opus-4-7-r低价专区-1M
$1$5
$1.25(5m)·$2(1h)$6.25(5m)·$10(1h)
$0.1$0.5
$5$25
claude-opus-4-6-dd低价专区-1M
$2.75$5
$3.4375(5m)·$5.5(1h)$6.25(5m)·$10(1h)
$0.275$0.5
$13.75$25
claude-opus-4-6官方资源1-200K1M$5$6.25(5m)·$10(1h)$0.5$25
200K-1M1M$5$6.25(5m)·$10(1h)$0.5$25
claude-opus-4-6-r低价专区-1M
$1$5
$1.25(5m)·$2(1h)$6.25(5m)·$10(1h)
$0.1$0.5
$5$25
claude-sonnet-4-6官方资源1-200K1M$3$3.75(5m)·$6(1h)$0.3$15
200K-1M1M$3$3.75(5m)·$6(1h)$0.3$15
claude-sonnet-4-6-dd低价专区-1M
$1.65$3
$2.0625(5m)·$3.3(1h)$3.75(5m)·$6(1h)
$0.165$0.3
$8.25$15
claude-sonnet-4-6-r低价专区-1M
$0.6$3
$0.75(5m)·$1.2(1h)$3.75(5m)·$6(1h)
$0.06$0.3
$3$15
claude-opus-4-5-20251101官方资源-200K
$4.75$5
$5.9375(5m)·$9.5(1h)$6.25(5m)·$10(1h)
$0.475$0.5
$23.75$25
claude-opus-4-5-20251101-dd低价专区-200K
$2.75$5
$3.4375(5m)$6.25(5m)
$0.275$0.5
$13.75$25
claude-sonnet-4-5-20250929官方资源1-200K200K$3$3.75(5m)·$6(1h)$0.3$15
200K-1M200K$6$7.5(5m)·$12(1h)$0.6$22.5
claude-sonnet-4-5-20250929-dd低价专区-200K
$1.65$3
$2.0625(5m)$3.75(5m)
$0.165$0.3
$8.25$15
claude-haiku-4-5-20251001官方资源-20K$1$1.25(5m)·$2(1h)$0.1$5
claude-haiku-4-5-20251001-dd低价专区-200K
$0.55$1
$0.6875(5m)·$1.1(1h)$1.25(5m)·$2(1h)
$0.055$0.1
$2.75$5
claude-haiku-4-5-20251001-r低价专区-200K
$0.2$1
$0.25(5m)·$0.4(1h)$1.25(5m)·$2(1h)
$0.02$0.1
$1$5
claude-opus-4-8-cc低价专区-1M
$1.85$5
$2.3125(5m)·$3.7(1h)$6.25(5m)·$10(1h)
$0.185$0.5
$9.25$25
claude-opus-4-6-cc低价专区-1M
$1.85$5
$2.3125(5m)·$3.7(1h)$6.25(5m)·$10(1h)
$0.185$0.5
$9.25$25
claude-opus-4-7-cc低价专区-1M
$1.85$5
$2.3125(5m)·$3.7(1h)$6.25(5m)·$10(1h)
$0.185$0.5
$9.25$25
claude-sonnet-4-6-cc低价专区-1M
$1.11$3
$1.3875(5m)·$2.22(1h)$3.75(5m)·$6(1h)
$0.111$0.3
$5.55$15
claude-haiku-4-5-20251001-cc低价专区-200K
$0.37$1
$0.4625(5m)·$0.74(1h)$1.25(5m)·$2(1h)
$0.037$0.1
$1.85$5
OpenAI

OpenAI

OpenAI的GPT系列模型提供最先进的语言理解和生成能力,在多种任务中表现出色,是业界领先的AI模型。

模型名称Input Token Range上下文Input(/Mt)Cache Write(/Mt)Cache Read(/Mt)Output(/Mt)操作
gpt-5.6-terra-es低价专区1-272K3.7M
$0.2$2
$0.25(30m)$2.5(30m)
$0.02$0.2
$1.2$12
272K-372K3.7M
$0.4$4
$0.5(30m)$5(30m)
$0.04$0.4
$1.8$18
gpt-5.6-luna-es低价专区1-272K372K
$0.02$0.2
$0.025(30m)$0.25(30m)
$0.002$0.02
$0.12$1.2
272K-372K372K
$0.04$0.4
$0.05(30m)$0.5(30m)
$0.004$0.04
$0.18$1.8
gpt-5.6-sol-es低价专区1-272K372K
$0.5$5
$0.625(30m)$6.25(30m)
$0.05$0.5
$3$30
272K-372K372K
$1$10
$1.25(30m)$12.5(30m)
$0.1$1
$4.5$45
gpt-5.6-terra官方资源1-272K1.1M$2$2.5(30m)$0.2$12
272K-1.1M1.1M$4$5(30m)$0.4$18
gpt-5.6-luna官方资源1-272K1.1M$0.2$0.25(30m)$0.02$1.2
272K-1.1M1.1M$0.4$0.5(30m)$0.04$1.8
gpt-5.6-sol官方资源1-272K1.1M$5$6.25(30m)$0.5$30
272K-1.1M1.1M$10$12.5(30m)$1$45
gpt-5.5-r低价专区-1.1M
$0.5$5
-
$0.05$0.5
$3$30
gpt-5.5官方资源1-272K1.1M
$4.75$5
-
$0.475$0.5
$28.5$30
272K-1.1M1.1M
$9.5$10
-
$0.95$1
$42.75$45
gpt-4.1-nano官方资源-1M
$0.095$0.1
-
$0.0237$0.025
$0.38$0.4
gpt-5.5-pro官方资源1-272K1.1M$30--$180
272K-1.1M1.1M$60--$270
gpt-5.4-pro官方资源1-272K1.1M$30--$180
272K-1.1M1.1M$60--$270
gpt-5.4官方资源1-272K1.1M$2.5-$0.25$15
272K-1.1M1.1M$5-$0.5$22.5
gpt-5.4-mini官方资源-400K
$0.7125$0.75
-
$0.0712$0.075
$4.275$4.5
gpt-5.4-nano官方资源-400K
$0.19$0.2
-
$0.019$0.02
$1.1875$1.25
gpt-5.3-codex官方资源-400K
$1.6625$1.75
-
$0.1662$0.175
$13.3$14
gpt-5.2-pro官方资源-400K
$19.95$21
--
$159.6$168
gpt-5.2-codex官方资源-400K$1.75-$0.175$14
gpt-5.2官方资源-400K
$1.6625$1.75
-
$0.1662$0.175
$13.3$14
gpt-5.1-codex-max官方资源-400K
$1.1875$1.25
-
$0.1187$0.125
$9.5$10
gpt-5.1-codex官方资源-400K
$1.1875$1.25
-
$0.1187$0.125
$9.5$10
gpt-5.1-codex-mini官方资源-400K
$0.2375$0.25
-
$0.0237$0.025
$1.9$2
gpt-5.1官方资源-400K
$1.1875$1.25
-
$0.1187$0.125
$9.5$10
gpt-5-pro官方资源-400K
$14.25$15
--
$114$120
gpt-5-codex官方资源-400K
$1.1875$1.25
-
$0.1187$0.125
$9.5$10
gpt-5官方资源-400K
$1.1875$1.25
-
$0.1187$0.125
$9.5$10
gpt-5-mini官方资源-400K
$0.2375$0.25
-
$0.0237$0.025
$1.9$2
gpt-5-nano官方资源-400K
$0.0475$0.05
-
$0.0047$0.005
$0.38$0.4
gpt-4.1官方资源-1M$2-$0.5$8
gpt-4.1-mini官方资源-1M$0.4-$0.1$1.6
gpt-4o官方资源-131.1K
$2.375$2.5
-
$1.1875$1.25
$9.5$10
gpt-4o-mini官方资源-128K
$0.1425$0.15
-
$0.0712$0.075
$0.57$0.6
OpenAI: GPT OSS 20B-131.1K$0.05--$0.2
OpenAI GPT OSS 120B-131.1K$0.1--$0.5
Gemini logo

Gemini

Google的Gemini模型提供高质量的语言处理能力,在各种NLP任务中表现出色,具有强大的多模态能力。

模型名称Input Token Range上下文Input(/Mt)Cache Write(/Mt)Cache Read(/Mt)Output(/Mt)操作
gemini-3.1-flash-lite-1M$0.25$0.083(5m)·$1(1h)$0.025$1.5
gemini-3.5-flash官方资源-1M
$1.425$1.5
$0.0788(5m)·$0.95(1h)$0.083(5m)·$1(1h)
$0.1425$0.15
$8.55$9
gemini-3.1-pro-preview官方资源1-204.8K1M$2$0.375(5m)·$4.5(1h)$0.2$12
204.8K-1M1M$4$0.375(5m)·$4.5(1h)$0.4$18
gemini-3-flash-preview官方资源-1M
$0.475$0.5
$0.0788(5m)·$0.95(1h)$0.083(5m)·$1(1h)
$0.0475$0.05
$2.85$3
gemini-2.5-pro官方资源-1M
$1.1875$1.25
$0.3562(5m)·$4.275(1h)$0.375(5m)·$4.5(1h)
$0.1187$0.125
$9.5$10
gemini-2.5-pro-preview-06-05官方资源-1M
$1.1875$1.25
$0.3562(5m)·$4.275(1h)$0.375(5m)·$4.5(1h)
$0.1187$0.125
$9.5$10
gemini-2.5-flash-preview-05-20官方资源-1M
$0.1425$0.15
$0.0788(5m)·$0.95(1h)$0.083(5m)·$1(1h)
$0.0285$0.03
$3.325$3.5
gemini-2.5-flash-1M
$0.285$0.3
$0.0788(5m)·$0.95(1h)$0.083(5m)·$1(1h)
$0.0285$0.03
$2.375$2.5
gemini-2.5-flash-lite-preview-09-2025官方资源-1M
$0.095$0.1
$0.0788(5m)·$0.95(1h)$0.083(5m)·$1(1h)
$0.0095$0.01
$0.38$0.4
gemini-2.5-flash-lite官方资源-1M
$0.095$0.1
$0.0788(5m)·$0.95(1h)$0.083(5m)·$1(1h)
$0.0095$0.01
$0.38$0.4
Gemma 3 27B-32.8K$0.119--$0.2
Gemma3 12B-131.1K$0.05--$0.1
gemini-3.6-flash官方资源-1M$1.5$0.0833(5m)·$1(1h)$0.15$7.5
gemini-3.5-flash-lite官方资源-1M$0.3$0.0833(5m)·$1(1h)$0.03$2.5
Llama logo

Llama

Meta的Llama模型提供最先进的语言理解能力,采用开放架构设计,适用于多样化应用场景。

模型名称上下文Input(/Mt)Output(/Mt)操作
Llama 3.1 8B Instruct16.4K$0.02$0.05
Llama 3.3 70B Instruct131.1K$0.13$0.39
Llama 4 Maverick Instruct1M$0.17$0.85
Llama 4 Scout Instruct131.1K$0.1$0.5
Qwen logo

Qwen

Qwen系列模型提供高效的语言处理能力,具有多种参数规模,从轻量级到企业级解决方案。

模型名称Input Token Range上下文Input(/Mt)Cache Read(/Mt)Output(/Mt)操作
Qwen3.5-Plus1-256K1M$0.4-$2.4
256K-1M1M$1.2-$7.2
Qwen3 235B A22B Instruct 2507-131.1K$0.15-$0.8
Qwen 2.5 72B Instruct-32K$0.38-$0.4
Qwen MT Plus-4.1K$0.25-$0.75
Qwen2.5 7B Instruct-32K$0.07-$0.07
Qwen2.5 VL 72B Instruct-32.8K$0.8-$0.8
Qwen3 30B A3B-41K$0.09-$0.45
Qwen3 32B-41K$0.1-$0.45
Qwen3 235B A22B-41K$0.2-$0.8
Qwen3 235B A22b Thinking 2507-131.1K$0.3-$3
Qwen3 Coder 480B A35B Instruct-262.1K$0.29-$1.2
Qwen3 Coder Next FP8-262.1K$0.2-$1.5
Qwen3 Next 80B A3B Instruct-65.5K$0.15-$1.5
Qwen3 Next 80B A3B Thinking-65.5K$0.15-$1.5
Qwen3.5-27B-262.1K$0.3-$2.4
Qwen3.8 Max-1M$2$0.25$6
Qwen3.5-122B-A10B-262.1K$0.4-$3.2
Qwen3.5-35B-A3B-262.1K$0.25-$2
Qwen3.5-397B-A17B-262.1K$0.6-$3.6
Wenxin

Baidu

百度的ERNIE模型提供先进的中文语言理解和多模态能力,针对中文应用进行了优化,具有竞争力的价格。

模型名称上下文Input(/Mt)Output(/Mt)操作
ERNIE 4.5 VL 424B A47B123K$0.42$1.25
ERNIE 4.5 300B A47B123K$0.28$1.1
ChatGLM

THUDM

来自清华大学的GLM系列模型,具有先进的中文语言理解和生成能力。

模型名称上下文Input(/Mt)Cache Read(/Mt)Output(/Mt)操作
GLM 5.21M$1.4$0.26$4.4
GLM-5.1204.8K$1.38$0.26$4.4
GLM-5V-Turbo204.8K$1.2$0.24$4
GLM 4.5V65.5K$0.6-$1.8
GLM-4.5131.1K$0.6-$2.2
GLM-4.7204.8K$0.6-$2.2
GLM-4.7-Flash200K$0.07$0.01$0.4
GLM-5204.8K$1$0.2$3.2
GLM-5-Turbo202.8K$1.2$0.24$4
Sao10K logo

Sao10K

专门针对创意和角色扮演应用优化的微调模型,具有增强的故事叙述能力。

模型名称上下文Input(/Mt)Output(/Mt)操作
L3 8B Stheno V3.28.2K$0.05$0.05
L3 70B Euryale V2.1 8.2K$1.48$1.48
L31 70B Euryale V2.28.2K$1.48$1.48
Sao10k L3 8B Lunaris 8.2K$0.05$0.05
Mistralai logo

Mistralai

来自Mistral AI的高效强大语言模型,专为商业和开源应用而设计。

模型名称上下文Input(/Mt)Output(/Mt)操作
Mistral Nemo60.3K$0.04$0.17
Mistral 7B Instruct32.8K$0.029$0.059
Deepseek logo

Deepseek

来自DeepSeek的先进AI模型,为企业级和研究应用提供前沿的推理能力和具有竞争力的价格。

模型名称上下文Input(/Mt)Cache Write(/Mt)Cache Read(/Mt)Output(/Mt)操作
Deepseek V4 Flash 07311M$0.14-$0.028$0.28
Deepseek V4 Flash1M$0.14-$0.028$0.28
Deepseek V4 Pro1M$0.435-$0.145$0.87
DeepSeek R1 0528163.8K$0.7-$0.35$2.5
DeepSeek V3 0324163.8K$0.28$0.14(5m)$0.14$1.14
DeepSeek V3.1163.8K$0.27--$1
DeepSeek-OCR 28.2K$0.03--$0.03
MiniMax logo

MiniMax

MiniMax AI的先进语言模型提供强大的对话AI能力,在客户服务、内容生成和创意应用中表现优异,具有强大的多语言支持和企业级可扩展性。

模型名称上下文Input(/Mt)Output(/Mt)操作
MiniMax M11M$0.55$2.2
Gryphe logo

Gryphe

来自Gryphe的创新AI模型,提供专业的语言理解能力,专注于效率和适应性,适用于利基应用。

模型名称上下文Input(/Mt)Output(/Mt)操作
Mythomax L2 13B4.1K$0.09$0.09

Mixture of Expert

最先进AI模型的高级集合,具有高级推理、数学证明能力和跨多个领域的前沿语言理解能力。

模型名称Input Token Range上下文Input(/Mt)Cache Write(/Mt)Cache Read(/Mt)Output(/Mt)操作
Qwen3.5-Plus1-256K1M$0.4--$2.4
256K-1M1M$1.2--$7.2
Deepseek V4 Flash 0731-1M$0.14-$0.028$0.28
GLM 5.2-1M$1.4-$0.26$4.4
Deepseek V4 Flash-1M$0.14-$0.028$0.28
Deepseek V4 Pro-1M$0.435-$0.145$0.87
MiniMax M2.7-204.8K$0.3-$0.03$1.2
Kimi K2.5-262.1K$0.6-$0.1$3
Kimi K2 Instruct-131.1K$0.57--$2.3
GLM-5.1-204.8K$1.38-$0.26$4.4
GLM-5V-Turbo-204.8K$1.2-$0.24$4
ERNIE 4.5 VL 424B A47B-123K$0.42--$1.25
OpenAI: GPT OSS 20B-131.1K$0.05--$0.2
OpenAI GPT OSS 120B-131.1K$0.1--$0.5
DeepSeek R1 0528-163.8K$0.7-$0.35$2.5
DeepSeek V3 0324-163.8K$0.28$0.14(5m)$0.14$1.14
DeepSeek V3.1-163.8K$0.27--$1
ERNIE 4.5 300B A47B-123K$0.28--$1.1
GLM 4.5V-65.5K$0.6--$1.8
GLM-4.5-131.1K$0.6--$2.2
GLM-4.7-204.8K$0.6--$2.2
GLM-4.7-Flash-200K$0.07-$0.01$0.4
GLM-5-204.8K$1-$0.2$3.2
GLM-5-Turbo-202.8K$1.2-$0.24$4
Llama 4 Maverick Instruct-1M$0.17--$0.85
Llama 4 Scout Instruct-131.1K$0.1--$0.5
MiniMax M1-1M$0.55--$2.2
Minimax M2.1-204.8K$0.3$0.375(5m)$0.03$1.2
MiniMax M2.5-204.8K$0.3-$0.03$1.2
MiniMax M2.7-highspeed-204.8K$0.6-$0.06$2.4
MiniMax M2.5-highspeed-204.8K$0.6-$0.03$2.4
Qwen3 30B A3B-41K$0.09--$0.45
Qwen3 32B-41K$0.1--$0.45
Qwen3 235B A22B-41K$0.2--$0.8
Qwen3 235B A22b Thinking 2507-131.1K$0.3--$3
Qwen3.8 Max-1M$2-$0.25$6
XiaomiMiMo/MiMo-V2.5-Pro1-262.1K1M$1-$0.2$3
262.1K-1M1M$2-$0.4$6
Qwen3.5-122B-A10B-262.1K$0.4--$3.2
Qwen3.5-35B-A3B-262.1K$0.25--$2
Qwen3.5-397B-A17B-262.1K$0.6--$3.6
Contact Us