
按类别探索 AI 模型 API
文本与语言模型 API
面向助手、智能体和生产应用的对话、推理、编程及多模态语言模型。
106 个可用模型
比较模型 API 价格与能力
打开模型详情页,查看当前价格、端点、上下文限制及相关 API。
Anthropic
NEWclaude-sonnet-5-5
隆重推出 Claude Sonnet 5.5,这是 Claude 5.5 系列的第二款产品。它相比 Claude Sonnet 5 有了显著的提升,运行速度提升 30% 以上,而且大多数工作的成本降低高达 30%。
上下文 1M
按量计费
供应商 4省65%
输入$2$0.7/1M输出$10$3.5/1M缓存$0.07/1M
Anthropic
NEWclaude-opus-5-5
Anthropic 的 claude-opus-5-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。思考模式始终开启。
上下文 1M
按量计费
供应商 5省65%
输入$4$1.4/1M输出$20$7/1M缓存$0.07/1M
OpenAI
NEWgpt-6-luna
OpenAI 的 gpt-6-luna 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。支持 Responses API 工具调用。
上下文 1.1M
按量计费
供应商 3省45%
输入$0.1$0.055/1M输出$0.5$0.275/1M缓存$0.0055/1M
OpenAI
NEWgpt-6-sol
OpenAI 的 gpt-6-sol 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。支持 Responses API 工具调用。
上下文 1.1M
按量计费
供应商 3省85%
输入$2$0.3/1M输出$10$1.5/1M缓存$0.03/1M
OpenAI
NEWgpt-6-astra
OpenAI 的 gpt-6-astra 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。支持 Responses API 工具调用。
上下文 1.1M
按量计费
供应商 4省85%
输入$10$1.5/1M输出$50$7.5/1M缓存$0.15/1M
gemini-3.8-flash
Google 的 gemini-3.8-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省80%
输入$0.5$0.1/1M输出$3$0.6/1M缓存$0.01/1M
gemini-3.7-flash
Google 的 gemini-3.7-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省80%
输入$0.75$0.15/1M输出$3.75$0.75/1M缓存$0.015/1M
Anthropic
claude-fable-5-1
Anthropic 的 claude-fable-5-1 模型,支持文本、图像输入和文本输出。支持推理、工具调用。思考模式始终开启。
上下文 1M
按量计费
供应商 5省80%
输入$10$2/1M输出$50$10/1M缓存$0.05/1M
Anthropic
claude-opus-5
Anthropic 的 claude-opus-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 8省80%
输入$5$1/1M输出$25$5/1M缓存$0.1/1M
gemini-3.6-flash
Google 的 gemini-3.6-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省80%
输入$1.5$0.3/1M输出$7$1.4/1M缓存$0.03/1M
OpenAI
gpt-5.6-sol
OpenAI 的 gpt-5.6-sol 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省85%
输入$5$0.75/1M输出$30$4.5/1M缓存$0.075/1M
OpenAI
gpt-5.6-terra
OpenAI 的 gpt-5.6-terra 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省85%
输入$2$0.3/1M输出$12$1.8/1M缓存$0.03/1M
OpenAI
gpt-5.6-luna
OpenAI 的 gpt-5.6-luna 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省45%
输入$0.2$0.11/1M输出$1.2$0.66/1M缓存$0.011/1M
Anthropic
claude-fable-5
Anthropic 的 claude-fable-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省80%
输入$10$2/1M输出$50$10/1M缓存$0.2/1M
gemini-3.5-flash-lite
Google 的 gemini-3.5-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省60%
输入$0.3$0.12/1M输出$1.2$0.48/1M
Anthropic
claude-sonnet-5
Anthropic 的 claude-sonnet-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省80%
输入$2$0.4/1M输出$10$2/1M缓存$0.04/1M
OpenAI
gpt-5.5
OpenAI 的 gpt-5.5 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省85%
输入$5$0.75/1M输出$30$4.5/1M缓存$0.075/1M
gemini-3.5-flash
Google 的 gemini-3.5-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省60%
输入$1.5$0.6/1M输出$9$3.6/1M缓存$0.06/1M
Anthropic
claude-opus-4-8
Anthropic 的 claude-opus-4-8 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省80%
输入$5$1/1M输出$25$5/1M缓存$0.1/1M
OpenAI
gpt-5.4
OpenAI 的 gpt-5.4 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省85%
输入$2.5$0.375/1M输出$15$2.25/1M缓存$0.0375/1M
OpenAI
gpt-5.4-mini
OpenAI 的 gpt-5.4-mini 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 4省85%
输入$0.75$0.1125/1M输出$4.5$0.675/1M缓存$0.01125/1M
OpenAI
gpt-5.4-nano
OpenAI 的 gpt-5.4-nano 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 4省85%
输入$0.2$0.03/1M输出$1.25$0.1875/1M缓存$0.003/1M
OpenAI
gpt-5.3-codex
OpenAI 的 gpt-5.3-codex 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 1省85%
输入$1.75$0.2625/1M输出$14$2.1/1M缓存$0.02625/1M
gemini-3.1-pro-preview
Google 的 gemini-3.1-pro-preview 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省80%
输入$2$0.4/1M输出$8$1.6/1M缓存$0.04/1M
Anthropic
claude-opus-4-7
Anthropic 的 claude-opus-4-7 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省80%
输入$5$1/1M输出$25$5/1M缓存$0.1/1M
OpenAI
gpt-5.2
OpenAI 的 gpt-5.2 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 3省85%
输入$1.75$0.2625/1M输出$14$2.1/1M缓存$0.02625/1M
gemini-3.1-flash-lite
Google 的 gemini-3.1-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省60%
输入$0.25$0.1/1M输出$1.5$0.6/1M缓存$0.01/1M
gemini-3.1-pro-preview-customtools
Google 的 gemini-3.1-pro-preview-customtools 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省60%
输入$2$0.8/1M输出$12$4.8/1M缓存$0.08/1M
Anthropic
claude-opus-4-6
Anthropic 的 claude-opus-4-6 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省80%
输入$5$1/1M输出$25$5/1M缓存$0.1/1M
OpenAI
gpt-5.1
OpenAI 的 gpt-5.1 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 1省85%
输入$1.25$0.1875/1M输出$10$1.5/1M缓存$0.01875/1M
gemini-3-flash
Google 的 gemini-3-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省80%
输入$0.5$0.1/1M输出$3$0.6/1M缓存$0.01/1M
Anthropic
claude-sonnet-4-6
Anthropic 的 claude-sonnet-4-6 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 6省80%
输入$3$0.6/1M输出$15$3/1M缓存$0.06/1M
gemini-2.5-pro
Google 的 gemini-2.5-pro 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省60%
输入$1.25$0.5/1M输出$10$4/1M缓存$0.05/1M
gemini-2.5-flash
Google 的 gemini-2.5-flash 模型,支持文本、图像、音频、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省60%
输入$0.3$0.12/1M输出$2.5$1/1M缓存$0.012/1M
gemini-2.5-flash-lite
Google 的 gemini-2.5-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省60%
输入$0.1$0.04/1M输出$0.4$0.16/1M缓存$0.004/1M
MiniMax
MiniMax-M3
MiniMax 的 MiniMax-M3 模型,支持文本、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
动态计费
供应商 2省30%
输入$0.3$0.21/1M输出$2.1$1.47/1M缓存读取$0.042/1M
DeepSeek
deepseek-v4-1-flash-260910
DeepSeek 的 deepseek-v4-1-flash-260910 模型,支持文本、图像输入和文本输出。支持推理。
上下文 1M
动态计费
供应商 3省50%
输入$0.03$0.015/1M输出$1.2$0.6/1M缓存读取$0.003/1M
DeepSeek
deepseek-v4-pro-0813
DeepSeek 的 deepseek-v4-pro-0813 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省50%
输入$1.33$0.665/1M输出$4$2/1M缓存$0.022/1M
DeepSeek
deepseek-v4-flash-0731
DeepSeek 的 deepseek-v4-flash-0731 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省50%
输入$0.44$0.22/1M输出$1.33$0.665/1M缓存$0.0075/1M
xAI
grok-4.6
xAI 的 grok-4.6 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。官方未设置独立的文本输出上限,总长度仍受上下文窗口约束。
上下文 500K
按量计费
供应商 1省50%
输入$2$1/1M输出$6$3/1M缓存$0.25/1M
MiniMax
MiniMax-M2.7
MiniMax 的 MiniMax-M2.7 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 204.8K
按量计费
供应商 2省30%
输入$0.3$0.21/1M输出$1.2$0.84/1M缓存$0.042/1M
Alibaba
qwen3.8-flash
Alibaba 的 qwen3.8-flash 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 1省30%
输入$0.12$0.084/1M输出$0.4$0.28/1M缓存$0.0105/1M
Alibaba
qwen3.8-max
Alibaba 的 qwen3.8-max 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 1省30%
输入$1.8$1.26/1M输出$5.3$3.71/1M缓存$0.154/1M
Xiaomi
mimo-v2.6-flash
Xiaomi 的 mimo-v2.6-flash 模型,支持文本、图像、视频、音频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 1
输入$0.154/1M输出$0.308/1M缓存$0.00308/1M
Xiaomi
mimo-v2.6-pro
Xiaomi 的 mimo-v2.6-pro 模型,支持文本、图像、视频、音频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 1
输入$0.4785/1M输出$0.957/1M缓存$0.00396/1M
T
TypeSafe
typesafe/jev
TypeSafe Jev 是面向软件系统的结构化决策模型,接收状态与候选动作并返回机器可用的决策结果。
上下文 —
按量计费
供应商 1
输入$0.0462/1M输出$0/1M
xAI
grok-4.7
xAI 的 grok-4.7 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。官方未设置独立的文本输出上限,总长度仍受上下文窗口约束。
上下文 500K
按量计费
供应商 1省50%
输入$2$1/1M输出$6$3/1M缓存$0.25/1M
Z.ai
glm-5.3-flash
Z.ai 的 glm-5.3-flash 模型,支持文本、图像、视频、文件输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 1省30%
输入$0.12$0.084/1M输出$0.418$0.2926/1M缓存$0.0245/1M
Z.ai
glm-5.3
Z.ai 的 glm-5.3 模型,支持文本输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 1省30%
输入$1.2$0.84/1M输出$4.18$2.926/1M缓存$0.21/1M
Gemma 4-26B-A4B
Gemma 是一系列生成式人工智能模型,可用于各种生成任务,包括问答、总结和推理。Gemma 模型提供开放权重,并允许负责任的商业用途,让您可以在自己的项目和应用中调整和部署它们。
上下文 —
按量计费
供应商 1省30%
输入$0.15$0.105/1M输出$0.6$0.42/1M缓存$0.0105/1M
Moonshot
kimi-k3
Moonshot 的 kimi-k3 模型,支持文本、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省35%
输入$2.86$1.859/1M输出$14.29$9.2885/1M缓存$0.1859/1M
xAI
grok-4.5
xAI 的 grok-4.5 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。官方未设置独立的文本输出上限,总长度仍受上下文窗口约束。
上下文 500K
按量计费
供应商 1省50%
输入$2$1/1M输出$6$3/1M缓存$0.25/1M
Xiaomi
mimo-v2.5
Xiaomi 的 mimo-v2.5 模型,支持文本、音频、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 1
输入$0.154/1M输出$0.308/1M缓存$0.00308/1M
Xiaomi
mimo-v2.5-pro
Xiaomi 的 mimo-v2.5-pro 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 1
输入$0.4785/1M输出$0.957/1M缓存$0.00396/1M
Tencent
hy3
Tencent 的 hy3 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 262.1K
按量计费
供应商 1
输入$0.165/1M输出$0.638/1M缓存$0.0396/1M
Moonshot
kimi-k2.6
Moonshot 的 kimi-k2.6 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 262.1K
按量计费
供应商 2省30%
输入$0.95$0.665/1M输出$4$2.8/1M缓存$0.112/1M
Z.ai
glm-5.2
Z.ai 的 glm-5.2 模型,支持文本输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 4省50%
输入$1.4$0.7/1M输出$4.4$2.2/1M缓存$0.13/1M
Z.ai
glm-5.1
Z.ai 的 glm-5.1 模型,支持文本输入和文本输出。支持推理、工具调用。
上下文 204.8K
按量计费
供应商 2省30%
输入$0.87$0.609/1M输出$3.5$2.45/1M缓存$0.133/1M
Z.ai
glm-5
Z.ai 的 glm-5 模型,支持文本输入和文本输出。支持推理、工具调用。
上下文 204.8K
按量计费
供应商 2省30%
输入$0.58$0.406/1M输出$2.6$1.82/1M缓存$0.098/1M
DeepSeek
deepseek-v4-pro
DeepSeek 的 deepseek-v4-pro 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 5省50%
输入$1.33$0.665/1M输出$4$2/1M缓存$0.022/1M
DeepSeek
deepseek-v4-flash
DeepSeek 的 deepseek-v4-flash 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 4省50%
输入$0.44$0.22/1M输出$1.33$0.665/1M缓存$0.0075/1M
Alibaba
qwen3.7-plus
Alibaba 的 qwen3.7-plus 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省30%
输入$0.4$0.28/1M输出$1.6$1.12/1M缓存$0.056/1M
Moonshot
kimi-k2.7-code
Moonshot 的 kimi-k2.7-code 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 262.1K
按量计费
供应商 2省35%
输入$0.95$0.6175/1M输出$4$2.6/1M缓存$0.1235/1M
ByteDance
doubao-seed-2-1-pro-260628
豆包 Seed 2.1 系列模型,支持深度思考、多模态理解、工具调用和结构化输出;官方标注 256K 上下文。
上下文 —
按量计费
供应商 1省3%
输入$0.86$0.8342/1M输出$4.3$4.171/1M
ByteDance
doubao-seed-2-1-turbo-260628
豆包 Seed 2.1 系列模型,支持深度思考、多模态理解、工具调用和结构化输出;官方标注 256K 上下文。
上下文 —
按量计费
供应商 1省3%
输入$0.43$0.4171/1M输出$0.43$0.4171/1M
MiniMax
MiniMax-M2.5
MiniMax 的 MiniMax-M2.5 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 204.8K
按量计费
供应商 2省30%
输入$0.3$0.21/1M输出$1.2$0.84/1M缓存$0.021/1M
Anthropic
claude-haiku-4-5
Anthropic 的 claude-haiku-4-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 200K
按量计费
供应商 5省80%
输入$1$0.2/1M输出$5$1/1M缓存$0.02/1M
OpenAI
gpt-5-nano
OpenAI 的 gpt-5-nano 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 2省45%
输入$0.05$0.0275/1M输出$0.4$0.22/1M缓存$0.00275/1M
Anthropic
claude-sonnet-4-5
Anthropic 的 claude-sonnet-4-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 200K
按量计费
供应商 6省80%
输入$3$0.6/1M输出$15$3/1M缓存$0.06/1M
Anthropic
claude-opus-4-5
Anthropic 的 claude-opus-4-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 200K
按量计费
供应商 4省80%
输入$5$1/1M输出$25$5/1M缓存$0.1/1M
MiniMax
MiniMax/MiniMax-M3
MiniMax 的 MiniMax-M3 模型,支持文本、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省30%
输入$75$52.5/1M输出$75$52.5/1M
DeepSeek
deepseek-v4.1-flash
DeepSeek 的 deepseek-v4-1-flash-260910 模型,支持文本、图像输入和文本输出。支持推理。
上下文 1M
按量计费
供应商 1省30%
输入$75$52.5/1M输出$75$52.5/1M
ByteDance
doubao-seed-2-0-code-preview-260215
豆包 Seed 2.0 系列模型接口,用于文本生成与智能体应用。精确版本规格以接入渠道为准。
上下文 —
按量计费
供应商 1省3%
输入$0.782$0.75854/1M输出$3.893$3.7762/1M
ByteDance
doubao-seed-2-0-lite-260428
豆包 Seed 2.0 系列模型接口,用于文本生成与智能体应用。精确版本规格以接入渠道为准。
上下文 —
按量计费
供应商 1省3%
输入$0.09041$0.087698/1M输出$0.54246$0.526186/1M缓存$0.01754/1M
ByteDance
doubao-seed-2-0-mini-260428
豆包 Seed 2.0 系列模型接口,用于文本生成与智能体应用。精确版本规格以接入渠道为准。
上下文 —
按量计费
供应商 1省3%
输入$0.0282$0.027354/1M输出$0.282$0.27354/1M缓存$0.005471/1M
ByteDance
doubao-seed-2-0-pro-260215
豆包 Seed 2.0 系列模型接口,用于文本生成与智能体应用。精确版本规格以接入渠道为准。
上下文 —
按量计费
供应商 1省3%
输入$0.782$0.75854/1M输出$3.876$3.7597/1M
xAI
grok-3
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省50%
输入$3$1.5/1M输出$15$7.5/1M缓存$1.5/1M
xAI
grok-3-fast-beta
xAI grok-3-fast-beta 系列文本模型接口。历史版本与当前官方服务可能存在差异,实际版本以接入渠道为准。
上下文 —
按量计费
供应商 1省50%
输入$5.5$2.75/1M输出$27.5$13.75/1M
xAI
grok-3-mini
xAI grok-3-mini 系列文本模型接口。历史版本与当前官方服务可能存在差异,实际版本以接入渠道为准。
上下文 —
按量计费
供应商 1省50%
输入$0.3$0.15/1M输出$0.501$0.2505/1M缓存$0.0375/1M
xAI
grok-4
xAI grok-4 系列文本模型接口。历史版本与当前官方服务可能存在差异,实际版本以接入渠道为准。
上下文 —
按量计费
供应商 1省50%
输入$3.3$1.65/1M输出$16.5$8.25/1M缓存$0.4125/1M
xAI
grok-4-0709
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省50%
输入$3$1.5/1M输出$15$7.5/1M
xAI
grok-4-1-fast-non-reasoning
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省50%
输入$0.2$0.1/1M输出$0.5$0.25/1M缓存$0.025/1M
xAI
grok-4-1-fast-reasoning
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省50%
输入$0.2$0.1/1M输出$0.5$0.25/1M缓存$0.025/1M
xAI
grok-4-fast-non-reasoning
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省50%
输入$0.2$0.1/1M输出$0.5$0.25/1M缓存$0.025/1M
xAI
grok-4-fast-reasoning
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省50%
输入$0.2$0.1/1M输出$0.5$0.25/1M缓存$0.025/1M
xAI
grok-4.20-0309-non-reasoning
xAI 的 grok-4.20-0309-non-reasoning 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省50%
输入$2$1/1M输出$6$3/1M缓存$0.1/1M
xAI
grok-4.20-0309-reasoning
xAI 的 grok-4.20-0309-reasoning 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省50%
输入$2$1/1M输出$6$3/1M缓存$0.1/1M
xAI
grok-4.20-beta-0309-non-reasoning
xAI 的 grok-4.20-beta-0309-non-reasoning 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省50%
输入$2$1/1M输出$6$3/1M缓存$0.1/1M
xAI
grok-4.20-beta-0309-reasoning
xAI 的 grok-4.20-beta-0309-reasoning 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省50%
输入$2$1/1M输出$6$3/1M缓存$0.1/1M
xAI
grok-4.3
xAI 的 grok-4.3 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省50%
输入$1.25$0.625/1M输出$2.5$1.25/1M缓存$0.1/1M
Alibaba
qwen3-omni-flash-2025-12-01
千问 Qwen3-Omni-Flash 的 2025 年 12 月快照,提供多模态理解及文本、语音生成能力。
上下文 —
按量计费
供应商 2省30%
输入$75$52.5/1M输出$75$52.5/1M
Alibaba
qwen3.5-flash
Alibaba 的 qwen3.5-flash 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 2省30%
输入$0.0282$0.01974/1M输出$0.282$0.1974/1M缓存$0.001974/1M
Alibaba
qwen3.5-plus
Alibaba 的 qwen3.5-plus 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 2省30%
输入$0.1096$0.07672/1M输出$0.6576$0.46032/1M缓存$0.007672/1M
Alibaba
qwen3.6-35b-a3b
Alibaba 的 qwen3.6-35b-a3b 模型。支持文本、图像、视频输入和文本输出。
上下文 262.1K
按量计费
供应商 2省30%
输入$0.254$0.1778/1M输出$1.524$1.0668/1M缓存$0.1778/1M
Alibaba
qwen3.6-flash
Alibaba 的 qwen3.6-flash 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 2省30%
输入$0.169$0.1183/1M输出$1.014$0.7098/1M缓存$0.01183/1M
Alibaba
qwen3.6-max-preview
Alibaba 的 qwen3.6-max-preview 模型。支持文本输入和文本输出。
上下文 262.1K
按量计费
供应商 2省30%
输入$1.268$0.8876/1M输出$7.608$5.3256/1M缓存$0.08876/1M
Alibaba
qwen3.6-plus
Alibaba 的 qwen3.6-plus 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 2省30%
输入$0.282$0.1974/1M输出$1.692$1.1844/1M缓存$0.01974/1M
Alibaba
qwen3.7-max
Alibaba 的 qwen3.7-max 模型。支持文本输入和文本输出。
上下文 1M
按量计费
供应商 2省30%
输入$2.5$1.75/1M输出$7.5$5.25/1M缓存$0.175/1M
Alibaba
qwen3.7-max-preview
Alibaba 的 qwen3.7-max-preview 模型。
上下文 —
按量计费
供应商 2省30%
输入$75$52.5/1M输出$75$52.5/1M