MoonshotAI

kimi-k2.7-code

MoonshotToken-based
Create API Key

Moonshot 的 kimi-k2.7-code 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。

textimagefunction_callingtoolsjson_modestructured_outputreasoningvisioncontext:262144
Starting price
Input / Output · 1M
Context
262.1K
Maximum input window
Modalities
→

Pricing by Supplier

official
-30%
官方接口直连
Input$0.95$0.665/ 1M
Output$4$2.8/ 1M
Cache Read$0.19$0.133/ 1M
Moonshot
-35%
Kimi 官方渠道
Input$0.95$0.6175/ 1M
Output$4$2.6/ 1M
Cache Read$0.19$0.1235/ 1M

Capabilities / Supported modalities

Function callingToolsJSON modeStructured outputReasoningVision
Input
Output

Provider & data privacy

Provider
Moonshot AIDocs
Tokenizer
Kimi tokenizer
License
Proprietary (commercial)Proprietary
Data retention69 daysNot used for upstream training by default

Performance

API access

Code samples

RequestPOST/v1/chat/completions
Example request
Parameters
ParameterTypeDefault / rangeDescription
temperature
number
=10 ~ 2
Sampling temperature; lower is more deterministic
top_p
number
=10 ~ 1
Nucleus sampling probability mass
max_tokens
integer>= 1Maximum number of tokens in the response
frequency_penalty
number
=0-2 ~ 2
Penalises repetition of frequent tokens
presence_penalty
number
=0-2 ~ 2
Encourages introducing new topics
stop
array—Up to 4 strings that stop generation
seed
integer—Deterministic sampling seed (best-effort)
n
integer
=1>= 1
Number of completions to generate
stream
boolean
=false
Stream tokens via Server-Sent Events
response_format
object—Force JSON object or schema-conforming output
tools
array—Tool / function declarations the model may call
tool_choice
string
autononerequired
Tool-choice policy or specific tool name
logprobs
boolean
=false
Return per-token log probabilities
top_logprobs
integer0 ~ 20Number of top log probabilities returned per token
logit_bias
object—Per-token logit bias map
user
string—End-user identifier for abuse monitoring

Replace <YOUR_API_KEY> with the API key from your token settings.

Authentication

All requests must include Authorization: Bearer <TOKEN> header. Anthropic-formatted endpoints accept the x-api-key header instead.

Generate tokens from the Tokens page; you can scope them to specific models, groups, IPs, and rate-limits.

Supported parameters

Generation parameters
ParameterTypeDefault / rangeDescription
temperature
number
=10 ~ 2
Sampling temperature; lower is more deterministic
top_p
number
=10 ~ 1
Nucleus sampling probability mass
max_tokens
integer>= 1Maximum number of tokens in the response
frequency_penalty
number
=0-2 ~ 2
Penalises repetition of frequent tokens
presence_penalty
number
=0-2 ~ 2
Encourages introducing new topics
stop
array—Up to 4 strings that stop generation
seed
integer—Deterministic sampling seed (best-effort)
n
integer
=1>= 1
Number of completions to generate
stream
boolean
=false
Stream tokens via Server-Sent Events
response_format
object—Force JSON object or schema-conforming output
tools
array—Tool / function declarations the model may call
tool_choice
string
autononerequired
Tool-choice policy or specific tool name
logprobs
boolean
=false
Return per-token log probabilities
top_logprobs
integer0 ~ 20Number of top log probabilities returned per token
logit_bias
object—Per-token logit bias map
user
string—End-user identifier for abuse monitoring

Rate limits

SupplierRPMTPMRPD
Moonshot730292K15K
official370146K7.3K

RPM = requests per minute, TPM = tokens per minute, RPD = requests per day. Limits apply per token group.

API access questions

Everything you need to decide before creating an account.

Discover more models