Gemini

gemini-3-flash

Googleトークンベース
エイリアス:gemini-3-flash-preview
APIキーを作成

Google 的 gemini-3-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。

textimageaudiovideofilecachingcode_interpreterfunction_callingtoolsweb_searchstructured_outputjson_modereasoningvisioncontext:1048576
最低料金
入力 / 出力 · 1M
コンテキスト
1M
最大入力ウィンドウ
最大出力
65.5K
1 回の応答あたりの最大トークン数
モダリティ
→
公開日
Dec 2025

サプライヤー別料金

Google AI Studio
-60%
谷歌官方接口
入力$0.5$0.2/ 1M
出力$3$1.2/ 1M
キャッシュ読み取り$0.05$0.02/ 1M
Google Vertex
-55%
谷歌官方接口
入力$0.5$0.225/ 1M
出力$3$1.35/ 1M
キャッシュ読み取り$0.05$0.0225/ 1M
Gemini Cli
-80%
Gemini cli 号池,适合 vibe coding学习等场景
入力$0.5$0.1/ 1M
出力$3$0.6/ 1M
キャッシュ読み取り$0.05$0.01/ 1M

機能 / サポートされるモダリティ

プロンプトキャッシュコードインタプリタ関数呼び出しツールウェブ検索構造化出力JSON モード理由ビジョン
入力
出力

プロバイダーとデータ保護

プロバイダー
トークナイザー
SentencePiece (Gemini)
ライセンス
Proprietary (commercial)プロプライエタリ
データ保持73 日デフォルトで上流の学習には使用されません

パフォーマンス

API を利用

コードサンプル

リクエストPOST/v1beta/models/gemini-3-flash:generateContent
リクエスト例
パラメータ
パラメータタイプデフォルト / 範囲説明
temperature
number
=10 ~ 2
サンプリング温度。低いほど決定論的になります
top_p
number
=10 ~ 1
核サンプリングの累積確率
max_tokens
integer>= 1レスポンスの最大トークン数
frequency_penalty
number
=0-2 ~ 2
頻出トークンの繰り返しを抑制します
presence_penalty
number
=0-2 ~ 2
新しい話題への展開を促進します
stop
array—生成を停止する文字列を最大 4 個まで
seed
integer—可能な限り再現性のあるサンプリングシード
n
integer
=1>= 1
生成する候補数
stream
boolean
=false
Server-Sent Events でトークンをストリーミング
response_format
object—JSON オブジェクトまたはスキーマ準拠の出力を強制します
tools
array—モデルが呼び出せるツール / 関数の宣言
tool_choice
string
autononerequired
ツール選択ポリシーまたは具体的なツール名
logprobs
boolean
=false
トークンごとの対数確率を返します
top_logprobs
integer0 ~ 20トークンごとに返される上位対数確率の数
logit_bias
object—トークンごとの logit バイアス
user
string—悪用検知用のエンドユーザー識別子

置換 <YOUR_API_KEY> をトークン設定の API キーに置き換えてください。

認証

すべてのリクエストには Authorization: Bearer <TOKEN> ヘッダーが必要です。Anthropic 形式のエンドポイントでは x-api-key ヘッダーも利用できます。

トークンページから API キーを発行できます。モデル、グループ、IP、レート制限ごとに細かく権限を設定可能です。

対応パラメータ

Generation parameters
パラメータタイプデフォルト / 範囲説明
temperature
number
=10 ~ 2
サンプリング温度。低いほど決定論的になります
top_p
number
=10 ~ 1
核サンプリングの累積確率
max_tokens
integer>= 1レスポンスの最大トークン数
frequency_penalty
number
=0-2 ~ 2
頻出トークンの繰り返しを抑制します
presence_penalty
number
=0-2 ~ 2
新しい話題への展開を促進します
stop
array—生成を停止する文字列を最大 4 個まで
seed
integer—可能な限り再現性のあるサンプリングシード
n
integer
=1>= 1
生成する候補数
stream
boolean
=false
Server-Sent Events でトークンをストリーミング
response_format
object—JSON オブジェクトまたはスキーマ準拠の出力を強制します
tools
array—モデルが呼び出せるツール / 関数の宣言
tool_choice
string
autononerequired
ツール選択ポリシーまたは具体的なツール名
logprobs
boolean
=false
トークンごとの対数確率を返します
top_logprobs
integer0 ~ 20トークンごとに返される上位対数確率の数
logit_bias
object—トークンごとの logit バイアス
user
string—悪用検知用のエンドユーザー識別子

レート制限

サプライヤーRPMTPMRPD
Gemini Cli920370K19K
Google AI Studio830334K17K
Google Vertex650260K13K

RPM = 1 分あたりリクエスト数、TPM = 1 分あたりトークン数、RPD = 1 日あたりリクエスト数。制限はトークングループ単位で適用されます。

API アクセスに関する質問

アカウント作成前の判断に必要な情報です。

他のモデルを探す