Gemini

gemini-3.1-flash-lite

GoogleНа основе токенов
Псевдоним:gemini-3.1-flash-lite-preview
Создать ключ API

Google 的 gemini-3.1-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。

textimageaudiovideofilecachingcode_interpreterfunction_callingtoolsweb_searchstructured_outputjson_modereasoningvisioncontext:1048576
Цена от
Вход / Выход · 1M
Контекст
1M
Максимальное окно ввода
Макс. вывод
65.5K
Максимум токенов на ответ
Модальности
→
Выпущено
May 2026

Цены по поставщикам

Google AI Studio
-60%
谷歌官方接口
Вход$0.25$0.1/ 1M
Выход$1.5$0.6/ 1M
Чтение кэша$0.025$0.01/ 1M
Google Vertex
-55%
谷歌官方接口
Вход$0.25$0.1125/ 1M
Выход$1.5$0.675/ 1M
Чтение кэша$0.025$0.01125/ 1M

Возможности / Поддерживаемые модальности

Кэширование промптовИнтерпретатор кодаВызов функцийИнструментыВеб-поискСтруктурированный выводРежим JSONОбоснованиеЗрение
Вход
Выход

Поставщик и конфиденциальность

Провайдер
Токенизатор
SentencePiece (Gemini)
Лицензия
Proprietary (commercial)Проприетарная
Хранение данных78 днейПо умолчанию не используется для обучения у поставщика

Производительность

Доступ к API

Примеры кода

ЗапросPOST/v1beta/models/gemini-3.1-flash-lite:generateContent
Пример запроса
Параметры
ПараметрТипПо умолчанию / диапазонОписание
temperature
number
=10 ~ 2
Температура сэмплирования; чем ниже, тем детерминированнее
top_p
number
=10 ~ 1
Накопленная вероятность для nucleus-сэмплинга
max_tokens
integer>= 1Максимальное число токенов в ответе
frequency_penalty
number
=0-2 ~ 2
Штрафует повторение частых токенов
presence_penalty
number
=0-2 ~ 2
Поощряет введение новых тем
stop
array—До 4 строк, останавливающих генерацию
seed
integer—Сид детерминированного сэмплирования (по возможности)
n
integer
=1>= 1
Число генерируемых вариантов
stream
boolean
=false
Стримить токены через Server-Sent Events
response_format
object—Принудительно вернуть JSON или соответствующий схеме вывод
tools
array—Объявления инструментов и функций, которые модель может вызывать
tool_choice
string
autononerequired
Политика выбора инструмента или конкретное имя
logprobs
boolean
=false
Возвращать логарифмические вероятности по токенам
top_logprobs
integer0 ~ 20Количество top-вероятностей на токен
logit_bias
object—Карта смещений логитов по токенам
user
string—Идентификатор конечного пользователя для мониторинга злоупотреблений

Заменить <YOUR_API_KEY> на API-ключ из настроек токенов.

Аутентификация

Все запросы должны содержать Authorization: Bearer <TOKEN> . Эндпоинты формата Anthropic вместо этого принимают x-api-key .

Создавайте токены на странице «Токены». Их можно ограничить моделями, группами, IP и лимитами частоты.

Поддерживаемые параметры

Generation parameters
ПараметрТипПо умолчанию / диапазонОписание
temperature
number
=10 ~ 2
Температура сэмплирования; чем ниже, тем детерминированнее
top_p
number
=10 ~ 1
Накопленная вероятность для nucleus-сэмплинга
max_tokens
integer>= 1Максимальное число токенов в ответе
frequency_penalty
number
=0-2 ~ 2
Штрафует повторение частых токенов
presence_penalty
number
=0-2 ~ 2
Поощряет введение новых тем
stop
array—До 4 строк, останавливающих генерацию
seed
integer—Сид детерминированного сэмплирования (по возможности)
n
integer
=1>= 1
Число генерируемых вариантов
stream
boolean
=false
Стримить токены через Server-Sent Events
response_format
object—Принудительно вернуть JSON или соответствующий схеме вывод
tools
array—Объявления инструментов и функций, которые модель может вызывать
tool_choice
string
autononerequired
Политика выбора инструмента или конкретное имя
logprobs
boolean
=false
Возвращать логарифмические вероятности по токенам
top_logprobs
integer0 ~ 20Количество top-вероятностей на токен
logit_bias
object—Карта смещений логитов по токенам
user
string—Идентификатор конечного пользователя для мониторинга злоупотреблений

Ограничения частоты

ПоставщикRPMTPMRPD
Google AI Studio920369K19K
Google Vertex550219K11K

RPM = запросов в минуту, TPM = токенов в минуту, RPD = запросов в день. Ограничения применяются к каждой группе токенов.

Вопросы о доступе к API

Всё необходимое для решения перед созданием аккаунта.

Другие модели