Gemma 是一系列生成式人工智能模型,可用于各种生成任务,包括问答、总结和推理。Gemma 模型提供开放权重,并允许负责任的商业用途,让您可以在自己的项目和应用中调整和部署它们。
SentencePiece (Gemini)Gemma 是一系列生成式人工智能模型,可用于各种生成任务,包括问答、总结和推理。Gemma 模型提供开放权重,并允许负责任的商业用途,让您可以在自己的项目和应用中调整和部署它们。
Pistes pour commencer l’évaluation ; les entrées et options prises en charge figurent dans la section d’accès API.
Séparez les instructions des sources, décrivez le résultat attendu et fournissez un exemple. Testez les outils ou les sorties structurées uniquement si leur prise en charge est indiquée.
Résumez le document suivant en cinq points. Séparez les faits confirmés des questions ouvertes, citez les passages pertinents et n’inventez pas les informations manquantes. Document : [collez votre texte]
/v1/chat/completions| Paramètre | Type | Défaut / plage | Description |
|---|---|---|---|
temperature | number | = 10 ~ 2 | Température d'échantillonnage ; plus c'est bas, plus c'est déterministe |
top_p | number | = 10 ~ 1 | Masse probabiliste de l'échantillonnage nucleus |
max_tokens | integer | >= 1 | Nombre maximum de jetons dans la réponse |
frequency_penalty | number | = 0-2 ~ 2 | Pénalise la répétition des jetons fréquents |
presence_penalty | number | = 0-2 ~ 2 | Encourage l'introduction de nouveaux sujets |
stop | array | — | Jusqu'à 4 chaînes qui arrêtent la génération |
seed | integer | — | Graine d'échantillonnage déterministe (meilleur effort) |
n | integer | = 1>= 1 | Nombre de complétions à générer |
stream | boolean | = false | Diffuser les jetons via Server-Sent Events |
response_format | object | — | Forcer une sortie JSON ou conforme à un schéma |
tools | array | — | Déclarations d'outils / fonctions que le modèle peut appeler |
tool_choice | string | autononerequired | Stratégie de choix d'outil ou nom d'outil spécifique |
logprobs | boolean | = false | Retourner les log-probabilités par jeton |
top_logprobs | integer | 0 ~ 20 | Nombre de log-probabilités retournées par jeton |
logit_bias | object | — | Carte de biais des logits par jeton |
user | string | — | Identifiant d'utilisateur final pour la surveillance des abus |
Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.
Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .
Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.
| Paramètre | Type | Défaut / plage | Description |
|---|---|---|---|
temperature | number | = 10 ~ 2 | Température d'échantillonnage ; plus c'est bas, plus c'est déterministe |
top_p | number | = 10 ~ 1 | Masse probabiliste de l'échantillonnage nucleus |
max_tokens | integer | >= 1 | Nombre maximum de jetons dans la réponse |
frequency_penalty | number | = 0-2 ~ 2 | Pénalise la répétition des jetons fréquents |
presence_penalty | number | = 0-2 ~ 2 | Encourage l'introduction de nouveaux sujets |
stop | array | — | Jusqu'à 4 chaînes qui arrêtent la génération |
seed | integer | — | Graine d'échantillonnage déterministe (meilleur effort) |
n | integer | = 1>= 1 | Nombre de complétions à générer |
stream | boolean | = false | Diffuser les jetons via Server-Sent Events |
response_format | object | — | Forcer une sortie JSON ou conforme à un schéma |
tools | array | — | Déclarations d'outils / fonctions que le modèle peut appeler |
tool_choice | string | autononerequired | Stratégie de choix d'outil ou nom d'outil spécifique |
logprobs | boolean | = false | Retourner les log-probabilités par jeton |
top_logprobs | integer | 0 ~ 20 | Nombre de log-probabilités retournées par jeton |
logit_bias | object | — | Carte de biais des logits par jeton |
user | string | — | Identifiant d'utilisateur final pour la surveillance des abus |
| Fournisseur | RPM | TPM | RPD |
|---|---|---|---|
| official | 460 | 184K | 9.2K |
RPM = requêtes/minute, TPM = jetons/minute, RPD = requêtes/jour. Les limites s'appliquent par groupe de jetons.
Gemma 是一系列生成式人工智能模型,可用于各种生成任务,包括问答、总结和推理。Gemma 模型提供开放权重,并允许负责任的商业用途,让您可以在自己的项目和应用中调整和部署它们。
Créez une clé API autorisée à utiliser Gemma 4-26B-A4B, puis utilisez l’identifiant exact et un point de terminaison pris en charge dans la section d’accès API. Les champs dépendent du point de terminaison choisi.
Le tarif dépend du groupe de fournisseurs choisi et de l’unité de facturation du modèle. Les prix actuels d’entrée, de sortie, par requête ou par média sont affichés sur cette page avant l’inscription.
Séparez les instructions des sources, décrivez le résultat attendu et fournissez un exemple. Testez les outils ou les sorties structurées uniquement si leur prise en charge est indiquée.