千问实时音视频对话模型,可理解文本、图像和音视频输入,并流式输出文本与语音。
Qwen tokenizer (tiktoken-compat)千问实时音视频对话模型,可理解文本、图像和音视频输入,并流式输出文本与语音。
Pistes pour commencer l’évaluation ; les entrées et options prises en charge figurent dans la section d’accès API.
Vérifiez d’abord la fonction du point de terminaison : entrée audio, transcription ou sortie audio. Confirmez les langues, formats et limites de longueur avant un traitement par lot.
/v1/chat/completions| Paramètre | Type | Défaut / plage | Description |
|---|---|---|---|
temperature | number | = 10 ~ 2 | Température d'échantillonnage ; plus c'est bas, plus c'est déterministe |
top_p | number | = 10 ~ 1 | Masse probabiliste de l'échantillonnage nucleus |
max_tokens | integer | >= 1 | Nombre maximum de jetons dans la réponse |
frequency_penalty | number | = 0-2 ~ 2 | Pénalise la répétition des jetons fréquents |
presence_penalty | number | = 0-2 ~ 2 | Encourage l'introduction de nouveaux sujets |
stop | array | — | Jusqu'à 4 chaînes qui arrêtent la génération |
seed | integer | — | Graine d'échantillonnage déterministe (meilleur effort) |
n | integer | = 1>= 1 | Nombre de complétions à générer |
stream | boolean | = false | Diffuser les jetons via Server-Sent Events |
response_format | object | — | Forcer une sortie JSON ou conforme à un schéma |
tools | array | — | Déclarations d'outils / fonctions que le modèle peut appeler |
tool_choice | string | autononerequired | Stratégie de choix d'outil ou nom d'outil spécifique |
logprobs | boolean | = false | Retourner les log-probabilités par jeton |
top_logprobs | integer | 0 ~ 20 | Nombre de log-probabilités retournées par jeton |
logit_bias | object | — | Carte de biais des logits par jeton |
user | string | — | Identifiant d'utilisateur final pour la surveillance des abus |
Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.
Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .
Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.
| Paramètre | Type | Défaut / plage | Description |
|---|---|---|---|
temperature | number | = 10 ~ 2 | Température d'échantillonnage ; plus c'est bas, plus c'est déterministe |
top_p | number | = 10 ~ 1 | Masse probabiliste de l'échantillonnage nucleus |
max_tokens | integer | >= 1 | Nombre maximum de jetons dans la réponse |
frequency_penalty | number | = 0-2 ~ 2 | Pénalise la répétition des jetons fréquents |
presence_penalty | number | = 0-2 ~ 2 | Encourage l'introduction de nouveaux sujets |
stop | array | — | Jusqu'à 4 chaînes qui arrêtent la génération |
seed | integer | — | Graine d'échantillonnage déterministe (meilleur effort) |
n | integer | = 1>= 1 | Nombre de complétions à générer |
stream | boolean | = false | Diffuser les jetons via Server-Sent Events |
response_format | object | — | Forcer une sortie JSON ou conforme à un schéma |
tools | array | — | Déclarations d'outils / fonctions que le modèle peut appeler |
tool_choice | string | autononerequired | Stratégie de choix d'outil ou nom d'outil spécifique |
logprobs | boolean | = false | Retourner les log-probabilités par jeton |
top_logprobs | integer | 0 ~ 20 | Nombre de log-probabilités retournées par jeton |
logit_bias | object | — | Carte de biais des logits par jeton |
user | string | — | Identifiant d'utilisateur final pour la surveillance des abus |
| Fournisseur | RPM | TPM | RPD |
|---|---|---|---|
| Alibaba | 620 | 248K | 12K |
| official | 630 | 252K | 13K |
RPM = requêtes/minute, TPM = jetons/minute, RPD = requêtes/jour. Les limites s'appliquent par groupe de jetons.
千问实时音视频对话模型,可理解文本、图像和音视频输入,并流式输出文本与语音。
Créez une clé API autorisée à utiliser qwen3.5-omni-flash-realtime, puis utilisez l’identifiant exact et un point de terminaison pris en charge dans la section d’accès API. Les champs dépendent du point de terminaison choisi.
Le tarif dépend du groupe de fournisseurs choisi et de l’unité de facturation du modèle. Les prix actuels d’entrée, de sortie, par requête ou par média sont affichés sur cette page avant l’inscription.
Vérifiez d’abord la fonction du point de terminaison : entrée audio, transcription ou sortie audio. Confirmez les langues, formats et limites de longueur avant un traitement par lot.