BaiLian

qwen3.6-35b-a3b

AlibabaBasé sur les jetons

Alibaba 的 qwen3.6-35b-a3b 模型。支持文本、图像、视频输入和文本输出。

textimagevideofunction_callingtoolsstructured_outputjson_modeweb_searchvisionreasoningcontext:262144
Tarif à partir de
Entree / Sortie · 1M
Contexte
262.1K
Fenêtre d'entrée maximale
Sortie max
65.5K
Nombre maximal de jetons par réponse
Modalités
→

Tarification par fournisseur

official
-30%
官方接口直连
Entree$0.254$0.1778/ 1M
Sortie$1.524$1.0668/ 1M
Lecture du cache$0.254$0.1778/ 1M
Alibaba
阿里巴巴百炼官方
Entree$0.2794/ 1M
Sortie$1.6764/ 1M
Lecture du cache$0.2794/ 1M

Capacités / Modalités prises en charge

Appel de fonctionOutilsSortie structuréeMode JSONRecherche webVisionRaisonnement
Entree
Sortie

Fournisseur & confidentialité

Fournisseur
Alibaba (Qwen)Documents
Tokeniseur
Qwen tokenizer (tiktoken-compat)
Licence
Tongyi Qianwen LicensePoids ouverts
Rétention des données14 joursNon utilisé pour l'entraînement amont par défaut

Performances

À propos de qwen3.6-35b-a3b

Alibaba 的 qwen3.6-35b-a3b 模型。支持文本、图像、视频输入和文本输出。

Cas d’usage et prompts

Pistes pour commencer l’évaluation ; les entrées et options prises en charge figurent dans la section d’accès API.

Cas d’usage à explorer

  • Rédigez et révisez des textes avec un public, un ton et un format clairement définis.
  • Résumez les documents fournis et comparez les réponses aux sources originales.

Conseils pratiques

Séparez les instructions des sources, décrivez le résultat attendu et fournissez un exemple. Testez les outils ou les sorties structurées uniquement si leur prise en charge est indiquée.

Exemple de prompt

Résumez le document suivant en cinq points. Séparez les faits confirmés des questions ouvertes, citez les passages pertinents et n’inventez pas les informations manquantes. Document : [collez votre texte]

Accès API

Exemples de code

RequêtePOST/v1/chat/completions
Exemple de requête
Paramètres
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.

Authentification

Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .

Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.

Paramètres pris en charge

Generation parameters
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Limites de débit

FournisseurRPMTPMRPD
Alibaba390155K7.7K
official820327K16K

RPM = requêtes/minute, TPM = jetons/minute, RPD = requêtes/jour. Les limites s'appliquent par groupe de jetons.

Questions fréquentes sur qwen3.6-35b-a3b

Qu’est-ce que qwen3.6-35b-a3b ?

Alibaba 的 qwen3.6-35b-a3b 模型。支持文本、图像、视频输入和文本输出。

Comment appeler qwen3.6-35b-a3b ?

Créez une clé API autorisée à utiliser qwen3.6-35b-a3b, puis utilisez l’identifiant exact et un point de terminaison pris en charge dans la section d’accès API. Les champs dépendent du point de terminaison choisi.

Comment qwen3.6-35b-a3b est-il facturé ?

Le tarif dépend du groupe de fournisseurs choisi et de l’unité de facturation du modèle. Les prix actuels d’entrée, de sortie, par requête ou par média sont affichés sur cette page avant l’inscription.

Quelle est la fenêtre de contexte de qwen3.6-35b-a3b ?

Le catalogue indique une fenêtre de contexte de 262144 tokens. Vérifiez les limites du point de terminaison sélectionné.

Quelle est la sortie maximale de qwen3.6-35b-a3b ?

Le catalogue indique une sortie maximale de 65536 tokens. Vos paramètres peuvent définir une limite inférieure.

Comment évaluer qwen3.6-35b-a3b pour mon projet ?

Séparez les instructions des sources, décrivez le résultat attendu et fournissez un exemple. Testez les outils ou les sorties structurées uniquement si leur prise en charge est indiquée.