Guide de l'API Qwen : intégration Python & Node.js hors de Chine
Qwen3.8 d'Alibaba rivalise avec GPT-5.6 Sol sur l'Artificial Analysis Intelligence Index et prend en charge un contexte allant jusqu'à 1 million de tokens. Ce guide montre comment accéder à l'API Qwen mondialement via le point de terminaison compatible OpenAI de ChinaModelAPI — avec des exemples de code fonctionnels en Python et Node.js.
from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.chinamodelapi.com/v1")
print(client.chat.completions.create(
model="qwen-plus",
messages=[{"role":"user","content":"ping"}],
).choices[0].message.content)
Qu'est-ce que l'API Qwen ?
L'API Qwen est l'interface pour développeurs d'Alibaba Cloud pour sa série de grands modèles de langage Qwen (通义千问). L'API suit le format chat completions d'OpenAI, ce qui en fait une solution de remplacement directe pour les développeurs utilisant déjà des modèles GPT.
Points clés sur l'API Qwen :
- • Compatible OpenAI — même format de requête/réponse que GPT
- • Fenêtre de contexte Qwen-Max — jusqu'à 1 000 000 de tokens
- • Langues — multilingue (100+), excelle en chinois-anglais
- • AA Intelligence Index — niveau supérieur open-weight, rivalise avec GPT-5.6 Sol
- • Prise en charge — chat, function calling, streaming, vision (Qwen-VL)
Modèles Qwen : lequel utiliser ?
| ID du modèle | Idéal pour | Contexte | Vitesse | Coût |
|---|---|---|---|---|
| qwen-3 | Tâches générales, performances les plus récentes | 128K | Rapide | $$ |
| qwen-max | Documents longs, raisonnement complexe | 1M | Modérée | $$$ |
| qwen-plus | Équilibré : vitesse + qualité | 128K | Rapide | $$ |
| qwen-2.5 | Charges de travail stables en production | 128K | Rapide | $ |
| qwen-2.5-coder | Génération & complétion de code | 128K | Rapide | $ |
Comment accéder à l'API Qwen hors de Chine : 4 étapes
-
1
Create a ChinaModelAPI account
Inscrivez-vous sur chinamodelapi.com — aucune carte de crédit requise.
-
2
Purchase tokens with USDT
Le forfait Starter ($9.9) est suffisant pour tester. Les tokens n'expirent jamais.
-
3
Copy your API key
Votre clé depuis le tableau de bord fonctionne avec tous les modèles Qwen.
-
4
Change base_url in your SDK
Une seule ligne de code — voir les exemples ci-dessous.
Intégration Python : API Qwen
Installez le SDK Python OpenAI : pip install openai
from openai import OpenAI
client = OpenAI(
base_url="https://api.chinamodelapi.com/v1",
api_key="your-chinamodelapi-key"
)
response = client.chat.completions.create(
model="qwen-3", # or qwen-max, qwen-plus, qwen-2.5
messages=[
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "Explain transformer architecture in 3 sentences."}
],
max_tokens=1024
)
print(response.choices[0].message.content)
Pour les réponses en streaming :
stream = client.chat.completions.create(
model="qwen-max",
messages=[{"role": "user", "content": "Write a Python function for binary search."}],
stream=True
)
for chunk in stream:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Intégration Node.js : API Qwen
Installation : npm install openai
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.chinamodelapi.com/v1",
apiKey: "your-chinamodelapi-key"
});
const response = await client.chat.completions.create({
model: "qwen-3", // or "qwen-max", "qwen-plus"
messages: [
{ role: "user", content: "Translate this to Chinese: Hello, world!" }
]
});
console.log(response.choices[0].message.content);
Foire aux questions
Puis-je utiliser l'API Qwen gratuitement ?
ChinaModelAPI ne propose pas d'offre gratuite, mais le forfait Starter à $9.9 fournit un volume important de tokens pour les tests et les petits projets. Les tokens n'expirent jamais, vous n'avez donc aucune contrainte de temps pour les utiliser.
L'API Qwen prend-elle en charge le function calling ?
Oui. Qwen3.8 et Qwen-Max prennent en charge le function calling (utilisation d'outils) compatible OpenAI. Le format de requête est identique à celui d'OpenAI — définissez vos outils dans le paramètre tools et le modèle retournera des appels de fonction structurés.
Quelle est la fenêtre de contexte de Qwen-Max ?
Qwen-Max prend en charge jusqu'à 1,000,000 tokens de contexte — l'équivalent d'environ 750 000 mots ou d'un livre entier. C'est l'une des plus grandes fenêtres de contexte disponibles, idéale pour analyser de longs documents, des bases de code ou des articles de recherche.
Existe-t-il une limite de débit sur l'API Qwen ?
Les limites de débit dépendent de votre forfait. Le forfait Starter dispose de limites de base adaptées au développement. Pro et supérieur offrent un débit plus élevé. Les forfaits Enterprise incluent des limites de débit personnalisées et des garanties de SLA. Contactez-nous pour obtenir des chiffres précis.
Guides associés
Prêt à utiliser l'API Qwen ? Obtenez l'accès en moins de 5 minutes.
Obtenir un Accès Anticipé