Qwen-API-Leitfaden: Python- & Node.js-Integration außerhalb Chinas
Alibabas Qwen3.8 konkurriert im Artificial Analysis Intelligence Index mit GPT-5.6 Sol und unterstützt einen Kontext von bis zu 1 Million Token. Dieser Leitfaden zeigt, wie Sie über den OpenAI-kompatiblen Endpunkt von ChinaModelAPI weltweit auf die Qwen API zugreifen können – inklusive funktionierender Python- und Node.js-Codebeispiele.
from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.chinamodelapi.com/v1")
print(client.chat.completions.create(
model="qwen-plus",
messages=[{"role":"user","content":"ping"}],
).choices[0].message.content)
Was ist die Qwen API?
Die Qwen API ist die Entwicklerschnittstelle von Alibaba Cloud für ihre Large-Language-Model-Reihe Qwen (通义千问). Die API folgt dem OpenAI chat completions format, wodurch sie für Entwickler, die bereits GPT-Modelle einsetzen, ein nahtloser Drop-in-Ersatz ist.
Wichtigste Fakten zur Qwen API:
- • OpenAI-kompatibel — gleiches Anfrage-/Antwortformat wie GPT
- • Qwen-Max-Kontextfenster — bis zu 1,000,000 Token
- • Sprachen — mehrsprachig (100+), herausragend bei Chinesisch-Englisch
- • AA Intelligence Index — Spitzenklasse unter den Open-Weight-Modellen, konkurrenzfähig mit GPT-5.6 Sol
- • Unterstützt — Chat, Function Calling, Streaming, Vision (Qwen-VL)
Qwen-Modelle: Welches Modell wählen?
| Modell-ID | Ideal für | Kontext | Geschwindigkeit | Kosten |
|---|---|---|---|---|
| qwen-3 | Allgemeine Aufgaben, modernste Performance | 128K | Schnell | $$ |
| qwen-max | Lange Dokumente, komplexes logisches Denken | 1M | Moderat | $$$ |
| qwen-plus | Ausgewogen: Geschwindigkeit + Qualität | 128K | Schnell | $$ |
| qwen-2.5 | Stabile Produktions-Workloads | 128K | Schnell | $ |
| qwen-2.5-coder | Codegenerierung & -vervollständigung | 128K | Schnell | $ |
Zugriff auf die Qwen API außerhalb Chinas: 4 Schritte
-
1
Create a ChinaModelAPI account
Registrieren Sie sich auf chinamodelapi.com — keine Kreditkarte erforderlich.
-
2
Purchase tokens with USDT
Der Starter-Tarif ($9.9) reicht zum Testen völlig aus. Token verfallen nie.
-
3
Copy your API key
Ihr Schlüssel aus dem Dashboard funktioniert für alle Qwen-Modelle.
-
4
Change base_url in your SDK
Eine einzige Codezeile — siehe Beispiele unten.
Python-Integration: Qwen API
Installieren Sie das OpenAI Python SDK: pip install openai
from openai import OpenAI
client = OpenAI(
base_url="https://api.chinamodelapi.com/v1",
api_key="your-chinamodelapi-key"
)
response = client.chat.completions.create(
model="qwen-3", # or qwen-max, qwen-plus, qwen-2.5
messages=[
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "Explain transformer architecture in 3 sentences."}
],
max_tokens=1024
)
print(response.choices[0].message.content)
Für Streaming-Antworten:
stream = client.chat.completions.create(
model="qwen-max",
messages=[{"role": "user", "content": "Write a Python function for binary search."}],
stream=True
)
for chunk in stream:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Node.js-Integration: Qwen API
Installation: npm install openai
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.chinamodelapi.com/v1",
apiKey: "your-chinamodelapi-key"
});
const response = await client.chat.completions.create({
model: "qwen-3", // or "qwen-max", "qwen-plus"
messages: [
{ role: "user", content: "Translate this to Chinese: Hello, world!" }
]
});
console.log(response.choices[0].message.content);
Häufig gestellte Fragen
Kann ich die Qwen API kostenlos nutzen?
ChinaModelAPI bietet keinen kostenlosen Tarif an, aber der Starter-Plan für $9.9 bietet reichlich Token zum Testen und für kleinere Projekte. Token verfallen nie, sodass kein Zeitdruck besteht, sie aufzubrauchen.
Unterstützt die Qwen API Function Calling?
Ja. Qwen3.8 und Qwen-Max unterstützen OpenAI-kompatibles Function Calling (Tool Use). Das Anfrageformat ist identisch mit dem von OpenAI — definieren Sie Ihre Tools im Parameter tools, und das Modell liefert strukturierte Funktionsaufrufe zurück.
Wie groß ist das Kontextfenster von Qwen-Max?
Qwen-Max unterstützt bis zu 1,000,000 Token Kontext — das entspricht ungefähr 750.000 Wörtern oder einem ganzen Buch. Dies ist eines der größten verfügbaren Kontextfenster und damit ideal für die Analyse langer Dokumente, Codebasen oder Forschungsarbeiten.
Gibt es ein Rate-Limit für die Qwen API?
Die Rate-Limits hängen von Ihrer Tarifstufe ab. Der Starter-Tarif bietet Basis-Limits, die für die Entwicklung geeignet sind. Pro und höher bieten einen höheren Durchsatz. Enterprise-Tarife beinhalten individuelle Rate-Limits und SLA-Garantien. Kontaktieren Sie uns für genaue Zahlen.
Verwandte Leitfäden
Bereit für den Einsatz der Qwen API? Erhalten Sie Zugang in unter 5 Minuten.
Vorabzugang erhalten