qwenapis.comDokumentation
Qwen-API: Erste Anfrage in fünf Minuten
Erhalte deine erste Antwort von unserer unzensierten Qwen-API in weniger als fünf Minuten. Diese Schnellstartanleitung behandelt Installation, Authentifizierung und Kernfunktionalität mit standard OpenAI-kompatiblen Clients.
Basis-URL und Authentifizierung
Unsere API folgt dem Standardformat von OpenAI, sodass du deine bestehende Client-Konfiguration problemlos wechseln kannst. Die Basis-URL für alle Anfragen ist https://api.qwenapis.com/v1. Du benötigst einen API-Schlüssel, um deine Anfragen zu authentifizieren. Falls du noch keinen erstellt hast, besuche die Seite API-Schlüssel erhalten, um einen Schlüssel nur mit deiner E-Mail-Adresse und deinem Passwort zu generieren. Für den Start mit dem Testguthaben wird keine Kreditkarte benötigt.
Jedes Konto ist auf einen aktiven Schlüssel beschränkt. Du kannst deinen Schlüssel jederzeit neu generieren, wodurch der vorherige sofort ungültig wird. So kannst du dein Konto sofort sichern, falls der Schlüssel bekannt wird, ohne auf einen Monatszyklus zu warten. Bewahre den Schlüssel sicher in deinen Umgebungsvariablen oder im Secret Manager auf.
Erste Anfrage senden
Überprüfe deine Einrichtung, indem du eine einfache Text-Vervollständigungsanfrage sendest. Das folgende Beispiel nutzt curl, um einen Prompt an das unzensierte Modell zu senden. Ersetze YOUR_API_KEY durch den im vorherigen Schritt generierten Schlüssel. Die Modell-ID ist auf uncensored gesetzt, das darauf ausgelegt ist, ohne Inhaltsfilter auf rechtliche erwachsene Nutzung zu antworten.
curl https://api.qwenapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Bei Erfolg erhältst du eine JSON-Antwort mit dem generierten Text. Bei einem 401-Fehler prüfe, ob dein Schlüssel korrekt ist. Ein 402-Fehler bedeutet, dass dein Prepaid-Guthaben aufgebraucht ist.
Python-SDK-Integration
Für Python-Entwickler funktioniert das offizielle OpenAI SDK direkt mit unserem Endpunkt. Installiere die Bibliothek mit pip und konfiguriere den Client, um auf unsere Basis-URL zu zeigen. So kannst du bekannte Methoden wie chat.completions.create() nutzen, ohne deine Anwendungslogik wesentlich zu ändern. Das SDK übernimmt die JSON-Serialisierung und Retry-Logik für dich.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Vergiss nicht, api_key und base_url korrekt zu setzen. Der Modellname bleibt uncensored. Dieser Ansatz gewährleistet Kompatibilität mit Code für andere Anbieter, was das Wechseln oder Testen verschiedener Endpunkte einfach macht.
Node-SDK-Nutzung
Node.js-Entwickler können das @anthropic-ai/sdk oder das offizielle openai npm-Paket nutzen. Konfiguriere den Client mit unserer Basis-URL und deinem API-Schlüssel. Die Struktur der Anfrage ist identisch mit anderen OpenAI-kompatiblen Diensten. Dies ermöglicht es dir, unzensiertes Qwen in deine bestehenden Node.js-Anwendungen mit minimalen Codeänderungen zu integrieren.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Stelle sicher, dass du die asynchrone Antwort angemessen behandelst. Das SDK gibt das vollständige Vervollständigungsobjekt zurück, einschließlich Token-Nutzungsstatistiken. So kannst du den Verbrauch deines Prepaid-Guthabens in Echtzeit überwachen.
Streaming aktivieren
Für geringere Latenz und bessere Benutzererfahrung aktiviere Streaming in deinen Anfragen. Streaming sendet die Antwort Token für Token, während sie generiert wird, sodass deine Anwendung die Ausgabe schrittweise anzeigen kann. Setze den Parameter stream auf true in deiner Anfrage. Das SDK stellt einen iterierbaren Stream von Chunks bereit.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Dies ist besonders nützlich für die Generierung langer Texte oder interaktive Anwendungen. Jeder Chunk enthält teilweise Text, den Sie an Ihren Anzeige-Puffer anhängen können. Der Stream endet, wenn das Modell die Antwort abschließt oder das Kontextlimit erreicht.
Limits, Fehler und Kontext
Unsere API hat spezifische Limits, um eine faire Nutzung zu gewährleisten. Du darfst 300 Anfragen pro Minute pro Schlüssel senden. Die maximale Größe des Anfragekörpers beträgt 8 MB. Das Kontextfenster umfasst 100.000 Token, sowohl den Prompt als auch die Vervollständigung. Wenn du das Ratenlimit überschreitest, erhältst du einen 429-Fehler. Wenn dein Guthaben nicht ausreicht, erhältst du einen 402-Fehler. Für ungültige Schlüssel erhältst du einen 401-Fehler. Diese Fehler helfen dir, den Ablauf deiner Anwendung und die Guthaben-Nutzung effektiv zu verwalten.
Funktionen und Limits
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Modell-ID | uncensored |
| Base-URL | https://api.qwenapis.com/v1 |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| JSON-Modus | response_format: {"type": "json_object"} |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Anfragegröße | bis 8 MB |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Was bedeutet unzensiert für diese API?
Das bedeutet, dass das Modell darauf ausgelegt ist, ohne Inhaltsablehnungen bei rechtmäßigen, erwachsenen, fiktiven oder kontroversen Themen zu antworten. Es blockiert keinen Standard-Erwachseneninhalt, schließt jedoch sexuellen Inhalt mit Minderjährigen aus. Dies macht es für kreatives Schreiben, Rollenspiele und Forschung geeignet, wo strenge Filterung unerwünscht ist.
Brauche ich eine Kreditkarte zum Starten?
Nein. Du kannst dich nur mit E-Mail und Passwort anmelden, um $0,50 kostenloses Testguthaben für 7 Tage zu erhalten. So kannst du die API testen, ohne Zahlungsdaten anzugeben. Du kannst Guthaben später per Krypto (USDT oder USDC) aufladen, wenn du fortfahren möchtest.
Ist dies die offizielle Qwen-API?
Nein, dies ist ein unabhängiger Dienst, der ein Open-Weight-Modell auf unseren eigenen GPU-Servern ausführt. Wir sind nicht mit Alibaba oder einem anderen Anbieter verbunden. Unsere API ist OpenAI-kompatibel, funktioniert also mit Standard-Clients, ist aber ein eigenständiger Dienst mit eigenen Preisen und Limits.
Dein Schlüssel ist nur ein Formular entfernt
Erstellen Sie ein Konto, kopieren Sie den Schlüssel, ändern Sie die Basis-URL. Das ist die gesamte Einrichtung.