DE ▾
API-Schlüssel erhalten

qwenapis.comDokumentation

Qwen-API: Erste Anfrage in fünf Minuten

Erhalte deine erste Antwort von unserer unzensierten Qwen-API in weniger als fünf Minuten. Diese Schnellstartanleitung behandelt Installation, Authentifizierung und Kernfunktionalität mit standard OpenAI-kompatiblen Clients.

API-Schlüssel erhalten

Basis-URL und Authentifizierung

Unsere API folgt dem Standardformat von OpenAI, sodass du deine bestehende Client-Konfiguration problemlos wechseln kannst. Die Basis-URL für alle Anfragen ist https://api.qwenapis.com/v1. Du benötigst einen API-Schlüssel, um deine Anfragen zu authentifizieren. Falls du noch keinen erstellt hast, besuche die Seite API-Schlüssel erhalten, um einen Schlüssel nur mit deiner E-Mail-Adresse und deinem Passwort zu generieren. Für den Start mit dem Testguthaben wird keine Kreditkarte benötigt.

Jedes Konto ist auf einen aktiven Schlüssel beschränkt. Du kannst deinen Schlüssel jederzeit neu generieren, wodurch der vorherige sofort ungültig wird. So kannst du dein Konto sofort sichern, falls der Schlüssel bekannt wird, ohne auf einen Monatszyklus zu warten. Bewahre den Schlüssel sicher in deinen Umgebungsvariablen oder im Secret Manager auf.

Erste Anfrage senden

Überprüfe deine Einrichtung, indem du eine einfache Text-Vervollständigungsanfrage sendest. Das folgende Beispiel nutzt curl, um einen Prompt an das unzensierte Modell zu senden. Ersetze YOUR_API_KEY durch den im vorherigen Schritt generierten Schlüssel. Die Modell-ID ist auf uncensored gesetzt, das darauf ausgelegt ist, ohne Inhaltsfilter auf rechtliche erwachsene Nutzung zu antworten.

curl https://api.qwenapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Bei Erfolg erhältst du eine JSON-Antwort mit dem generierten Text. Bei einem 401-Fehler prüfe, ob dein Schlüssel korrekt ist. Ein 402-Fehler bedeutet, dass dein Prepaid-Guthaben aufgebraucht ist.

Python-SDK-Integration

Für Python-Entwickler funktioniert das offizielle OpenAI SDK direkt mit unserem Endpunkt. Installiere die Bibliothek mit pip und konfiguriere den Client, um auf unsere Basis-URL zu zeigen. So kannst du bekannte Methoden wie chat.completions.create() nutzen, ohne deine Anwendungslogik wesentlich zu ändern. Das SDK übernimmt die JSON-Serialisierung und Retry-Logik für dich.

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Vergiss nicht, api_key und base_url korrekt zu setzen. Der Modellname bleibt uncensored. Dieser Ansatz gewährleistet Kompatibilität mit Code für andere Anbieter, was das Wechseln oder Testen verschiedener Endpunkte einfach macht.

Node-SDK-Nutzung

Node.js-Entwickler können das @anthropic-ai/sdk oder das offizielle openai npm-Paket nutzen. Konfiguriere den Client mit unserer Basis-URL und deinem API-Schlüssel. Die Struktur der Anfrage ist identisch mit anderen OpenAI-kompatiblen Diensten. Dies ermöglicht es dir, unzensiertes Qwen in deine bestehenden Node.js-Anwendungen mit minimalen Codeänderungen zu integrieren.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Stelle sicher, dass du die asynchrone Antwort angemessen behandelst. Das SDK gibt das vollständige Vervollständigungsobjekt zurück, einschließlich Token-Nutzungsstatistiken. So kannst du den Verbrauch deines Prepaid-Guthabens in Echtzeit überwachen.

Streaming aktivieren

Für geringere Latenz und bessere Benutzererfahrung aktiviere Streaming in deinen Anfragen. Streaming sendet die Antwort Token für Token, während sie generiert wird, sodass deine Anwendung die Ausgabe schrittweise anzeigen kann. Setze den Parameter stream auf true in deiner Anfrage. Das SDK stellt einen iterierbaren Stream von Chunks bereit.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Dies ist besonders nützlich für die Generierung langer Texte oder interaktive Anwendungen. Jeder Chunk enthält teilweise Text, den Sie an Ihren Anzeige-Puffer anhängen können. Der Stream endet, wenn das Modell die Antwort abschließt oder das Kontextlimit erreicht.

Limits, Fehler und Kontext

Unsere API hat spezifische Limits, um eine faire Nutzung zu gewährleisten. Du darfst 300 Anfragen pro Minute pro Schlüssel senden. Die maximale Größe des Anfragekörpers beträgt 8 MB. Das Kontextfenster umfasst 100.000 Token, sowohl den Prompt als auch die Vervollständigung. Wenn du das Ratenlimit überschreitest, erhältst du einen 429-Fehler. Wenn dein Guthaben nicht ausreicht, erhältst du einen 402-Fehler. Für ungültige Schlüssel erhältst du einen 401-Fehler. Diese Fehler helfen dir, den Ablauf deiner Anwendung und die Guthaben-Nutzung effektiv zu verwalten.

Funktionen und Limits

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Modell-IDuncensored
Base-URLhttps://api.qwenapis.com/v1
AuthentifizierungAuthorization: Bearer YOUR_KEY
EndpunktePOST /v1/chat/completions · GET /v1/models
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
JSON-Modusresponse_format: {"type": "json_object"}
Ratenlimit300 Anfragen pro Minute und Schlüssel
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Anfragegrößebis 8 MB
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Bonus+5 % ab $50, +10 % ab $100
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
AnmeldungGoogle oder E-Mail und Passwort

Fehler und Lösungen

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Was bedeutet unzensiert für diese API?

Das bedeutet, dass das Modell darauf ausgelegt ist, ohne Inhaltsablehnungen bei rechtmäßigen, erwachsenen, fiktiven oder kontroversen Themen zu antworten. Es blockiert keinen Standard-Erwachseneninhalt, schließt jedoch sexuellen Inhalt mit Minderjährigen aus. Dies macht es für kreatives Schreiben, Rollenspiele und Forschung geeignet, wo strenge Filterung unerwünscht ist.

Brauche ich eine Kreditkarte zum Starten?

Nein. Du kannst dich nur mit E-Mail und Passwort anmelden, um $0,50 kostenloses Testguthaben für 7 Tage zu erhalten. So kannst du die API testen, ohne Zahlungsdaten anzugeben. Du kannst Guthaben später per Krypto (USDT oder USDC) aufladen, wenn du fortfahren möchtest.

Ist dies die offizielle Qwen-API?

Nein, dies ist ein unabhängiger Dienst, der ein Open-Weight-Modell auf unseren eigenen GPU-Servern ausführt. Wir sind nicht mit Alibaba oder einem anderen Anbieter verbunden. Unsere API ist OpenAI-kompatibel, funktioniert also mit Standard-Clients, ist aber ein eigenständiger Dienst mit eigenen Preisen und Limits.

Dein Schlüssel ist nur ein Formular entfernt

Erstellen Sie ein Konto, kopieren Sie den Schlüssel, ändern Sie die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten