qwenapis.comDocs
Qwen API: eerste verzoek in vijf minuten
Ontvang je eerste respons van onze ongecensureerde Qwen API in minder dan vijf minuten. Deze quickstart-gids behandelt installatie, authenticatie en kernfunctionaliteit met standaard OpenAI-compatible clients.
Base URL en authenticatie
Onze API volgt de standaard OpenAI-indeling, waardoor het eenvoudig is je bestaande clientconfiguratie te wijzigen. De base URL voor alle verzoeken is https://api.qwenapis.com/v1. Je hebt een API-sleutel nodig om je verzoeken te authenticeren. Als je er nog geen hebt, bezoek dan de API-sleutel ophalen-pagina om een sleutel te genereren met alleen je e-mail en wachtwoord. Er is geen creditcard nodig om te beginnen met het proeftegoed.
Elk account is beperkt tot één actieve sleutel tegelijk. Je kunt je sleutel op elk moment regeneren, waardoor de vorige direct ongeldig wordt. Dit zorgt ervoor dat je je account direct kunt beveiligen als je sleutel is gelekt, zonder te wachten op een maandelijkse cyclus. Bewaar je sleutel veilig in je omgevingsvariabelen of secret manager.
Maak je eerste verzoek
Verifieer je configuratie door een eenvoudig verzoek voor tekstaanvulling te sturen. Het volgende voorbeeld gebruikt curl om een prompt naar het ongecensureerde model te sturen. Vervang YOUR_API_KEY door de sleutel die je in de vorige stap hebt gegenereerd. De model-ID is ingesteld op uncensored, dat is afgestemd om te antwoorden zonder inhoudelijke weigeringen voor wettelijk volwassen gebruik.
curl https://api.qwenapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Als het succesvol is, ontvang je een JSON-respons met de gegenereerde tekst. Als je een 401-fout krijgt, controleer dan of je sleutel correct is. Een 402-fout geeft aan dat je prepaid tegoed op is.
Python SDK-integratie
Voor Python-ontwikkelaars werkt de officiële OpenAI SDK direct met onze endpoint. Installeer de bibliotheek met pip en configureer de client zodat deze naar onze base URL verwijst. Hiermee kun je bekende methoden gebruiken zoals chat.completions.create() zonder je applicatielogica aanzienlijk te wijzigen. De SDK verzorgt JSON-serialisatie en retry-logica voor je.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Vergeet niet de api_key en base_url correct in te stellen. De modelnaam blijft uncensored. Deze aanpak zorgt voor compatibiliteit met code die voor andere providers is geschreven, waardoor het eenvoudig is om van endpoint te wisselen of te testen.
Node SDK-gebruik
Node.js-ontwikkelaars kunnen de @anthropic-ai/sdk of de officiële openai npm-pakketten gebruiken. Configureer de client met onze base URL en je API-sleutel. De structuur van het verzoek is identiek aan andere OpenAI-compatible diensten. Hiermee kun je ongecensureerde Qwen integreren in je bestaande Node.js-applicaties met minimale codeaanpassingen.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Zorg ervoor dat je de asynchrone respons correct afhandelt. De SDK retourneert het volledige completeringsobject, inclusief tokengebruikstatistieken. Dit helpt je het verbruik van je prepaid tegoed in realtime te monitoren.
Streaming inschakelen
Schakel streaming in voor je verzoeken voor lagere latentie en een betere gebruikerservaring. Streaming stuurt de respons token voor token naarmate deze wordt gegenereerd, waardoor je applicatie de uitvoer progressief kan weergeven. Stel de stream-parameter in op true in je verzoek. De SDK biedt een iterabele stream van chunks.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Dit is vooral nuttig voor het genereren van lange inhoud of interactieve applicaties. Elke chunk bevat gedeeltelijke tekst die je kunt toevoegen aan je weergavebuffer. De stream eindigt wanneer het model de respons heeft voltooid of de contextlimiet heeft bereikt.
Limieten, fouten en context
Onze API heeft specifieke limieten om eerlijk gebruik te garanderen. Je mag 300 verzoeken per minuut per sleutel uitvoeren. De maximale grootte van de request body is 8 MB. Het contextvenster is 100.000 tokens, zowel voor de prompt als de completion. Als je de rate limit overschrijdt, ontvang je een 429-fout. Als je credit onvoldoende is, ontvang je een 402-fout. Voor ongeldige sleutels ontvang je een 401-fout. Deze fouten helpen je de flow van je applicatie en het creditgebruik effectief te beheren.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Model-ID | uncensored |
| Base URL | https://api.qwenapis.com/v1 |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| JSON-modus | response_format: {"type": "json_object"} |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Verzoekgrootte | tot 8 MB |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Inloggen | Google of e-mail en wachtwoord |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Wat betekent ongecensureerd voor deze API?
Het betekent dat het model is afgestemd om te antwoorden zonder inhoudsweigeringen voor wettelijk volwassen, fictief of controversieel onderwerp. Het blokkeert geen standaard volwassen inhoud, maar blokkeert wel seksuele inhoud met minderjarigen. Dit maakt het geschikt voor creatief schrijven, rollenspellen en onderzoek waar strikte filtering ongewenst is.
Heb ik een creditcard nodig om te beginnen?
Nee. Je kunt je aanmelden met alleen een e-mail en wachtwoord om $0,50 aan proeftegoed te ontvangen dat 7 dagen geldig is. Hiermee kun je de API testen zonder betaalgegevens op te geven. Je kunt later tegoed toevoegen met crypto (USDT of USDC) als je wilt doorgaan.
Is dit de officiële Qwen API?
Nee, dit is een onafhankelijke dienst die een open-weight ongecensureerd model draait op onze eigen GPU-servers. We zijn niet gelieerd aan Alibaba of een andere leverancier. Onze API is OpenAI-compatible, dus hij werkt met standaardclients, maar het is een aparte dienst met eigen prijzen en limieten.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, wijzig de base URL. Dat is de hele setup.