NL ▾
API-sleutel aanvragen

qwenapis.comDocs

Qwen API: eerste verzoek in vijf minuten

Ontvang je eerste respons van onze ongecensureerde Qwen API in minder dan vijf minuten. Deze quickstart-gids behandelt installatie, authenticatie en kernfunctionaliteit met standaard OpenAI-compatible clients.

API-sleutel aanvragen

Base URL en authenticatie

Onze API volgt de standaard OpenAI-indeling, waardoor het eenvoudig is je bestaande clientconfiguratie te wijzigen. De base URL voor alle verzoeken is https://api.qwenapis.com/v1. Je hebt een API-sleutel nodig om je verzoeken te authenticeren. Als je er nog geen hebt, bezoek dan de API-sleutel ophalen-pagina om een sleutel te genereren met alleen je e-mail en wachtwoord. Er is geen creditcard nodig om te beginnen met het proeftegoed.

Elk account is beperkt tot één actieve sleutel tegelijk. Je kunt je sleutel op elk moment regeneren, waardoor de vorige direct ongeldig wordt. Dit zorgt ervoor dat je je account direct kunt beveiligen als je sleutel is gelekt, zonder te wachten op een maandelijkse cyclus. Bewaar je sleutel veilig in je omgevingsvariabelen of secret manager.

Maak je eerste verzoek

Verifieer je configuratie door een eenvoudig verzoek voor tekstaanvulling te sturen. Het volgende voorbeeld gebruikt curl om een prompt naar het ongecensureerde model te sturen. Vervang YOUR_API_KEY door de sleutel die je in de vorige stap hebt gegenereerd. De model-ID is ingesteld op uncensored, dat is afgestemd om te antwoorden zonder inhoudelijke weigeringen voor wettelijk volwassen gebruik.

curl https://api.qwenapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Als het succesvol is, ontvang je een JSON-respons met de gegenereerde tekst. Als je een 401-fout krijgt, controleer dan of je sleutel correct is. Een 402-fout geeft aan dat je prepaid tegoed op is.

Python SDK-integratie

Voor Python-ontwikkelaars werkt de officiële OpenAI SDK direct met onze endpoint. Installeer de bibliotheek met pip en configureer de client zodat deze naar onze base URL verwijst. Hiermee kun je bekende methoden gebruiken zoals chat.completions.create() zonder je applicatielogica aanzienlijk te wijzigen. De SDK verzorgt JSON-serialisatie en retry-logica voor je.

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Vergeet niet de api_key en base_url correct in te stellen. De modelnaam blijft uncensored. Deze aanpak zorgt voor compatibiliteit met code die voor andere providers is geschreven, waardoor het eenvoudig is om van endpoint te wisselen of te testen.

Node SDK-gebruik

Node.js-ontwikkelaars kunnen de @anthropic-ai/sdk of de officiële openai npm-pakketten gebruiken. Configureer de client met onze base URL en je API-sleutel. De structuur van het verzoek is identiek aan andere OpenAI-compatible diensten. Hiermee kun je ongecensureerde Qwen integreren in je bestaande Node.js-applicaties met minimale codeaanpassingen.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Zorg ervoor dat je de asynchrone respons correct afhandelt. De SDK retourneert het volledige completeringsobject, inclusief tokengebruikstatistieken. Dit helpt je het verbruik van je prepaid tegoed in realtime te monitoren.

Streaming inschakelen

Schakel streaming in voor je verzoeken voor lagere latentie en een betere gebruikerservaring. Streaming stuurt de respons token voor token naarmate deze wordt gegenereerd, waardoor je applicatie de uitvoer progressief kan weergeven. Stel de stream-parameter in op true in je verzoek. De SDK biedt een iterabele stream van chunks.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Dit is vooral nuttig voor het genereren van lange inhoud of interactieve applicaties. Elke chunk bevat gedeeltelijke tekst die je kunt toevoegen aan je weergavebuffer. De stream eindigt wanneer het model de respons heeft voltooid of de contextlimiet heeft bereikt.

Limieten, fouten en context

Onze API heeft specifieke limieten om eerlijk gebruik te garanderen. Je mag 300 verzoeken per minuut per sleutel uitvoeren. De maximale grootte van de request body is 8 MB. Het contextvenster is 100.000 tokens, zowel voor de prompt als de completion. Als je de rate limit overschrijdt, ontvang je een 429-fout. Als je credit onvoldoende is, ontvang je een 402-fout. Voor ongeldige sleutels ontvang je een 401-fout. Deze fouten helpen je de flow van je applicatie en het creditgebruik effectief te beheren.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Model-IDuncensored
Base URLhttps://api.qwenapis.com/v1
AuthenticatieAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Contextvenster100.000 tokens (invoer + uitvoer)
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
JSON-modusresponse_format: {"type": "json_object"}
Rate limit300 verzoeken per minuut per sleutel
Gelijktijdige verzoekentot 8 tegelijk per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Verzoekgroottetot 8 MB
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Bonus+5% vanaf $50, +10% vanaf $100
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
InloggenGoogle of e-mail en wachtwoord

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Wat betekent ongecensureerd voor deze API?

Het betekent dat het model is afgestemd om te antwoorden zonder inhoudsweigeringen voor wettelijk volwassen, fictief of controversieel onderwerp. Het blokkeert geen standaard volwassen inhoud, maar blokkeert wel seksuele inhoud met minderjarigen. Dit maakt het geschikt voor creatief schrijven, rollenspellen en onderzoek waar strikte filtering ongewenst is.

Heb ik een creditcard nodig om te beginnen?

Nee. Je kunt je aanmelden met alleen een e-mail en wachtwoord om $0,50 aan proeftegoed te ontvangen dat 7 dagen geldig is. Hiermee kun je de API testen zonder betaalgegevens op te geven. Je kunt later tegoed toevoegen met crypto (USDT of USDC) als je wilt doorgaan.

Is dit de officiële Qwen API?

Nee, dit is een onafhankelijke dienst die een open-weight ongecensureerd model draait op onze eigen GPU-servers. We zijn niet gelieerd aan Alibaba of een andere leverancier. Onze API is OpenAI-compatible, dus hij werkt met standaardclients, maar het is een aparte dienst met eigen prijzen en limieten.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, wijzig de base URL. Dat is de hele setup.

API-sleutel aanvragen