FR ▾
Obtenir une clé API

qwenapis.comDocs

API Qwen : première requête en cinq minutes

Obtenez votre première réponse de notre API Qwen sans censure en moins de cinq minutes. Ce guide de démarrage rapide couvre l'installation, l'authentification et les fonctionnalités de base à l'aide de clients compatibles OpenAI standards.

Obtenir une clé API

URL de base et authentification

Notre API suit le format OpenAI standard, ce qui facilite le changement de configuration de votre client existant. L'URL de base pour toutes les requêtes est https://api.qwenapis.com/v1. Vous aurez besoin d'une clé API pour authentifier vos requêtes. Si vous n'en avez pas encore créé une, visitez la page Obtenir la clé API pour générer une clé avec simplement votre e-mail et mot de passe. Aucune carte bancaire n'est requise pour commencer avec le crédit d'essai.

Chaque compte est limité à une clé active à la fois. Vous pouvez régénérer votre clé à tout moment, ce qui révoque immédiatement la précédente. Cela garantit que si votre clé est exposée, vous pouvez sécuriser votre compte instantanément sans attendre un cycle mensuel. Gardez votre clé sécurisée dans vos variables d'environnement ou votre gestionnaire de secrets.

Effectuer votre première requête

Vérifiez votre configuration en envoyant une requête simple de complétion de texte. L'exemple suivant utilise curl pour envoyer un prompt au modèle sans censure. Remplacez YOUR_API_KEY par la clé générée à l'étape précédente. L'ID du modèle est défini sur uncensored, qui est ajusté pour répondre sans refus de contenu pour une utilisation adulte licite.

curl https://api.qwenapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Si cela réussit, vous recevrez une réponse JSON contenant le texte généré. Si vous recevez une erreur 401, vérifiez que votre clé est correcte. Une erreur 402 indique que votre crédit prépayé est épuisé.

Intégration SDK Python

Pour les développeurs Python, le SDK OpenAI officiel fonctionne directement avec notre endpoint. Installez la bibliothèque en utilisant pip, puis configurez le client pour pointer vers notre URL de base. Cela vous permet d'utiliser des méthodes familières comme chat.completions.create() sans modifier significativement la logique de votre application. Le SDK gère la sérialisation JSON et la logique de réessai pour vous.

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

N'oubliez pas de définir correctement api_key et base_url. Le nom du modèle reste uncensored. Cette approche garantit la compatibilité avec le code écrit pour d'autres fournisseurs, facilitant le changement ou le test de différents endpoints.

Utilisation SDK Node.js

Les développeurs Node.js peuvent utiliser le package npm @anthropic-ai/sdk ou le package officiel openai. Configurez le client avec notre URL de base et votre clé API. La structure de la requête est identique à celle des autres services compatibles OpenAI. Cela vous permet d'intégrer Qwen sans censure dans vos applications Node.js existantes avec des modifications de code minimales.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Assurez-vous de gérer correctement la réponse asynchrone. Le SDK retournera l'objet de complétion complet, y compris les statistiques d'utilisation des tokens. Cela vous aide à surveiller la consommation de votre crédit prépayé en temps réel.

Activer le streaming

Pour réduire la latence et améliorer l'expérience utilisateur, activez le streaming dans vos requêtes. Le streaming envoie le token par token de la réponse au fur et à mesure de sa génération, ce qui permet à votre application d'afficher la sortie de manière progressive. Définissez le paramètre stream sur true dans votre requête. Le SDK fournira un flux itérable de blocs.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Cela est particulièrement utile pour la génération de contenu long ou les applications interactives. Chaque bloc contient du texte partiel que vous pouvez ajouter à votre tampon d'affichage. Le flux se termine lorsque le modèle termine la réponse ou atteint la limite de la fenêtre de contexte.

Limites, erreurs et contexte

Notre API a des limites spécifiques pour garantir une utilisation équitable. Vous avez droit à 300 requêtes par minute par clé. La taille maximale du corps de la requête est de 8 Mo. La fenêtre de contexte est de 100 000 tokens, couvrant à la fois le prompt et la complétion. Si vous dépassez la limite de débit, vous recevrez une erreur 429. Si votre crédit est insuffisant, vous recevrez une erreur 402. Pour les clés invalides, vous recevrez une erreur 401. Ces erreurs vous aident à gérer efficacement le flux de votre application et l'utilisation du crédit.

Fonctions et limites

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
ID du modèleuncensored
Base URLhttps://api.qwenapis.com/v1
AuthentificationAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Fenêtre de contexte100 000 tokens (entrée + sortie)
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Mode JSONresponse_format: {"type": "json_object"}
Limite de débit300 requêtes par minute et par clé
Concurrence8 requêtes simultanées par clé
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Taillejusqu'à 8 Mo par requête
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Bonus+5 % dès 50 $, +10 % dès 100 $
Validitéle crédit payé n'expire jamais, sans abonnement
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Clésune clé active par compte ; une nouvelle remplace l'ancienne
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé
ConnexionGoogle ou e-mail et mot de passe

Erreurs et solutions

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

Que signifie sans censure pour cette API ?

Cela signifie que le modèle est ajusté pour répondre sans refus de contenu pour des sujets adultes licites, fictifs ou controversés. Il ne bloque pas le contenu adulte standard, mais il bloque le contenu sexuel impliquant des mineurs. Cela le rend adapté à l'écriture créative, au jeu de rôle et à la recherche où un filtrage strict est indésirable.

Ai-je besoin d'une carte bancaire pour commencer ?

Non. Vous pouvez vous inscrire avec simplement un e-mail et un mot de passe pour recevoir 0,50 $ de crédit d'essai valable 7 jours. Cela vous permet de tester l'API sans fournir de détails de paiement. Vous pouvez ajouter du crédit plus tard en utilisant des cryptomonnaies (USDT ou USDC) si vous souhaitez continuer.

S'agit-il de l'API officielle Qwen ?

Non, il s'agit d'un service indépendant exécutant un modèle à poids ouverts sans censure sur nos propres serveurs GPU. Nous ne sommes pas affiliés à Alibaba ou à tout autre fournisseur. Notre API est compatible OpenAI, donc elle fonctionne avec les clients standards, mais c'est un service distinct avec ses propres tarifs et limites.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, changez l'URL de base. C'est toute la configuration.

Obtenir une clé API