qwenapis.comDocs
API Qwen : première requête en cinq minutes
Obtenez votre première réponse de notre API Qwen sans censure en moins de cinq minutes. Ce guide de démarrage rapide couvre l'installation, l'authentification et les fonctionnalités de base à l'aide de clients compatibles OpenAI standards.
URL de base et authentification
Notre API suit le format OpenAI standard, ce qui facilite le changement de configuration de votre client existant. L'URL de base pour toutes les requêtes est https://api.qwenapis.com/v1. Vous aurez besoin d'une clé API pour authentifier vos requêtes. Si vous n'en avez pas encore créé une, visitez la page Obtenir la clé API pour générer une clé avec simplement votre e-mail et mot de passe. Aucune carte bancaire n'est requise pour commencer avec le crédit d'essai.
Chaque compte est limité à une clé active à la fois. Vous pouvez régénérer votre clé à tout moment, ce qui révoque immédiatement la précédente. Cela garantit que si votre clé est exposée, vous pouvez sécuriser votre compte instantanément sans attendre un cycle mensuel. Gardez votre clé sécurisée dans vos variables d'environnement ou votre gestionnaire de secrets.
Effectuer votre première requête
Vérifiez votre configuration en envoyant une requête simple de complétion de texte. L'exemple suivant utilise curl pour envoyer un prompt au modèle sans censure. Remplacez YOUR_API_KEY par la clé générée à l'étape précédente. L'ID du modèle est défini sur uncensored, qui est ajusté pour répondre sans refus de contenu pour une utilisation adulte licite.
curl https://api.qwenapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Si cela réussit, vous recevrez une réponse JSON contenant le texte généré. Si vous recevez une erreur 401, vérifiez que votre clé est correcte. Une erreur 402 indique que votre crédit prépayé est épuisé.
Intégration SDK Python
Pour les développeurs Python, le SDK OpenAI officiel fonctionne directement avec notre endpoint. Installez la bibliothèque en utilisant pip, puis configurez le client pour pointer vers notre URL de base. Cela vous permet d'utiliser des méthodes familières comme chat.completions.create() sans modifier significativement la logique de votre application. Le SDK gère la sérialisation JSON et la logique de réessai pour vous.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)N'oubliez pas de définir correctement api_key et base_url. Le nom du modèle reste uncensored. Cette approche garantit la compatibilité avec le code écrit pour d'autres fournisseurs, facilitant le changement ou le test de différents endpoints.
Utilisation SDK Node.js
Les développeurs Node.js peuvent utiliser le package npm @anthropic-ai/sdk ou le package officiel openai. Configurez le client avec notre URL de base et votre clé API. La structure de la requête est identique à celle des autres services compatibles OpenAI. Cela vous permet d'intégrer Qwen sans censure dans vos applications Node.js existantes avec des modifications de code minimales.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Assurez-vous de gérer correctement la réponse asynchrone. Le SDK retournera l'objet de complétion complet, y compris les statistiques d'utilisation des tokens. Cela vous aide à surveiller la consommation de votre crédit prépayé en temps réel.
Activer le streaming
Pour réduire la latence et améliorer l'expérience utilisateur, activez le streaming dans vos requêtes. Le streaming envoie le token par token de la réponse au fur et à mesure de sa génération, ce qui permet à votre application d'afficher la sortie de manière progressive. Définissez le paramètre stream sur true dans votre requête. Le SDK fournira un flux itérable de blocs.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Cela est particulièrement utile pour la génération de contenu long ou les applications interactives. Chaque bloc contient du texte partiel que vous pouvez ajouter à votre tampon d'affichage. Le flux se termine lorsque le modèle termine la réponse ou atteint la limite de la fenêtre de contexte.
Limites, erreurs et contexte
Notre API a des limites spécifiques pour garantir une utilisation équitable. Vous avez droit à 300 requêtes par minute par clé. La taille maximale du corps de la requête est de 8 Mo. La fenêtre de contexte est de 100 000 tokens, couvrant à la fois le prompt et la complétion. Si vous dépassez la limite de débit, vous recevrez une erreur 429. Si votre crédit est insuffisant, vous recevrez une erreur 402. Pour les clés invalides, vous recevrez une erreur 401. Ces erreurs vous aident à gérer efficacement le flux de votre application et l'utilisation du crédit.
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| ID du modèle | uncensored |
| Base URL | https://api.qwenapis.com/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Mode JSON | response_format: {"type": "json_object"} |
| Limite de débit | 300 requêtes par minute et par clé |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Taille | jusqu'à 8 Mo par requête |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Que signifie sans censure pour cette API ?
Cela signifie que le modèle est ajusté pour répondre sans refus de contenu pour des sujets adultes licites, fictifs ou controversés. Il ne bloque pas le contenu adulte standard, mais il bloque le contenu sexuel impliquant des mineurs. Cela le rend adapté à l'écriture créative, au jeu de rôle et à la recherche où un filtrage strict est indésirable.
Ai-je besoin d'une carte bancaire pour commencer ?
Non. Vous pouvez vous inscrire avec simplement un e-mail et un mot de passe pour recevoir 0,50 $ de crédit d'essai valable 7 jours. Cela vous permet de tester l'API sans fournir de détails de paiement. Vous pouvez ajouter du crédit plus tard en utilisant des cryptomonnaies (USDT ou USDC) si vous souhaitez continuer.
S'agit-il de l'API officielle Qwen ?
Non, il s'agit d'un service indépendant exécutant un modèle à poids ouverts sans censure sur nos propres serveurs GPU. Nous ne sommes pas affiliés à Alibaba ou à tout autre fournisseur. Notre API est compatible OpenAI, donc elle fonctionne avec les clients standards, mais c'est un service distinct avec ses propres tarifs et limites.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, changez l'URL de base. C'est toute la configuration.