qwenapis.comDocumentación
API Qwen: primera petición en cinco minutos
Obtén tu primera respuesta de nuestra API Qwen sin censura en menos de cinco minutos. Esta guía rápida cubre la instalación, la autenticación y la funcionalidad básica utilizando clientes compatibles con OpenAI estándar.
URL base y autenticación
Nuestra API sigue el formato estándar de OpenAI, lo que facilita cambiar la configuración de tu cliente existente. La URL base para todas las peticiones es https://api.qwenapis.com/v1. Necesitarás una clave de API para autenticar tus peticiones. Si aún no has creado una, visita la página Obtener clave de API para generar una usando solo tu correo electrónico y contraseña. No se requiere tarjeta de crédito para comenzar con el crédito de prueba.
Cada cuenta tiene un límite de una clave activa a la vez. Puedes regenerar tu clave en cualquier momento, lo que revoca inmediatamente la anterior. Esto asegura que si tu clave se expone, puedas asegurar tu cuenta al instante sin esperar al ciclo mensual. Mantén tu clave segura en tus variables de entorno o gestor de secretos.
Realiza tu primera petición
Verifica tu configuración enviando una petición simple de finalización de texto. El siguiente ejemplo usa curl para enviar un prompt al modelo sin censura. Reemplaza YOUR_API_KEY con la clave generada en el paso anterior. El ID del modelo está configurado como uncensored, que está ajustado para responder sin rechazos de contenido para uso adulto lícito.
curl https://api.qwenapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Si tienes éxito, recibirás una respuesta JSON que contiene el texto generado. Si recibes un error 401, verifica que tu clave sea correcta. Un error 402 indica que tu crédito prepago se ha agotado.
Integración con SDK de Python
Para desarrolladores de Python, el SDK oficial de OpenAI funciona directamente con nuestro endpoint. Instala la biblioteca usando pip, luego configura el cliente para apuntar a nuestra URL base. Esto te permite usar métodos familiares como chat.completions.create() sin cambiar significativamente la lógica de tu aplicación. El SDK maneja la serialización JSON y la lógica de reintento por ti.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Recuerda configurar correctamente el api_key y el base_url. El nombre del modelo sigue siendo uncensored. Este enfoque asegura la compatibilidad con el código escrito para otros proveedores, facilitando cambiar o probar diferentes endpoints.
Uso del SDK de Node.js
Los desarrolladores de Node.js pueden usar el paquete npm @anthropic-ai/sdk o el oficial openai. Configura el cliente con nuestra URL base y tu clave de API. La estructura de la petición es idéntica a la de otros servicios compatibles con OpenAI. Esto te permite integrar Qwen sin censura en tus aplicaciones Node.js existentes con cambios mínimos de código.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Asegúrate de manejar la respuesta asíncrona apropiadamente. El SDK devolverá el objeto de finalización completo, incluidas las estadísticas de uso de tokens. Esto te ayuda a monitorear el consumo de tu crédito prepago en tiempo real.
Habilitar streaming
Para una menor latencia y una mejor experiencia de usuario, habilita el streaming en tus peticiones. El streaming envía la respuesta token por token a medida que se genera, permitiendo que tu aplicación muestre el progreso de la salida. Establece el parámetro stream en true en tu petición. El SDK proporcionará un flujo iterable de fragmentos.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Esto es particularmente útil para la generación de contenido extenso o aplicaciones interactivas. Cada fragmento contiene texto parcial, que puedes agregar a tu búfer de visualización. El flujo termina cuando el modelo completa la respuesta o alcanza el límite de contexto.
Límites, errores y contexto
Nuestra API tiene límites específicos para garantizar un uso justo. Se te permiten 300 peticiones por minuto por clave. El tamaño máximo del cuerpo de la petición es 8 MB. La ventana de contexto es de 100.000 tokens, cubriendo tanto el prompt como la finalización. Si excedes el límite de peticiones, recibirás un error 429. Si tu crédito es insuficiente, recibirás un error 402. Para claves inválidas, recibirás un error 401. Estos errores te ayudan a gestionar el flujo de tu aplicación y el uso de crédito de manera efectiva.
Funciones y límites
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| ID del modelo | uncensored |
| Base URL | https://api.qwenapis.com/v1 |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Modo JSON | response_format: {"type": "json_object"} |
| Límite de peticiones | 300 por minuto por clave |
| Concurrencia | 8 peticiones a la vez por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamaño de petición | hasta 8 MB |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Bono | +5 % desde $50, +10 % desde $100 |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Acceso | Google o correo y contraseña |
Errores y qué hacer
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Qué significa sin censura para esta API?
Significa que el modelo está ajustado para responder sin rechazos de contenido para temas adultos lícitos, ficticios o controversiales. No bloquea contenido adulto estándar, pero sí bloquea contenido sexual que involucre menores. Esto lo hace adecuado para escritura creativa, roleplay e investigación donde no se desea un filtrado estricto.
¿Necesito una tarjeta de crédito para empezar?
No. Puedes registrarte solo con un correo electrónico y una contraseña para recibir $0,50 de crédito de prueba válido por 7 días. Esto te permite probar la API sin proporcionar datos de pago. Puedes añadir crédito más tarde usando criptomonedas (USDT o USDC) si deseas continuar.
¿Es esta la API oficial de Qwen?
No, este es un servicio independiente que ejecuta un modelo de pesos abiertos sin censura en nuestros propios servidores GPU. No estamos afiliados a Alibaba ni a ningún otro proveedor. Nuestra API es compatible con OpenAI, por lo que funciona con clientes estándar, pero es un servicio distinto con sus propios precios y límites.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.