qwenapis.comDocumentação
API Qwen: primeira requisição em cinco minutos
Obtenha sua primeira resposta da nossa API Qwen sem censura em menos de cinco minutos. Este guia de início rápido cobre instalação, autenticação e funcionalidade principal usando clientes OpenAI-compatíveis padrão.
URL base e autenticação
Nossa API segue o formato padrão da OpenAI, facilitando a alteração da configuração do seu cliente existente. A URL base para todas as requisições é https://api.qwenapis.com/v1. Você precisará de uma chave de API para autenticar suas requisições. Se você ainda não criou uma, visite a página Obter chave de API para gerar uma chave usando apenas seu e-mail e senha. Não é necessário cartão de crédito para começar com o crédito de teste.
Cada conta está limitada a uma chave ativa por vez. Você pode regenerar sua chave a qualquer momento, o que revoga imediatamente a anterior. Isso garante que, se sua chave for exposta, você possa proteger sua conta instantaneamente sem esperar pelo ciclo mensal. Mantenha sua chave segura em suas variáveis de ambiente ou gerenciador de segredos.
Faça sua primeira requisição
Verifique sua configuração enviando uma solicitação simples de conclusão de texto. O exemplo a seguir usa curl para enviar um prompt para o modelo sem censura. Substitua YOUR_API_KEY pela chave gerada na etapa anterior. O ID do modelo é definido como uncensored, que é ajustado para responder sem recusas de conteúdo para uso adulto lícito.
curl https://api.qwenapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Se bem-sucedido, você receberá uma resposta JSON contendo o texto gerado. Se receber um erro 401, verifique se sua chave está correta. Um erro 402 indica que seu crédito pré-pago foi esgotado.
Integração com SDK Python
Para desenvolvedores Python, o SDK oficial da OpenAI funciona diretamente com nosso endpoint. Instale a biblioteca usando pip, em seguida, configure o client para apontar para nossa URL base. Isso permite que você use métodos familiares como chat.completions.create() sem alterar significativamente a lógica do seu aplicativo. O SDK cuida da serialização JSON e da lógica de retry para você.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Lembre-se de definir corretamente o api_key e o base_url. O nome do modelo permanece uncensored. Esta abordagem garante compatibilidade com código escrito para outros provedores, facilitando a alternância ou teste de diferentes endpoints.
Uso do SDK Node.js
Desenvolvedores Node.js podem usar o pacote npm @anthropic-ai/sdk ou o oficial openai. Configure o cliente com nossa URL base e sua chave de API. A estrutura da requisição é idêntica à de outros serviços compatíveis com OpenAI. Isso permite integrar o Qwen sem censura em seus aplicativos Node.js existentes com mínimas alterações de código.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Certifique-se de lidar adequadamente com a resposta assíncrona. O SDK retornará o objeto de conclusão completo, incluindo estatísticas de uso de tokens. Isso ajuda você a monitorar o consumo de seu crédito pré-pago em tempo real.
Ativar streaming
Para menor latência e uma melhor experiência do usuário, ative o streaming nas suas requisições. O streaming envia o token da resposta conforme ele é gerado, permitindo que seu aplicativo exiba o output progressivamente. Defina o parâmetro stream como true na sua requisição. O SDK fornecerá um stream iterável de pedaços.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Isso é particularmente útil para geração de conteúdo longo ou aplicativos interativos. Cada bloco contém texto parcial, que você pode adicionar ao seu buffer de exibição. O stream termina quando o modelo completa a resposta ou atinge o limite da janela de contexto.
Limites, erros e contexto
Nossa API tem limites específicos para garantir uso justo. Você tem permissão para 300 requisições por minuto por chave. O tamanho máximo do corpo da requisição é 8 MB. A janela de contexto é de 100.000 tokens, abrangendo tanto o prompt quanto a conclusão. Se você exceder o limite de requisições, receberá um erro 429. Se seu crédito for insuficiente, receberá um erro 402. Para chaves inválidas, receberá um erro 401. Esses erros ajudam você a gerenciar o fluxo do seu aplicativo e o uso de crédito de forma eficaz.
Recursos e limites
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| ID do modelo | uncensored |
| Base URL | https://api.qwenapis.com/v1 |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Modo JSON | response_format: {"type": "json_object"} |
| Limite de taxa | 300 requisições por minuto por chave |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamanho | até 8 MB por requisição |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Validade | crédito pago não expira, sem assinatura |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Login | Google ou e-mail e senha |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
O que significa sem censura para esta API?
Significa que o modelo é ajustado para responder sem recusas de conteúdo para tópicos adultos lícitos, fictícios ou controversos. Ele não bloqueia conteúdo adulto padrão, mas bloqueia conteúdo sexual envolvendo menores. Isso o torna adequado para escrita criativa, roleplay e pesquisa, onde filtros rigorosos são indesejáveis.
Preciso de cartão de crédito para começar?
Não. Você pode entrar com apenas e-mail e senha para receber $0,50 de crédito de teste válido por 7 dias. Isso permite testar a API sem fornecer dados de pagamento. Você pode adicionar crédito depois usando cripto (USDT ou USDC) se quiser continuar.
Esta é a API oficial do Qwen?
Não, este é um serviço independente executando um modelo de pesos abertos sem censura em nossos próprios servidores GPU. Não somos afiliados à Alibaba ou a qualquer outro fornecedor. Nossa API é compatível com OpenAI, então funciona com clientes padrão, mas é um serviço distinto com seus próprios preços e limites.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.