PT ▾
Obter chave de API

qwenapis.comDocumentação

API Qwen: primeira requisição em cinco minutos

Obtenha sua primeira resposta da nossa API Qwen sem censura em menos de cinco minutos. Este guia de início rápido cobre instalação, autenticação e funcionalidade principal usando clientes OpenAI-compatíveis padrão.

Obter chave de API

URL base e autenticação

Nossa API segue o formato padrão da OpenAI, facilitando a alteração da configuração do seu cliente existente. A URL base para todas as requisições é https://api.qwenapis.com/v1. Você precisará de uma chave de API para autenticar suas requisições. Se você ainda não criou uma, visite a página Obter chave de API para gerar uma chave usando apenas seu e-mail e senha. Não é necessário cartão de crédito para começar com o crédito de teste.

Cada conta está limitada a uma chave ativa por vez. Você pode regenerar sua chave a qualquer momento, o que revoga imediatamente a anterior. Isso garante que, se sua chave for exposta, você possa proteger sua conta instantaneamente sem esperar pelo ciclo mensal. Mantenha sua chave segura em suas variáveis de ambiente ou gerenciador de segredos.

Faça sua primeira requisição

Verifique sua configuração enviando uma solicitação simples de conclusão de texto. O exemplo a seguir usa curl para enviar um prompt para o modelo sem censura. Substitua YOUR_API_KEY pela chave gerada na etapa anterior. O ID do modelo é definido como uncensored, que é ajustado para responder sem recusas de conteúdo para uso adulto lícito.

curl https://api.qwenapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Se bem-sucedido, você receberá uma resposta JSON contendo o texto gerado. Se receber um erro 401, verifique se sua chave está correta. Um erro 402 indica que seu crédito pré-pago foi esgotado.

Integração com SDK Python

Para desenvolvedores Python, o SDK oficial da OpenAI funciona diretamente com nosso endpoint. Instale a biblioteca usando pip, em seguida, configure o client para apontar para nossa URL base. Isso permite que você use métodos familiares como chat.completions.create() sem alterar significativamente a lógica do seu aplicativo. O SDK cuida da serialização JSON e da lógica de retry para você.

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Lembre-se de definir corretamente o api_key e o base_url. O nome do modelo permanece uncensored. Esta abordagem garante compatibilidade com código escrito para outros provedores, facilitando a alternância ou teste de diferentes endpoints.

Uso do SDK Node.js

Desenvolvedores Node.js podem usar o pacote npm @anthropic-ai/sdk ou o oficial openai. Configure o cliente com nossa URL base e sua chave de API. A estrutura da requisição é idêntica à de outros serviços compatíveis com OpenAI. Isso permite integrar o Qwen sem censura em seus aplicativos Node.js existentes com mínimas alterações de código.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Certifique-se de lidar adequadamente com a resposta assíncrona. O SDK retornará o objeto de conclusão completo, incluindo estatísticas de uso de tokens. Isso ajuda você a monitorar o consumo de seu crédito pré-pago em tempo real.

Ativar streaming

Para menor latência e uma melhor experiência do usuário, ative o streaming nas suas requisições. O streaming envia o token da resposta conforme ele é gerado, permitindo que seu aplicativo exiba o output progressivamente. Defina o parâmetro stream como true na sua requisição. O SDK fornecerá um stream iterável de pedaços.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Isso é particularmente útil para geração de conteúdo longo ou aplicativos interativos. Cada bloco contém texto parcial, que você pode adicionar ao seu buffer de exibição. O stream termina quando o modelo completa a resposta ou atinge o limite da janela de contexto.

Limites, erros e contexto

Nossa API tem limites específicos para garantir uso justo. Você tem permissão para 300 requisições por minuto por chave. O tamanho máximo do corpo da requisição é 8 MB. A janela de contexto é de 100.000 tokens, abrangendo tanto o prompt quanto a conclusão. Se você exceder o limite de requisições, receberá um erro 429. Se seu crédito for insuficiente, receberá um erro 402. Para chaves inválidas, receberá um erro 401. Esses erros ajudam você a gerenciar o fluxo do seu aplicativo e o uso de crédito de forma eficaz.

Recursos e limites

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
ID do modelouncensored
Base URLhttps://api.qwenapis.com/v1
AutenticaçãoAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Janela de contexto100.000 tokens (entrada + saída)
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Modo JSONresponse_format: {"type": "json_object"}
Limite de taxa300 requisições por minuto por chave
Concorrência8 requisições ao mesmo tempo por chave
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamanhoaté 8 MB por requisição
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Bônus+5% a partir de $50, +10% a partir de $100
Validadecrédito pago não expira, sem assinatura
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Chavesuma chave ativa por conta; uma nova substitui a anterior
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
LoginGoogle ou e-mail e senha

Erros e o que fazer

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

O que significa sem censura para esta API?

Significa que o modelo é ajustado para responder sem recusas de conteúdo para tópicos adultos lícitos, fictícios ou controversos. Ele não bloqueia conteúdo adulto padrão, mas bloqueia conteúdo sexual envolvendo menores. Isso o torna adequado para escrita criativa, roleplay e pesquisa, onde filtros rigorosos são indesejáveis.

Preciso de cartão de crédito para começar?

Não. Você pode entrar com apenas e-mail e senha para receber $0,50 de crédito de teste válido por 7 dias. Isso permite testar a API sem fornecer dados de pagamento. Você pode adicionar crédito depois usando cripto (USDT ou USDC) se quiser continuar.

Esta é a API oficial do Qwen?

Não, este é um serviço independente executando um modelo de pesos abertos sem censura em nossos próprios servidores GPU. Não somos afiliados à Alibaba ou a qualquer outro fornecedor. Nossa API é compatível com OpenAI, então funciona com clientes padrão, mas é um serviço distinto com seus próprios preços e limites.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API