qwenapis.comDocs
API Qwen: prima richiesta in cinque minuti
Ottieni la tua prima risposta dalla nostra API Qwen senza censura in meno di cinque minuti. Questa guida rapida copre installazione, autenticazione e funzionalità core utilizzando client compatibili con OpenAI standard.
URL base e autenticazione
La nostra API segue il formato standard OpenAI, rendendo facile cambiare la configurazione del tuo client esistente. L'URL base per tutte le richieste è https://api.qwenapis.com/v1. Avrai bisogno di una chiave API per autenticare le tue richieste. Se non l'hai ancora creata, visita la pagina Ottieni chiave API per generare una chiave usando solo email e password. Non è richiesta la carta di credito per iniziare con il credito di prova.
Ogni account è limitato a una chiave attiva alla volta. Puoi rigenerare la tua chiave in qualsiasi momento, il che revoca immediatamente quella precedente. Questo garantisce che se la tua chiave viene esposta, puoi proteggere il tuo account istantaneamente senza aspettare un ciclo mensile. Tieni la tua chiave sicura nelle variabili di ambiente o nel gestore di segreti.
Esegui la tua prima richiesta
Verifica la tua configurazione inviando una semplice richiesta di completamento del testo. L'esempio seguente usa curl per inviare un prompt al modello senza censura. Sostituisci YOUR_API_KEY con la chiave generata nel passaggio precedente. L'ID del modello è impostato su uncensored, che è ottimizzato per rispondere senza rifiuti sui contenuti per uso adulto lecito.
curl https://api.qwenapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Se ha successo, riceverai una risposta JSON contenente il testo generato. Se ricevi un errore 401, controlla che la tua chiave sia corretta. Un errore 402 indica che il tuo credito prepagato è stato esaurito.
Integrazione SDK Python
Per gli sviluppatori Python, l'SDK ufficiale OpenAI funziona direttamente con il nostro endpoint. Installa la libreria usando pip, quindi configura il client per puntare al nostro URL base. Questo ti permette di utilizzare metodi familiari come chat.completions.create() senza modificare significativamente la logica della tua applicazione. L'SDK gestisce la serializzazione JSON e la logica di retry per te.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Ricorda di impostare correttamente api_key e base_url. Il nome del modello rimane uncensored. Questo approccio garantisce la compatibilità con il codice scritto per altri provider, rendendo facile cambiare o testare endpoint diversi.
Utilizzo SDK Node
Gli sviluppatori Node.js possono utilizzare il pacchetto npm @anthropic-ai/sdk o l'ufficiale openai. Configura il client con il nostro URL base e la tua chiave API. La struttura della richiesta è identica ad altri servizi compatibili con OpenAI. Questo ti permette di integrare Qwen senza censura nelle tue applicazioni Node.js esistenti con modifiche minime al codice.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Assicurati di gestire appropriatamente la risposta asincrona. L'SDK restituirà l'oggetto di completamento completo, incluse le statistiche di utilizzo dei token. Questo ti aiuta a monitorare il consumo del tuo credito prepagato in tempo reale.
Abilita lo streaming
Per una latenza inferiore e una migliore esperienza utente, abilita lo streaming nelle tue richieste. Lo streaming invia la risposta token per token mentre viene generata, permettendo alla tua applicazione di visualizzare l'output in modo progressivo. Imposta il parametro stream su true nella tua richiesta. L'SDK fornirà uno stream iterabile di chunk.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Questo è particolarmente utile per la generazione di contenuti lunghi o applicazioni interattive. Ogni chunk contiene testo parziale, che puoi aggiungere al tuo buffer di visualizzazione. Lo stream termina quando il modello completa la risposta o raggiunge il limite di contesto.
Limiti, errori e contesto
La nostra API ha limiti specifici per garantire un utilizzo equo. Ti sono consentite 300 richieste al minuto per chiave. La dimensione massima del corpo della richiesta è 8 MB. La finestra di contesto è di 100.000 token, che coprono sia il prompt che il completamento. Se superi il limite di richieste, riceverai un errore 429. Se il tuo credito è insufficiente, riceverai un errore 402. Per chiavi non valide, riceverai un errore 401. Questi errori ti aiutano a gestire il flusso della tua applicazione e l'utilizzo del credito in modo efficace.
Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| ID modello | uncensored |
| Base URL | https://api.qwenapis.com/v1 |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Finestra di contesto | 100.000 token (input + output) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Modalità JSON | response_format: {"type": "json_object"} |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Concorrenza | 8 richieste contemporanee per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Dimensione | fino a 8 MB per richiesta |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Bonus | +5% da $50, +10% da $100 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Accesso | Google oppure e-mail e password |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Cosa significa senza censura per questa API?
Significa che il modello è ottimizzato per rispondere senza rifiuti sui contenuti per argomenti adulti leciti, di fantasia o controversi. Non blocca i contenuti adulti standard, ma blocca i contenuti sessuali che coinvolgono minori. Questo lo rende adatto per la scrittura creativa, il roleplay e la ricerca dove un filtraggio rigoroso è indesiderabile.
Ho bisogno di una carta di credito per iniziare?
No. Puoi registrarti solo con email e password per ricevere $0,50 di credito di prova valido per 7 giorni. Questo ti permette di testare l'API senza fornire dettagli di pagamento. Puoi aggiungere credito in seguito usando criptovalute (USDT o USDC) se desideri continuare.
È l'API ufficiale Qwen?
No, questo è un servizio indipendente che esegue un modello open-weight senza censura sui nostri server GPU. Non siamo affiliati ad Alibaba o ad altri fornitori. La nostra API è compatibile con OpenAI, quindi funziona con client standard, ma è un servizio distinto con i propri prezzi e limiti.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL base. È tutta la configurazione.