qwenapis.comDokumentacja
API Qwen: pierwsze zapytanie w pięć minut
Otrzymaj pierwszą odpowiedź od naszego API Qwen bez cenzury w mniej niż pięć minut. Ten przewodnik szybkiego startu obejmuje instalację, uwierzytelnianie i podstawową funkcjonalność przy użyciu standardowych klientów kompatybilnych z OpenAI.
URL bazowy i uwierzytelnianie
Nasz API jest zgodny ze standardowym formatem OpenAI, co ułatwia zmianę konfiguracji istniejącego klienta. Podstawowy URL dla wszystkich zapytań to https://api.qwenapis.com/v1. Do uwierzytelniania zapytań potrzebujesz klucza API. Jeśli jeszcze go nie utworzyłeś, odwiedź stronę Pobierz klucz API, aby wygenerować klucz za pomocą adresu e-mail i hasła. Nie jest wymagana karta kredytowa, aby rozpocząć korzystanie z darmowego kredytu próbnego.
Konto może mieć jednocześnie aktywny tylko jeden klucz. Możesz wygenerować klucz ponownie w dowolnym momencie, co natychmiast unieważnia poprzedni. Dzięki temu, jeśli Twój klucz zostanie ujawniony, możesz zabezpieczyć konto natychmiast, bez oczekiwania na cykl miesięczny. Przechowuj klucz bezpiecznie w zmiennych środowiskowych lub menedżerze sekretów.
Wyślij pierwsze zapytanie
Sprawdź swoją konfigurację, wysyłając proste zapytanie o uzupełnienie tekstu. Poniższy przykład używa curl do wysłania promptu do modelu bez cenzury. Zastąp YOUR_API_KEY kluczem wygenerowanym w poprzednim kroku. ID modelu jest ustawione na uncensored, który jest dostrojony do odpowiadania bez odmów treści dla legalnego użytku dorosłych.
curl https://api.qwenapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Jeśli operacja się powiedzie, otrzymasz odpowiedź JSON zawierającą wygenerowany tekst. Jeśli otrzymasz błąd 401, sprawdź poprawność swojego klucza. Błąd 402 oznacza, że Twój przedpłacony kredyt został wyczerpany.
Integracja z Python SDK
Dla programistów Python oficjalne SDK OpenAI działa bezpośrednio z naszym endpointem. Zainstaluj bibliotekę za pomocą pip, a następnie skonfiguruj klienta tak, aby wskazywał nasz podstawowy adres URL. Pozwala to na korzystanie z znanych metod, takich jak chat.completions.create(), bez istotnych zmian w logice aplikacji. SDK zajmuje się serializacją JSON i logiką ponownych prób za Ciebie.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Pamiętaj o poprawnym ustawieniu api_key i base_url. Nazwa modelu to nadal uncensored. To podejście zapewnia kompatybilność z kodem napisanym dla innych dostawców, ułatwiając zmianę lub testowanie różnych endpointów.
Użycie Node SDK
Programiści Node.js mogą używać @anthropic-ai/sdk lub oficjalnego pakietu npm openai. Skonfiguruj klienta, podając nasz podstawowy adres URL i swój klucz API. Struktura zapytania jest identyczna jak w innych usługach kompatybilnych z OpenAI. Pozwala to na integrację modelu Qwen bez cenzury z istniejącymi aplikacjami Node.js przy minimalnych zmianach kodu.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Upewnij się, że odpowiedź asynchroniczna jest obsługiwana poprawnie. SDK zwróci pełny obiekt uzupełnienia, w tym statystyki użycia tokenów. Pomaga to monitorować zużycie przedpłaconego kredytu w czasie rzeczywistym.
Włącz strumieniowanie
Aby zmniejszyć opóźnienia i poprawić wrażenia użytkownika, włącz strumieniowanie w swoich zapytaniach. Strumieniowanie wysyła token odpowiedzi po tokenie, gdy jest generowany, pozwalając Twojej aplikacji na wyświetlanie wyniku stopniowo. Ustaw parametr stream na true w swoim zapytaniu. SDK dostarczy iterowalny strumień fragmentów.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Jest to szczególnie przydatne przy generowaniu długich treści lub w aplikacjach interaktywnych. Każdy fragment zawiera częściowy tekst, który możesz dołączyć do bufora wyświetlania. Strumień kończy się, gdy model zakończy generowanie odpowiedzi lub osiągnie limit kontekstu.
Limity, błędy i kontekst
Nasze API ma określone limity, aby zapewnić uczciwe użytkowanie. Masz do dyspozycji 300 zapytań na minutę na klucz. Maksymalny rozmiar ciała zapytania to 8 MB. Okno kontekstu wynosi 100 000 tokenów, obejmując zarówno prompt, jak i uzupełnienie. Jeśli przekroczysz limit zapytań, otrzymasz błąd 429. Jeśli Twój kredyt jest niewystarczający, otrzymasz błąd 402. Dla nieprawidłowych kluczy otrzymasz błąd 401. Te błędy pomagają skutecznie zarządzać przepływem aplikacji i zużyciem kredytu.
Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| ID modelu | uncensored |
| Base URL | https://api.qwenapis.com/v1 |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Tryb JSON | response_format: {"type": "json_object"} |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozmiar zapytania | do 8 MB |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Bonus | +5% od $50, +10% od $100 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Co oznacza „bez cenzury” dla tego API?
Oznacza to, że model jest dostrojony do odpowiadania bez odmów treści dla legalnych tematów dorosłych, fikcyjnych lub kontrowersyjnych. Nie blokuje standardowej treści dla dorosłych, ale blokuje treści seksualne z udziałem małoletnich. Jest idealny do pisania kreatywnego, roleplay i badań, gdzie ścisłe filtrowanie jest niepożądane.
Czy potrzebuję karty kredytowej, aby zacząć?
Nie. Możesz się zarejestrować podając tylko e-mail i hasło, aby otrzymać $0,50 kredytu próbnego ważnego przez 7 dni. Pozwoli Ci to przetestować API bez podawania danych płatniczych. Później możesz doładować saldo kryptowalutą (USDT lub USDC), jeśli chcesz kontynuować.
Czy to oficjalne API Qwen?
Nie, to niezależna usługa uruchamiająca model o otwartych wagach bez cenzury na własnych serwerach GPU. Nie jesteśmy powiązani z Alibaba ani żadnym innym dostawcą. Nasze API jest kompatybilne z OpenAI, więc działa ze standardowymi klientami, ale jest to odrębna usługa z własnymi cenami i limitami.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień URL bazowy. To cała konfiguracja.