Qwen API: 5분 내 첫 요청
무검열 Qwen API로 5분 이내에 첫 응답을 받으세요. 이 빠른 시작 가이드는 표준 OpenAI 호환 클라이언트를 사용한 설치, 인증 및 핵심 기능을 다룹니다.
베이스 URL 및 인증
당사 API는 표준 OpenAI 형식을 따르므로 기존 클라이언트 구성을 쉽게 전환할 수 있습니다. 모든 요청의 베이스 URL은 https://api.qwenapis.com/v1입니다. 요청 인증을 위해 API 키가 필요합니다. 아직 생성하지 않았다면 API 키 받기 페이지를 방문하여 이메일과 비밀번호만으로 키를 생성하세요. 시작 시 신용카드가 필요하지 않습니다.
각 계정은 동시에 하나의 활성 키만 가질 수 있습니다. 언제든지 키를 재생성할 수 있으며, 이때 이전 키는 즉시 무효화됩니다. 이는 키가 노출된 경우 월별 주기까지 기다리지 않고 계정을 즉시 보호할 수 있게 해줍니다. 키는 환경 변수나 비밀 관리자에서 안전하게 보관하세요.
첫 번째 요청 보내기
간단한 텍스트 완성 요청을 보내어 설정을 확인하세요. 다음 예시는 curl을 사용하여 프롬프트를 무검열 모델에 전송합니다. YOUR_API_KEY을 이전 단계에서 생성한 키로 바꿉니다. 모델 ID는 uncensored로 설정되며, 이는 합법적인 성인 사용에 대해 콘텐츠 거부 없이 답변하도록 조정되었습니다.
curl https://api.qwenapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'성공하면 생성된 텍스트가 포함된 JSON 응답을 받게 됩니다. 401 오류가 발생하면 키가 올바른지 확인하세요. 402 오류는 선불 크레딧이 소진되었음을 나타냅니다.
Python SDK 통합
Python 개발자의 경우 공식 OpenAI SDK가 당사 엔드포인트와 직접 작동합니다. pip를 사용하여 라이브러리를 설치한 후 클라이언트를 당사 베이스 URL을 가리키도록 구성하세요. 이렇게 하면 애플리케이션 로직을 크게 변경하지 않고도 chat.completions.create()과 같은 익숙한 메서드를 사용할 수 있습니다. SDK는 JSON 직렬화 및 재시도 로직을 처리합니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)api_key 및 base_url을 올바르게 설정하세요. 모델 이름은 여전히 uncensored입니다. 이 접근 방식은 다른 공급업체를 위해 작성된 코드와의 호환성을 보장하여 다른 엔드포인트로 쉽게 전환하거나 테스트할 수 있게 합니다.
Node SDK 사용법
Node.js 개발자는 @anthropic-ai/sdk 또는 공식 openai npm 패키지를 사용할 수 있습니다. 클라이언트를 당사 베이스 URL과 API 키로 구성하세요. 요청 구조는 다른 OpenAI 호환 서비스와 동일합니다. 이를 통해 최소한의 코드 변경으로 기존 Node.js 애플리케이션에 무검열 Qwen을 통합할 수 있습니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);비동기 응답을 적절히 처리하세요. SDK는 토큰 사용량 통계가 포함된 전체 완성 객체를 반환합니다. 이를 통해 선불 크레딧 소비를 실시간으로 모니터링할 수 있습니다.
스트리밍 활성화
낮은 지연 시간과 더 나은 사용자 경험을 위해 요청에서 스트리밍을 활성화하세요. 스트리밍은 생성되는 대로 응답 토큰을 토큰 단위로 전송하여 애플리케이션이 출력을 단계별로 표시할 수 있게 합니다. 요청에서 stream 매개변수를 true로 설정하세요. SDK는 청크의 반복 가능한 스트림을 제공합니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)이는 장문 콘텐츠 생성 또는 대화형 애플리케이션에 특히 유용합니다. 각 청크에는 부분 텍스트가 포함되어 있으며 이를 디스플레이 버퍼에 추가할 수 있습니다. 스트림은 모델이 응답을 완료하거나 컨텍스트 제한에 도달할 때 종료됩니다.
제한 사항, 오류 및 컨텍스트
당사 API는 공정한 사용을 위해 특정 제한 사항을 가지고 있습니다. 키당 분당 300회 요청이 허용됩니다. 최대 요청 본문 크기는 8 MB입니다. 컨텍스트 창은 프롬프트와 완성을 모두 포함하여 100,000 토큰입니다. 속도 제한을 초과하면 429 오류가 발생합니다. 크레딧이 부족하면 402 오류가 발생합니다. 키가 유효하지 않으면 401 오류가 발생합니다. 이러한 오류는 애플리케이션의 흐름과 크레딧 사용을 효과적으로 관리하는 데 도움이 됩니다.
기술 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 모델 ID | uncensored |
| Base URL | https://api.qwenapis.com/v1 |
| 인증 | Authorization: Bearer YOUR_KEY |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| JSON 모드 | response_format: {"type": "json_object"} |
| 속도 제한 | 키당 분당 300회 |
| 동시 요청 | 키당 동시 8개 |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 요청 크기 | 최대 8 MB |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 로그인 | Google 또는 이메일과 비밀번호 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
이 API에서 무검열이란 무엇을 의미합니까?
법적인 성인, 픽션, 논쟁적인 주제에 대해 콘텐츠 거부 없이 답변하도록 모델이 조정되었다는 의미입니다. 일반적인 성인 콘텐츠는 차단하지 않지만 미성년자가 관련된 성 콘텐츠는 차단합니다. 이는 엄격한 필터링이 바람직하지 않은 창작 글쓰기, 역할극, 연구에 적합합니다.
시작하려면 신용카드가 필요한가요?
아니요. 이메일과 비밀번호만으로 가입하여 7일 유효한 $0.50의 무료 체험 크레딧을 받을 수 있습니다. 이를 통해 결제 정보를 제공하지 않고도 API를 테스트할 수 있습니다. 계속 사용하려면 나중에 암호화폐(USDT 또는 USDC)로 크레딧을 충전할 수 있습니다.
이것이 공식 Qwen API인가요?
아니요, 이는 자체 GPU 서버에서 오픈 웨이트 무검열 모델을 실행하는 독립적인 서비스입니다. 알리바바나 기타 벤더와 제휴 관계가 없습니다. 이 API는 OpenAI 호환형이므로 표준 클라이언트에서 작동하지만, 자체 가격과 제한을 가진 별도의 서비스입니다.