RU ▾
Получить API-ключ

qwenapis.comДокументация

API Qwen: первый запрос за пять минут

Получите первый ответ от нашего API Qwen без цензуры менее чем за пять минут. Это краткое руководство по установке, аутентификации и основным функциям с использованием стандартных клиентов, совместимых с OpenAI.

Получить API-ключ

Базовый URL и аутентификация

Наш API следует стандартному формату OpenAI, что упрощает переключение конфигурации вашего существующего клиента. Базовый URL для всех запросов: https://api.qwenapis.com/v1. Для аутентификации запросов вам понадобится API-ключ. Если вы ещё не создали его, посетите страницу Получить API-ключ, чтобы сгенерировать ключ, используя только email и пароль. Для начала с пробным балансом кредитная карта не требуется.

К одной учётной записи привязан только один активный ключ одновременно. Вы можете сгенерировать новый ключ в любое время, что немедленно аннулирует предыдущий. Это гарантирует, что если ваш ключ будет скомпрометирован, вы сможете мгновенно защитить учётную запись, не ожидая окончания месячного цикла. Храните ключ в безопасном месте, например в переменных окружения или менеджере секретов.

Первый запрос

Проверьте настройку, отправив простой запрос на генерацию текста. В следующем примере используется curl для отправки промпта модели без цензуры. Замените YOUR_API_KEY на ключ, сгенерированный на предыдущем шаге. Идентификатор модели установлен в uncensored, что означает настройку на ответы без отказов в контенте для законного использования взрослыми.

curl https://api.qwenapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Если запрос успешен, вы получите JSON-ответ, содержащий сгенерированный текст. Если вы получили ошибку 401, проверьте правильность ключа. Ошибка 402 указывает на то, что ваш предоплаченный баланс исчерпан.

Интеграция Python SDK

Для разработчиков на Python официальный SDK OpenAI работает напрямую с нашим эндпоинтом. Установите библиотеку с помощью pip, затем настройте клиент на указание нашего базового URL. Это позволяет использовать знакомые методы, такие как chat.completions.create(), без существенного изменения логики приложения. SDK обрабатывает сериализацию JSON и логику повторных попыток за вас.

from openai import OpenAI

client = OpenAI(base_url="https://api.qwenapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Помните правильно установить api_key и base_url. Имя модели остаётся uncensored. Такой подход обеспечивает совместимость с кодом, написанным для других провайдеров, что позволяет легко переключаться или тестировать различные эндпоинты.

Использование Node SDK

Разработчики Node.js могут использовать пакет @anthropic-ai/sdk или официальный пакет openai npm. Настройте клиент с нашим базовым URL и API-ключом. Структура запроса идентична другим сервисам, совместимым с OpenAI. Это позволяет интегрировать Qwen без цензуры в ваши существующие приложения Node.js с минимальными изменениями в коде.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.qwenapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Убедитесь, что вы правильно обрабатываете асинхронный ответ. SDK вернёт полный объект завершения, включая статистику использования токенов. Это помогает вам отслеживать расход предоплаченного баланса в реальном времени.

Включение потоковой передачи

Для снижения задержки и улучшения пользовательского опыта включите потоковую передачу в запросах. Потоковая передача отправляет ответ токен за токеном по мере его генерации, позволяя вашему приложению отображать вывод постепенно. Установите параметр stream в значение true в вашем запросе. SDK предоставит итерируемый поток фрагментов.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Это особенно полезно для генерации длинных текстов или интерактивных приложений. Каждый фрагмент содержит частичный текст, который можно добавлять в буфер отображения. Потоковая передача завершается, когда модель завершает ответ или достигает лимита контекста.

Лимиты, ошибки и контекст

Наш API имеет определённые лимиты для обеспечения справедливого использования. Вам разрешено 300 запросов в минуту на ключ. Максимальный размер тела запроса составляет 8 МБ. Контекстное окно равно 100 000 токенов, включая промпт и завершение. Если вы превысите лимит запросов, вы получите ошибку 429. Если вашего баланса недостаточно, вы получите ошибку 402. Для недействительных ключей вы получите ошибку 401. Эти ошибки помогают эффективно управлять потоком приложения и расходом средств.

Технические характеристики

Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.

ПараметрЗначение
Формат APIсовместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ
ID моделиuncensored
Base URLhttps://api.qwenapis.com/v1
АвторизацияAuthorization: Bearer YOUR_KEY
ЭндпоинтыPOST /v1/chat/completions · GET /v1/models
Потоковая передачада — server-sent events, последний фрагмент содержит расход токенов
Максимум ответадо остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет)
Параметрыtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Контекстное окно100 000 токенов (вход и ответ вместе)
Вызов функцийда — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool
JSON-режимresponse_format: {"type": "json_object"}
Лимит запросов300 запросов в минуту на ключ
Параллельные запросыдо 8 одновременно на ключ
Заголовки ответаX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Размер запросадо 8 МБ
Оплатапредоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны
ПополнениеUSDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500
Цена$0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных
Бонус+5% от $50, +10% от $100
Срок действияоплаченный баланс не сгорает, без подписки
Пробный баланс$0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения
Ключиодин активный ключ на аккаунт; новый заменяет старый
Контентконтент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён
ВходGoogle или e-mail и пароль

Коды ошибок

Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.

КодТипЧто значит
400bad_requestневерный JSON, пустые сообщения, неверный параметр или превышено окно контекста
401missing_key · invalid_key · key_revokedнет ключа, ключ неверный или заменён новым
402no_creditбаланс пуст — пополните, работа продолжится сразу
403content_blockedсексуальный контент с несовершеннолетними — отказ, без оплаты
404not_foundнеизвестный эндпоинт
413request_too_largeтело запроса больше 8 МБ
429rate_limited · concurrencyбольше 300/мин или 8 параллельно — подождите и повторите
503upstream_busyмодель занята — повторите через несколько секунд

Вопросы и ответы

Что означает «без цензуры» для этого API?

Это означает, что модель настроена на ответы без отказов в контенте для законных взрослых, художественных или спорных тем. Она не блокирует стандартный контент для взрослых, но блокирует сексуальный контент с участием несовершеннолетних. Это делает её подходящей для творческого письма, ролевых игр и исследований, где строгая фильтрация нежелательна.

Нужна ли кредитная карта для начала?

Нет. Вы можете зарегистрироваться, указав только адрес электронной почты и пароль, чтобы получить $0.50 пробного баланса, действительного в течение 7 дней. Это позволит вам протестировать API, не указывая платёжные данные. Позже вы сможете пополнить баланс с помощью криптовалюты (USDT или USDC), если пожелаете продолжить работу.

Это официальный API Qwen?

Нет, это независимый сервис, использующий модель с открытыми весами без цензуры на наших собственных GPU-серверах. Мы не связаны с Alibaba или другими поставщиками. Наш API совместим с OpenAI, поэтому работает со стандартными клиентами, но это отдельный сервис со своими ценами и лимитами.

Ваш ключ — в одной форме от вас

Создайте учётную запись, скопируйте ключ, измените базовый URL. Вот и вся настройка.

Получить API-ключ