RU ▾
apertus.topНецензурная LLM API, оплата за токен

Первый запрос за пять минут

Начните работу с API LLM без цензуры Apertus за несколько минут. Это руководство по быстрому старту охватывает аутентификацию, базовые запросы и потоковую передачу через совместимый с OpenAI интерфейс.

Базовый URL и аутентификация

Получите доступ к API, используя выделенный базовый URL https://api.apertus.top/v1. Сервис совместим с OpenAI, что позволяет использовать стандартные SDK, обновив base_url и предоставив ваш API-ключ. Зарегистрируйтесь на странице Получить API-ключ, используя Google или адрес электронной почты. Ваш ключ отображается сразу после создания. В каждом аккаунте есть один активный ключ; генерация нового заменяет предыдущий. Ежемесячных подписок или сроков действия ключа нет. Предоплаченный баланс не сгорает, и неиспользованные средства остаются доступными для будущих запросов. Ошибки и отказы не расходуют ваш баланс.

Первый запрос

Отправьте простой запрос на завершение текста, чтобы проверить подключение и работу биллинга. Используйте идентификатор модели uncensored для доступа к единственной модели с открытыми весами, размещённой на наших серверах. Эта модель настроена на ответы без отказов по содержанию для законного использования взрослыми. Базовый URL — https://api.apertus.top/v1. Цены прозрачны: $0,25 за 1 млн входных токенов и $1,00 за 1 млн выходных токенов. Вы платите только за то, что используете.

curl https://api.apertus.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

В ответе возвращается сгенерированный текст. Если вашего баланса недостаточно, вы получите ошибку биллинга. Ошибки во время обработки не списывают средства с вашего аккаунта. Вы можете пополнить баланс с помощью USDT (TRC20) или USDC (Base) через панель управления.

Интеграция Python SDK

Используйте официальный Python SDK от OpenAI или любой совместимый клиент. Установите base_url в значение https://api.apertus.top/v1 и предоставьте ваш API-ключ. Это позволяет использовать существующие кодовые базы, предназначенные для OpenAI. Эндпоинт /v1/chat/completions обрабатывает всю генерацию текста. Идентификатор модели — uncensored. Поддерживаются такие параметры, как temperature, top_p и stop. Потоковые ответы содержат детали использования токенов в последнем чанке. Также доступны вызов функций и JSON-режим для структурированных выводов.

from openai import OpenAI

client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Интеграция Node SDK

Инициализируйте клиент с базовым URL Apertus. Класс OpenAI принимает стандартные параметры конфигурации. Передайте ваш API-ключ и установите базовый URL в значение https://api.apertus.top/v1. Это обеспечивает совместимость с существующими приложениями Node.js. Идентификатор модели uncensored обязателен для всех запросов. Вы можете контролировать длину вывода с помощью max_tokens. По умолчанию максимальный вывод составляет 2048 токенов, если не указано иное, с жестким лимитом в 32 000 токенов на запрос.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Потоковые ответы

Включите потоковую передачу, установив stream: true в вашем запросе. API возвращает поток Server-Sent Events (SSE). Каждый чанк содержит частичный текст. Последний чанк включает полную статистику использования токенов для запроса. Это позволяет отображать результаты в реальном времени, отслеживая расходы. Потоковая передача работает со всеми параметрами, включая вызов функций. Убедитесь, что ваш клиент правильно обрабатывает события SSE. Контекстное окно поддерживает до 100 000 токенов для промпта и завершения в сумме.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Лимиты, ошибки и контекст

API устанавливает лимит в 300 запросов в минуту на ключ и позволяет до 8 параллельных запросов. Максимальный размер тела запроса составляет 8 МБ. Если ключ аутентификации недействителен, вы получите ошибку 401. Если ваш предоплаченный баланс исчерпан, вы получите ошибку 402, указывающую на недостаток средств. Ограничение частоты применяется на основе квоты в минуту. Контекстное окно составляет 100 000 токенов в сумме. Максимальный вывод на запрос — 32 000 токенов. Запросы, превышающие этот лимит, обрабатываются стандартным поведением модели. Проценты SLA не гарантируются. Поддерживается конфиденциальность; промпты не используются для обучения.

Характеристики API

Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.

ПараметрЗначение
Формат APIсовместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ
ЭндпоинтыPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.apertus.top/v1
ID моделиuncensored
АвторизацияAuthorization: Bearer YOUR_KEY
Вызов функцийда — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool
Потоковая передачада — server-sent events, последний фрагмент содержит расход токенов
Максимум ответадо остатка окна в 64 000 токенов; max_tokens необязателен (отдельного лимита нет)
Параметрыtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON-режимresponse_format: {"type": "json_object"}
Контекстное окно64 000 токенов (вход и ответ вместе)
Лимит запросов300 запросов в минуту на ключ
Параллельные запросыдо 8 одновременно на ключ
Заголовки ответаX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Размер запросадо 8 МБ
Бонус+5% от $50, +10% от $100
Пробный баланс$0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения
Оплатапредоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны
ПополнениеUSDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500
Срок действияоплаченный баланс не сгорает, без подписки
Цена$0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных
ВходGoogle или e-mail и пароль
Контентконтент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён
Ключиодин активный ключ на аккаунт; новый заменяет старый

Коды ошибок

Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.

КодТипЧто значит
400bad_requestневерный JSON, пустые сообщения, неверный параметр или превышено окно контекста
401missing_key · invalid_key · key_revokedнет ключа, ключ неверный или заменён новым
402no_creditбаланс пуст — пополните, работа продолжится сразу
403content_blockedсексуальный контент с несовершеннолетними — отказ, без оплаты
404not_foundнеизвестный эндпоинт
413request_too_largeтело запроса больше 8 МБ
429rate_limited · concurrencyбольше 300/мин или 8 параллельно — подождите и повторите
503upstream_busyмодель занята — повторите через несколько секунд

Вопросы и ответы

Истекает ли срок действия моего API-ключа?

Нет, ваш API-ключ не истекает. С вашим аккаунтом не связаны ежемесячные подписки или регулярные платежи. Вы можете использовать ключ бессрочно, пока не решите его отозвать.

Что произойдёт, если я превышу лимит запросов?

API ограничивает вас до 300 запросов в минуту на ключ. Если вы превысите этот лимит, последующие запросы могут быть задержаны или отклонены. Вы также можете выполнять до 8 параллельных запросов одновременно. Следите за использованием, чтобы оставаться в этих пределах.

Обрезается ли вывод, если он превышает 32 000 токенов?

Модель поддерживает максимальный вывод до 32 000 токенов на запрос. Если сгенерированный текст превышает этот лимит, ответ обрезается моделью. Вы можете изменить параметр <code>max_tokens</code>, чтобы контролировать длину вывода в пределах этого лимита.

Ваш ключ — в одной форме от вас

Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.

Получить API-ключПрочитать документацию