Первый запрос за пять минут
Начните работу с API LLM без цензуры Apertus за несколько минут. Это руководство по быстрому старту охватывает аутентификацию, базовые запросы и потоковую передачу через совместимый с OpenAI интерфейс.
Базовый URL и аутентификация
Получите доступ к API, используя выделенный базовый URL https://api.apertus.top/v1. Сервис совместим с OpenAI, что позволяет использовать стандартные SDK, обновив base_url и предоставив ваш API-ключ. Зарегистрируйтесь на странице Получить API-ключ, используя Google или адрес электронной почты. Ваш ключ отображается сразу после создания. В каждом аккаунте есть один активный ключ; генерация нового заменяет предыдущий. Ежемесячных подписок или сроков действия ключа нет. Предоплаченный баланс не сгорает, и неиспользованные средства остаются доступными для будущих запросов. Ошибки и отказы не расходуют ваш баланс.
Первый запрос
Отправьте простой запрос на завершение текста, чтобы проверить подключение и работу биллинга. Используйте идентификатор модели uncensored для доступа к единственной модели с открытыми весами, размещённой на наших серверах. Эта модель настроена на ответы без отказов по содержанию для законного использования взрослыми. Базовый URL — https://api.apertus.top/v1. Цены прозрачны: $0,25 за 1 млн входных токенов и $1,00 за 1 млн выходных токенов. Вы платите только за то, что используете.
curl https://api.apertus.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
В ответе возвращается сгенерированный текст. Если вашего баланса недостаточно, вы получите ошибку биллинга. Ошибки во время обработки не списывают средства с вашего аккаунта. Вы можете пополнить баланс с помощью USDT (TRC20) или USDC (Base) через панель управления.
Интеграция Python SDK
Используйте официальный Python SDK от OpenAI или любой совместимый клиент. Установите base_url в значение https://api.apertus.top/v1 и предоставьте ваш API-ключ. Это позволяет использовать существующие кодовые базы, предназначенные для OpenAI. Эндпоинт /v1/chat/completions обрабатывает всю генерацию текста. Идентификатор модели — uncensored. Поддерживаются такие параметры, как temperature, top_p и stop. Потоковые ответы содержат детали использования токенов в последнем чанке. Также доступны вызов функций и JSON-режим для структурированных выводов.
from openai import OpenAI
client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Интеграция Node SDK
Инициализируйте клиент с базовым URL Apertus. Класс OpenAI принимает стандартные параметры конфигурации. Передайте ваш API-ключ и установите базовый URL в значение https://api.apertus.top/v1. Это обеспечивает совместимость с существующими приложениями Node.js. Идентификатор модели uncensored обязателен для всех запросов. Вы можете контролировать длину вывода с помощью max_tokens. По умолчанию максимальный вывод составляет 2048 токенов, если не указано иное, с жестким лимитом в 32 000 токенов на запрос.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Потоковые ответы
Включите потоковую передачу, установив stream: true в вашем запросе. API возвращает поток Server-Sent Events (SSE). Каждый чанк содержит частичный текст. Последний чанк включает полную статистику использования токенов для запроса. Это позволяет отображать результаты в реальном времени, отслеживая расходы. Потоковая передача работает со всеми параметрами, включая вызов функций. Убедитесь, что ваш клиент правильно обрабатывает события SSE. Контекстное окно поддерживает до 100 000 токенов для промпта и завершения в сумме.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Лимиты, ошибки и контекст
API устанавливает лимит в 300 запросов в минуту на ключ и позволяет до 8 параллельных запросов. Максимальный размер тела запроса составляет 8 МБ. Если ключ аутентификации недействителен, вы получите ошибку 401. Если ваш предоплаченный баланс исчерпан, вы получите ошибку 402, указывающую на недостаток средств. Ограничение частоты применяется на основе квоты в минуту. Контекстное окно составляет 100 000 токенов в сумме. Максимальный вывод на запрос — 32 000 токенов. Запросы, превышающие этот лимит, обрабатываются стандартным поведением модели. Проценты SLA не гарантируются. Поддерживается конфиденциальность; промпты не используются для обучения.
Характеристики API
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.apertus.top/v1 |
| ID модели | uncensored |
| Авторизация | Authorization: Bearer YOUR_KEY |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| Максимум ответа | до остатка окна в 64 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-режим | response_format: {"type": "json_object"} |
| Контекстное окно | 64 000 токенов (вход и ответ вместе) |
| Лимит запросов | 300 запросов в минуту на ключ |
| Параллельные запросы | до 8 одновременно на ключ |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Размер запроса | до 8 МБ |
| Бонус | +5% от $50, +10% от $100 |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Вход | Google или e-mail и пароль |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |
Вопросы и ответы
Истекает ли срок действия моего API-ключа?
Нет, ваш API-ключ не истекает. С вашим аккаунтом не связаны ежемесячные подписки или регулярные платежи. Вы можете использовать ключ бессрочно, пока не решите его отозвать.
Что произойдёт, если я превышу лимит запросов?
API ограничивает вас до 300 запросов в минуту на ключ. Если вы превысите этот лимит, последующие запросы могут быть задержаны или отклонены. Вы также можете выполнять до 8 параллельных запросов одновременно. Следите за использованием, чтобы оставаться в этих пределах.
Обрезается ли вывод, если он превышает 32 000 токенов?
Модель поддерживает максимальный вывод до 32 000 токенов на запрос. Если сгенерированный текст превышает этот лимит, ответ обрезается моделью. Вы можете изменить параметр <code>max_tokens</code>, чтобы контролировать длину вывода в пределах этого лимита.
Ваш ключ — в одной форме от вас
Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.