5분 내 첫 요청
몇 분 안에 Apertus 무검열 LLM API 사용을 시작하세요. 이 빠른 시작 가이드는 인증, 기본 요청 및 OpenAI 호환 인터페이스를 사용한 스트리밍을 다룹니다.
기본 URL 및 인증
전용 베이스 URL https://api.apertus.top/v1를 사용하여 API에 접근하세요. 이 서비스는 OpenAI와 호환되므로, base_url을 업데이트하고 API 키를 제공하여 표준 SDK를 사용할 수 있습니다. Google 또는 이메일 주소로 API 키 받기 페이지에서 가입하세요. 키는 생성 즉시 표시됩니다. 각 계정에는 활성 키가 하나만 있으며, 새 키를 생성하면 이전 키가 대체됩니다. 월 구독이나 키 만료 날짜는 없습니다. 선불 크레딧은 절대 만료되지 않으며, 사용되지 않은 잔액은 향후 요청에 사용할 수 있습니다. 오류와 거절은 크레딧을 소모하지 않습니다.
첫 번째 요청
연결성 및 청구 테스트를 위해 간단한 텍스트 completion 요청을 보내십시오. 서버에서 호스팅되는 유일한 오픈 웨이트 모델에 접근하려면 uncensored 모델 ID를 사용하십시오. 이 모델은 합법적인 성인 용도로 콘텐츠 거부 없이 답변하도록 조정되었습니다. 기본 URL은 https://api.apertus.top/v1입니다. 가격은 투명합니다: 입력 토큰 100만 개당 $0.25, 출력 토큰 100만 개당 $1.00입니다. 사용한 만큼만 지불합니다.
curl https://api.apertus.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
응답은 생성된 텍스트를 반환합니다. 크레딧이 부족하면 과금 오류가 발생합니다. 처리 중 오류가 발생해도 계정에 요금이 부과되지 않습니다. 대시보드를 통해 USDT(TRC20) 또는 USDC(Base)로 선불 크레딧을 충전할 수 있습니다.
Python SDK 통합
공식 OpenAI Python SDK 또는 호환 가능한 클라이언트를 사용하세요. base_url을 https://api.apertus.top/v1로 설정하고 API 키를 제공하세요. 이렇게 하면 OpenAI용으로 설계된 기존 코드베이스를 활용할 수 있습니다. 엔드포인트 /v1/chat/completions은 모든 텍스트 생성을 처리합니다. 모델 ID는 uncensored입니다. temperature, top_p, stop과 같은 매개변수가 지원됩니다. 스트리밍 응답에는 마지막 청크에 토큰 사용량 세부 정보가 포함됩니다. 구조화된 출력을 위해 함수 호출과 JSON 모드도 사용할 수 있습니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK 통합
Apertus 기본 URL로 클라이언트를 초기화하십시오. OpenAI 클래스는 표준 구성 매개변수를 허용합니다. API 키를 전달하고 기본 URL을 https://api.apertus.top/v1로 설정하십시오. 이는 기존 Node.js 애플리케이션과의 호환성을 보장합니다. 모든 요청에는 uncensored 모델 ID가 필요합니다. max_tokens을 사용하여 출력 길이를 제어할 수 있습니다. 지정하지 않은 경우 기본 최대 출력은 2,048 토큰이며, 요청당 hard cap은 32,000 토큰입니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
스트리밍 응답
요청에 stream: true을 설정하여 streaming을 활성화하십시오. API는 Server-Sent Events (SSE) 스트림을 반환합니다. 각 청크에는 부분 텍스트가 포함됩니다. 마지막 청크에는 요청에 대한 complete token usage 통계가 포함됩니다. 이를 통해 비용을 추적하면서 결과를 실시간으로 표시할 수 있습니다. streaming은 함수 호출을 포함한 모든 매개변수와 함께 작동합니다. 클라이언트가 SSE 이벤트를 올바르게 처리하도록 하십시오. 컨텍스트 창은 프롬프트와 completion을 합쳐 최대 100,000 토큰을 지원합니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
한도, 오류 및 컨텍스트
API는 키당 분당 300개의 요청 제한과 8개의 concurrent 요청을 허용합니다. 최대 요청 본문 크기는 8 MB입니다. 인증 키가 유효하지 않으면 401 오류가 발생합니다. 선불 크레딧이 고갈되면 insufficient funds를 나타내는 402 오류가 발생합니다. 분당 할당량에 따라 rate limiting이 적용됩니다. 컨텍스트 창은 총 100,000 토큰입니다. 요청당 최대 출력은 32,000 토큰입니다. 이 제한을 초과하는 요청은 모델의 표준 동작에 의해 처리됩니다. SLA 백분율은 보장되지 않습니다. 프라이버시가 유지되며 프롬프트는 학습에 사용되지 않습니다.
API 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.apertus.top/v1 |
| 모델 ID | uncensored |
| 인증 | Authorization: Bearer YOUR_KEY |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 최대 출력 | 64,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON 모드 | response_format: {"type": "json_object"} |
| 컨텍스트 창 | 64,000 토큰 (입력 + 출력) |
| 속도 제한 | 키당 분당 300회 |
| 동시 요청 | 키당 동시 8개 |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 요청 크기 | 최대 8 MB |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
API 키는 만료되지 않나요?
아니요, API 키는 만료되지 않습니다. 계정에는 월 구독이나 recurring 요금이 없습니다. 키를 취소하기로 선택할 때까지 무제한으로 사용할 수 있습니다.
속도 제한에 도달하면 어떻게 됩니까?
API는 키당 분당 300개의 요청으로 제한합니다. 이를 초과하면 이후 요청이 지연되거나 거부될 수 있습니다. 동시에 8개의 요청을 보낼 수 있습니다. 이러한 한도 내에서 사용량을 모니터링하세요.
출력이 32,000 토큰을 초과하면 잘려 나가나요?
모델은 요청당 최대 32,000개의 토큰 출력을 지원합니다. 생성된 텍스트가 이를 초과하면 모델에 의해 응답이 잘립니다. 이 한도 내에서 출력 길이를 제어하려면 <code>max_tokens</code> 매개변수를 조정하세요.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 설정은 이것뿐입니다.