KO ▾
apertus.top토큰 기반 과금 uncensored LLM API

5분 내 첫 요청

몇 분 안에 Apertus 무검열 LLM API 사용을 시작하세요. 이 빠른 시작 가이드는 인증, 기본 요청 및 OpenAI 호환 인터페이스를 사용한 스트리밍을 다룹니다.

기본 URL 및 인증

전용 베이스 URL https://api.apertus.top/v1를 사용하여 API에 접근하세요. 이 서비스는 OpenAI와 호환되므로, base_url을 업데이트하고 API 키를 제공하여 표준 SDK를 사용할 수 있습니다. Google 또는 이메일 주소로 API 키 받기 페이지에서 가입하세요. 키는 생성 즉시 표시됩니다. 각 계정에는 활성 키가 하나만 있으며, 새 키를 생성하면 이전 키가 대체됩니다. 월 구독이나 키 만료 날짜는 없습니다. 선불 크레딧은 절대 만료되지 않으며, 사용되지 않은 잔액은 향후 요청에 사용할 수 있습니다. 오류와 거절은 크레딧을 소모하지 않습니다.

첫 번째 요청

연결성 및 청구 테스트를 위해 간단한 텍스트 completion 요청을 보내십시오. 서버에서 호스팅되는 유일한 오픈 웨이트 모델에 접근하려면 uncensored 모델 ID를 사용하십시오. 이 모델은 합법적인 성인 용도로 콘텐츠 거부 없이 답변하도록 조정되었습니다. 기본 URL은 https://api.apertus.top/v1입니다. 가격은 투명합니다: 입력 토큰 100만 개당 $0.25, 출력 토큰 100만 개당 $1.00입니다. 사용한 만큼만 지불합니다.

curl https://api.apertus.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

응답은 생성된 텍스트를 반환합니다. 크레딧이 부족하면 과금 오류가 발생합니다. 처리 중 오류가 발생해도 계정에 요금이 부과되지 않습니다. 대시보드를 통해 USDT(TRC20) 또는 USDC(Base)로 선불 크레딧을 충전할 수 있습니다.

Python SDK 통합

공식 OpenAI Python SDK 또는 호환 가능한 클라이언트를 사용하세요. base_url을 https://api.apertus.top/v1로 설정하고 API 키를 제공하세요. 이렇게 하면 OpenAI용으로 설계된 기존 코드베이스를 활용할 수 있습니다. 엔드포인트 /v1/chat/completions은 모든 텍스트 생성을 처리합니다. 모델 ID는 uncensored입니다. temperature, top_p, stop과 같은 매개변수가 지원됩니다. 스트리밍 응답에는 마지막 청크에 토큰 사용량 세부 정보가 포함됩니다. 구조화된 출력을 위해 함수 호출과 JSON 모드도 사용할 수 있습니다.

from openai import OpenAI

client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK 통합

Apertus 기본 URL로 클라이언트를 초기화하십시오. OpenAI 클래스는 표준 구성 매개변수를 허용합니다. API 키를 전달하고 기본 URL을 https://api.apertus.top/v1로 설정하십시오. 이는 기존 Node.js 애플리케이션과의 호환성을 보장합니다. 모든 요청에는 uncensored 모델 ID가 필요합니다. max_tokens을 사용하여 출력 길이를 제어할 수 있습니다. 지정하지 않은 경우 기본 최대 출력은 2,048 토큰이며, 요청당 hard cap은 32,000 토큰입니다.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

스트리밍 응답

요청에 stream: true을 설정하여 streaming을 활성화하십시오. API는 Server-Sent Events (SSE) 스트림을 반환합니다. 각 청크에는 부분 텍스트가 포함됩니다. 마지막 청크에는 요청에 대한 complete token usage 통계가 포함됩니다. 이를 통해 비용을 추적하면서 결과를 실시간으로 표시할 수 있습니다. streaming은 함수 호출을 포함한 모든 매개변수와 함께 작동합니다. 클라이언트가 SSE 이벤트를 올바르게 처리하도록 하십시오. 컨텍스트 창은 프롬프트와 completion을 합쳐 최대 100,000 토큰을 지원합니다.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

한도, 오류 및 컨텍스트

API는 키당 분당 300개의 요청 제한과 8개의 concurrent 요청을 허용합니다. 최대 요청 본문 크기는 8 MB입니다. 인증 키가 유효하지 않으면 401 오류가 발생합니다. 선불 크레딧이 고갈되면 insufficient funds를 나타내는 402 오류가 발생합니다. 분당 할당량에 따라 rate limiting이 적용됩니다. 컨텍스트 창은 총 100,000 토큰입니다. 요청당 최대 출력은 32,000 토큰입니다. 이 제한을 초과하는 요청은 모델의 표준 동작에 의해 처리됩니다. SLA 백분율은 보장되지 않습니다. 프라이버시가 유지되며 프롬프트는 학습에 사용되지 않습니다.

API 사양

크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.

항목내용
형식OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작
엔드포인트POST /v1/chat/completions · GET /v1/models
Base URLhttps://api.apertus.top/v1
모델 IDuncensored
인증Authorization: Bearer YOUR_KEY
함수 호출지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송
스트리밍지원 — SSE, 마지막 청크에 토큰 사용량 포함
최대 출력64,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음)
파라미터temperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON 모드response_format: {"type": "json_object"}
컨텍스트 창64,000 토큰 (입력 + 출력)
속도 제한키당 분당 300회
동시 요청키당 동시 8개
응답 헤더X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
요청 크기최대 8 MB
보너스$50 이상 +5%, $100 이상 +10%
무료 체험$0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용
과금선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료
충전USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액
유효기간유료 크레딧은 만료되지 않으며 구독 없음
가격입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00
로그인Google 또는 이메일과 비밀번호
콘텐츠성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부
키계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효

오류 코드

오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.

코드유형의미
400bad_request잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과
401missing_key · invalid_key · key_revoked키 없음·잘못됨·새 키로 교체됨
402no_credit잔액 없음 — 충전하면 즉시 재개
403content_blocked미성년자 관련 성적 콘텐츠 — 거부, 과금 없음
404not_found알 수 없는 엔드포인트
413request_too_large본문 8 MB 초과
429rate_limited · concurrency분당 300회 또는 동시 8개 초과 — 잠시 후 재시도
503upstream_busy모델 혼잡 — 몇 초 후 재시도

질문과 답변

API 키는 만료되지 않나요?

아니요, API 키는 만료되지 않습니다. 계정에는 월 구독이나 recurring 요금이 없습니다. 키를 취소하기로 선택할 때까지 무제한으로 사용할 수 있습니다.

속도 제한에 도달하면 어떻게 됩니까?

API는 키당 분당 300개의 요청으로 제한합니다. 이를 초과하면 이후 요청이 지연되거나 거부될 수 있습니다. 동시에 8개의 요청을 보낼 수 있습니다. 이러한 한도 내에서 사용량을 모니터링하세요.

출력이 32,000 토큰을 초과하면 잘려 나가나요?

모델은 요청당 최대 32,000개의 토큰 출력을 지원합니다. 생성된 텍스트가 이를 초과하면 모델에 의해 응답이 잘립니다. 이 한도 내에서 출력 길이를 제어하려면 <code>max_tokens</code> 매개변수를 조정하세요.

키는 양식 하나만 작성하면 받을 수 있습니다

계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 설정은 이것뿐입니다.

API 키 받기문서 읽기