NL ▾
apertus.topOngecensureerd LLM API, betaal per token

Eerste verzoek in vijf minuten

Kom in enkele minuten aan de slag met de ongecensureerde LLM API van Apertus. Deze quickstart-gids behandelt authenticatie, basisverzoeken en streaming via de OpenAI-compatibele interface.

Basis-URL & Authenticatie

Gebruik de API via de specifieke basis-URL https://api.apertus.top/v1. De dienst is OpenAI-compatibel, dus je kunt standaard SDK's gebruiken door de base_url aan te passen en je API-sleutel op te geven. Meld je aan op de pagina API-sleutel ophalen met Google of een e-mailadres. Je sleutel wordt direct na aanmaken weergegeven. Elk account heeft één actieve sleutel; het genereren van een nieuwe vervangt de vorige. Er zijn geen maandelijkse abonnementen of vervaldatums voor sleutels. Prepaid tegoed verloopt niet, en ongebruikt saldo blijft beschikbaar voor toekomstige verzoeken. Fouten en weigeringen verbruiken geen tegoed.

Eerste verzoek

Stuur een eenvoudig verzoek voor tekstgeneratie om de connectiviteit en facturatie te testen. Gebruik de model-ID uncensored om toegang te krijgen tot het enige open-weight model dat op onze servers wordt gehost. Dit model is afgestemd om te antwoorden zonder inhoudelijke weigeringen voor wettelijk volwassen gebruik. De basis-URL is https://api.apertus.top/v1. Prijzen zijn transparant: $0,25 per 1M input-tokens en $1,00 per 1M output-tokens. Je betaalt alleen voor wat je gebruikt.

curl https://api.apertus.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Het antwoord bevat de gegenereerde tekst. Als je tegoed onvoldoende is, ontvang je een facturatiefout. Fouten tijdens het verwerken worden niet in rekening gebracht. Je kunt opwaarderen met USDT (TRC20) of USDC (Base) via het dashboard.

Python SDK-integratie

Gebruik de officiële OpenAI Python SDK of een compatibele client. Stel de base_url in op https://api.apertus.top/v1 en geef je API-sleutel op. Hiermee kun je bestaande codebases gebruiken die voor OpenAI zijn ontworpen. Het endpoint /v1/chat/completions verzorgt alle tekstgeneratie. De model-ID is uncensored. Parameters zoals temperature, top_p en stop worden ondersteund. Streaming-antwoorden bevatten token-gebruiksgegevens in het laatste chunk. Function calling en JSON-modus zijn ook beschikbaar voor gestructureerde outputs.

from openai import OpenAI

client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK-integratie

Initialiseer de client met de Apertus basis-URL. De klasse OpenAI accepteert de standaard configuratieparameters. Geef je API-sleutel door en stel de basis-URL in op https://api.apertus.top/v1. Dit zorgt voor compatibiliteit met bestaande Node.js-applicaties. De model-ID uncensored is vereist voor alle verzoeken. Je kunt de outputlengte beheren met max_tokens. De standaard maximale output is 2.048 tokens als dit niet wordt opgegeven, met een harde limiet van 32.000 tokens per verzoek.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming-antwoorden

Schakel streaming in door stream: true in je verzoek in te stellen. De API retourneert een Server-Sent Events (SSE)-stream. Elk chunk bevat gedeeltelijke tekst. Het laatste chunk bevat de volledige token-gebruiksstatistieken voor het verzoek. Hiermee kun je resultaten in realtime weergeven terwijl je de kosten bijhoudt. Streaming werkt met alle parameters, inclusief function calling. Zorg dat je client SSE-gebeurtenissen correct verwerkt. Het contextvenster ondersteunt tot 100.000 tokens voor prompt en completion samen.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limieten, fouten & context

De API handhaaft een limiet van 300 verzoeken per minuut per sleutel en staat 8 gelijktijdige verzoeken toe. De maximale grootte van de request body is 8 MB. Als de authenticatiesleutel ongeldig is, ontvang je een 401-fout. Als je prepaid tegoed op is, ontvang je een 402-fout die onvoldoende saldo aangeeft. Rate limiting wordt toegepast op basis van de minuutquota. Het contextvenster is 100.000 tokens in totaal. De maximale output per verzoek is 32.000 tokens. Verzoeken die deze limiet overschrijden, worden afgehandeld door het standaardgedrag van het model. Er worden geen SLA-percentages gegarandeerd. Privacy wordt gewaarborgd; prompts worden niet gebruikt voor training.

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.apertus.top/v1
Model-IDuncensored
AuthenticatieAuthorization: Bearer YOUR_KEY
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Max. uitvoertot de rest van het venster van 64.000 tokens; max_tokens optioneel (geen aparte limiet)
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON-modusresponse_format: {"type": "json_object"}
Contextvenster64.000 tokens (invoer + uitvoer)
Rate limit300 verzoeken per minuut per sleutel
Gelijktijdige verzoekentot 8 tegelijk per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Verzoekgroottetot 8 MB
Bonus+5% vanaf $50, +10% vanaf $100
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
InloggenGoogle of e-mail en wachtwoord
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Verloopt mijn API-sleutel?

Nee, je API-sleutel verloopt niet. Er zijn geen maandelijkse abonnementen of terugkerende kosten voor je account. Je kunt je sleutel onbeperkt gebruiken tot je hem intrekt.

Wat gebeurt er als ik de rate limit raak?

De API beperkt je tot 300 verzoeken per minuut per sleutel. Als je dit overschrijdt, kunnen volgende verzoeken worden vertraagd of afgewezen. Je kunt ook 8 gelijktijdige verzoeken tegelijk uitvoeren. Houd je gebruik in de gaten om binnen deze grenzen te blijven.

Wordt de output afgekapt als deze meer dan 32.000 tokens overschrijdt?

Het model ondersteunt een maximale output van 32.000 tokens per verzoek. Als de gegenereerde tekst dit overschrijdt, wordt het antwoord door het model afgekapt. Je kunt de <code>max_tokens</code> parameter aanpassen om de outputlengte binnen deze limiet te beheren.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.

API-sleutel ophalenDocs lezen