DE ▾
apertus.topUnzensierte LLM-API, Bezahlung pro Token

Erste Anfrage in fünf Minuten

Starte in wenigen Minuten mit der unzensierten LLM-API von Apertus. Dieser Schnellstart behandelt Authentifizierung, Basisanfragen und Streaming über die OpenAI-kompatible Schnittstelle.

Basis-URL & Auth

Greife über die dedizierte Basis-URL https://api.apertus.top/v1 auf die API zu. Der Dienst ist OpenAI-kompatibel, sodass du Standard-SDKs nutzen kannst, indem du die base_url aktualisierst und deinen API-Schlüssel angibst. Registriere dich auf der Seite API-Schlüssel erhalten mit Google oder einer E-Mail-Adresse. Dein Schlüssel wird sofort nach der Erstellung angezeigt. Jedes Konto hat einen aktiven Schlüssel; das Erzeugen eines neuen ersetzt den vorherigen. Es gibt keine monatlichen Abonnements oder Ablaufdaten für Schlüssel. Prepaid-Guthaben verfällt nie, und nicht verwendete Mittel stehen für zukünftige Anfragen zur Verfügung. Fehler und Ablehnungen verbrauchen kein Guthaben.

Erste Anfrage

Sende eine einfache Textvervollständigungsanfrage, um die Konnektivität und Abrechnung zu testen. Verwende die Modell-ID uncensored, um auf das einzelne Open-Weight-Modell zuzugreifen, das auf unseren Servern gehostet wird. Dieses Modell ist darauf ausgelegt, ohne Inhaltsablehnungen für die legale erwachsene Nutzung zu antworten. Die Basis-URL ist https://api.apertus.top/v1. Die Preise sind transparent: $0,25 pro 1M Input-Token und $1,00 pro 1M Output-Token. Du zahlst nur für das, was du nutzt.

curl https://api.apertus.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Die Antwort gibt den generierten Text zurück. Wenn dein Guthaben nicht ausreicht, erhältst du einen Abrechnungsfehler. Fehler während der Verarbeitung belasten dein Konto nicht. Du kannst über das Dashboard mit USDT (TRC20) oder USDC (Base) aufladen.

Python SDK-Integration

Verwende das offizielle OpenAI Python SDK oder einen kompatiblen Client. Setze die base_url auf https://api.apertus.top/v1 und gib deinen API-Schlüssel an. So kannst du bestehende Codebasen nutzen, die für OpenAI entwickelt wurden. Der Endpunkt /v1/chat/completions verarbeitet alle Textgenerierungen. Die Modell-ID ist uncensored. Parameter wie temperature, top_p und stop werden unterstützt. Streaming-Antworten enthalten Token-Nutzungsdetails im letzten Chunk. Function Calling und JSON-Modus sind ebenfalls für strukturierte Ausgaben verfügbar.

from openai import OpenAI

client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK-Integration

Initialisiere den Client mit der Apertus-Basis-URL. Die Klasse OpenAI akzeptiert die Standardkonfigurationsparameter. Gib deinen API-Schlüssel an und setze die Basis-URL auf https://api.apertus.top/v1. Dies gewährleistet die Kompatibilität mit bestehenden Node.js-Anwendungen. Die Modell-ID uncensored ist für alle Anfragen erforderlich. Du kannst die Ausgabelänge mit max_tokens steuern. Die Standard-Maximalausgabe beträgt 2.048 Token, wenn nicht angegeben, mit einer harten Grenze von 32.000 Token pro Anfrage.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming-Antworten

Aktiviere Streaming, indem du stream: true in deiner Anfrage setzt. Die API gibt einen Server-Sent Events (SSE)-Stream zurück. Jeder Chunk enthält teilweise Text. Der letzte Chunk enthält die vollständigen Token-Nutzungsstatistiken für die Anfrage. So kannst du Ergebnisse in Echtzeit anzeigen und gleichzeitig die Kosten verfolgen. Streaming funktioniert mit allen Parametern, einschließlich Function Calling. Stelle sicher, dass dein Client SSE-Ereignisse korrekt verarbeitet. Das Kontextfenster unterstützt bis zu 100.000 Token für Prompt und Vervollständigung zusammen.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limits, Fehler & Kontext

Die API erzwingt ein Limit von 300 Anfragen pro Minute und Schlüssel und erlaubt 8 parallele Anfragen. Die maximale Größe des Anfragekörpers beträgt 8 MB. Wenn der Authentifizierungsschlüssel ungültig ist, erhältst du einen 401-Fehler. Wenn dein Prepaid-Guthaben aufgebraucht ist, erhältst du einen 402-Fehler, der auf unzureichende Mittel hinweist. Die Ratenbegrenzung wird basierend auf dem pro Minute geltenden Kontingent angewendet. Das Kontextfenster beträgt insgesamt 100.000 Token. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token. Anfragen, die dieses Limit überschreiten, werden vom Standardverhalten des Modells behandelt. Es werden keine SLA-Prozentsätze garantiert. Die Privatsphäre wird gewahrt; Prompts werden nicht zum Training verwendet.

Funktionen und Limits

Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
EndpunktePOST /v1/chat/completions · GET /v1/models
Base-URLhttps://api.apertus.top/v1
Modell-IDuncensored
AuthentifizierungAuthorization: Bearer YOUR_KEY
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Max. Ausgabebis zum Rest des 64.000-Token-Fensters; max_tokens optional (kein separates Limit)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON-Modusresponse_format: {"type": "json_object"}
Kontextfenster64.000 Tokens (Eingabe + Ausgabe)
Ratenlimit300 Anfragen pro Minute und Schlüssel
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Anfragegrößebis 8 MB
Bonus+5 % ab $50, +10 % ab $100
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
AnmeldungGoogle oder E-Mail und Passwort
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Verfällt mein API-Schlüssel?

Nein, dein API-Schlüssel verfällt nie. Es gibt keine monatlichen Abonnements oder wiederkehrenden Gebühren für dein Konto. Du kannst deinen Schlüssel unbegrenzt nutzen, bis du ihn widerrufst.

Was passiert, wenn ich das Ratenlimit erreiche?

Die API begrenzt dich auf 300 Anfragen pro Minute und Schlüssel. Wenn du dies überschreitest, können nachfolgende Anfragen verzögert oder abgelehnt werden. Du kannst auch 8 parallele Anfragen gleichzeitig stellen. Überwache deine Nutzung, um innerhalb dieser Grenzen zu bleiben.

Wird die Ausgabe abgeschnitten, wenn sie 32.000 Token überschreitet?

Das Modell unterstützt eine maximale Ausgabe von 32.000 Token pro Anfrage. Wenn der generierte Text dies überschreitet, wird die Antwort vom Modell abgeschnitten. Du kannst den <code>max_tokens</code>-Parameter anpassen, um die Ausgabelänge innerhalb dieses Limits zu steuern.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhaltenLies die Dokumentation