Erste Anfrage in fünf Minuten
Starte in wenigen Minuten mit der unzensierten LLM-API von Apertus. Dieser Schnellstart behandelt Authentifizierung, Basisanfragen und Streaming über die OpenAI-kompatible Schnittstelle.
Basis-URL & Auth
Greife über die dedizierte Basis-URL https://api.apertus.top/v1 auf die API zu. Der Dienst ist OpenAI-kompatibel, sodass du Standard-SDKs nutzen kannst, indem du die base_url aktualisierst und deinen API-Schlüssel angibst. Registriere dich auf der Seite API-Schlüssel erhalten mit Google oder einer E-Mail-Adresse. Dein Schlüssel wird sofort nach der Erstellung angezeigt. Jedes Konto hat einen aktiven Schlüssel; das Erzeugen eines neuen ersetzt den vorherigen. Es gibt keine monatlichen Abonnements oder Ablaufdaten für Schlüssel. Prepaid-Guthaben verfällt nie, und nicht verwendete Mittel stehen für zukünftige Anfragen zur Verfügung. Fehler und Ablehnungen verbrauchen kein Guthaben.
Erste Anfrage
Sende eine einfache Textvervollständigungsanfrage, um die Konnektivität und Abrechnung zu testen. Verwende die Modell-ID uncensored, um auf das einzelne Open-Weight-Modell zuzugreifen, das auf unseren Servern gehostet wird. Dieses Modell ist darauf ausgelegt, ohne Inhaltsablehnungen für die legale erwachsene Nutzung zu antworten. Die Basis-URL ist https://api.apertus.top/v1. Die Preise sind transparent: $0,25 pro 1M Input-Token und $1,00 pro 1M Output-Token. Du zahlst nur für das, was du nutzt.
curl https://api.apertus.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Die Antwort gibt den generierten Text zurück. Wenn dein Guthaben nicht ausreicht, erhältst du einen Abrechnungsfehler. Fehler während der Verarbeitung belasten dein Konto nicht. Du kannst über das Dashboard mit USDT (TRC20) oder USDC (Base) aufladen.
Python SDK-Integration
Verwende das offizielle OpenAI Python SDK oder einen kompatiblen Client. Setze die base_url auf https://api.apertus.top/v1 und gib deinen API-Schlüssel an. So kannst du bestehende Codebasen nutzen, die für OpenAI entwickelt wurden. Der Endpunkt /v1/chat/completions verarbeitet alle Textgenerierungen. Die Modell-ID ist uncensored. Parameter wie temperature, top_p und stop werden unterstützt. Streaming-Antworten enthalten Token-Nutzungsdetails im letzten Chunk. Function Calling und JSON-Modus sind ebenfalls für strukturierte Ausgaben verfügbar.
from openai import OpenAI
client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK-Integration
Initialisiere den Client mit der Apertus-Basis-URL. Die Klasse OpenAI akzeptiert die Standardkonfigurationsparameter. Gib deinen API-Schlüssel an und setze die Basis-URL auf https://api.apertus.top/v1. Dies gewährleistet die Kompatibilität mit bestehenden Node.js-Anwendungen. Die Modell-ID uncensored ist für alle Anfragen erforderlich. Du kannst die Ausgabelänge mit max_tokens steuern. Die Standard-Maximalausgabe beträgt 2.048 Token, wenn nicht angegeben, mit einer harten Grenze von 32.000 Token pro Anfrage.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming-Antworten
Aktiviere Streaming, indem du stream: true in deiner Anfrage setzt. Die API gibt einen Server-Sent Events (SSE)-Stream zurück. Jeder Chunk enthält teilweise Text. Der letzte Chunk enthält die vollständigen Token-Nutzungsstatistiken für die Anfrage. So kannst du Ergebnisse in Echtzeit anzeigen und gleichzeitig die Kosten verfolgen. Streaming funktioniert mit allen Parametern, einschließlich Function Calling. Stelle sicher, dass dein Client SSE-Ereignisse korrekt verarbeitet. Das Kontextfenster unterstützt bis zu 100.000 Token für Prompt und Vervollständigung zusammen.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limits, Fehler & Kontext
Die API erzwingt ein Limit von 300 Anfragen pro Minute und Schlüssel und erlaubt 8 parallele Anfragen. Die maximale Größe des Anfragekörpers beträgt 8 MB. Wenn der Authentifizierungsschlüssel ungültig ist, erhältst du einen 401-Fehler. Wenn dein Prepaid-Guthaben aufgebraucht ist, erhältst du einen 402-Fehler, der auf unzureichende Mittel hinweist. Die Ratenbegrenzung wird basierend auf dem pro Minute geltenden Kontingent angewendet. Das Kontextfenster beträgt insgesamt 100.000 Token. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token. Anfragen, die dieses Limit überschreiten, werden vom Standardverhalten des Modells behandelt. Es werden keine SLA-Prozentsätze garantiert. Die Privatsphäre wird gewahrt; Prompts werden nicht zum Training verwendet.
Funktionen und Limits
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.apertus.top/v1 |
| Modell-ID | uncensored |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Max. Ausgabe | bis zum Rest des 64.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-Modus | response_format: {"type": "json_object"} |
| Kontextfenster | 64.000 Tokens (Eingabe + Ausgabe) |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Anfragegröße | bis 8 MB |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Anmeldung | Google oder E-Mail und Passwort |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Verfällt mein API-Schlüssel?
Nein, dein API-Schlüssel verfällt nie. Es gibt keine monatlichen Abonnements oder wiederkehrenden Gebühren für dein Konto. Du kannst deinen Schlüssel unbegrenzt nutzen, bis du ihn widerrufst.
Was passiert, wenn ich das Ratenlimit erreiche?
Die API begrenzt dich auf 300 Anfragen pro Minute und Schlüssel. Wenn du dies überschreitest, können nachfolgende Anfragen verzögert oder abgelehnt werden. Du kannst auch 8 parallele Anfragen gleichzeitig stellen. Überwache deine Nutzung, um innerhalb dieser Grenzen zu bleiben.
Wird die Ausgabe abgeschnitten, wenn sie 32.000 Token überschreitet?
Das Modell unterstützt eine maximale Ausgabe von 32.000 Token pro Anfrage. Wenn der generierte Text dies überschreitet, wird die Antwort vom Modell abgeschnitten. Du kannst den <code>max_tokens</code>-Parameter anpassen, um die Ausgabelänge innerhalb dieses Limits zu steuern.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.