Première requête en cinq minutes
Commencez avec l'API LLM sans censure Apertus en quelques minutes. Ce guide de démarrage rapide couvre l'authentification, les requêtes de base et le streaming via l'interface compatible OpenAI.
URL de base et authentification
Accédez à l'API via l'URL de base dédiée https://api.apertus.top/v1. Le service est compatible OpenAI, ce qui vous permet d'utiliser des SDK standard en mettant à jour le base_url et en fournissant votre clé API. Inscrivez-vous sur la page Obtenir la clé API avec Google ou une adresse e-mail. Votre clé s'affiche immédiatement après sa création. Chaque compte détient une clé active ; la génération d'une nouvelle clé remplace la précédente. Il n'y a ni abonnement mensuel ni date d'expiration des clés. Le crédit prépayé n'expire jamais, et les fonds inutilisés restent disponibles pour les requêtes futures. Les erreurs et les refus ne consomment pas votre crédit.
Première requête
Envoyez une requête simple de complétion de texte pour tester la connectivité et la facturation. Utilisez l'ID de modèle uncensored pour accéder au seul modèle à poids ouverts hébergé sur nos serveurs. Ce modèle est optimisé pour répondre sans refus de contenu pour un usage adulte légal. L'URL de base est https://api.apertus.top/v1. La tarification est transparente : 0,25 $ par 1 M de tokens d'entrée et 1,00 $ par 1 M de tokens de sortie. Vous ne payez que ce que vous utilisez.
curl https://api.apertus.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
La réponse retourne le texte généré. Si votre crédit est insuffisant, vous recevrez une erreur de facturation. Les erreurs lors du traitement ne débitent pas votre compte. Vous pouvez recharger en utilisant USDT (TRC20) ou USDC (Base) via le tableau de bord.
Intégration SDK Python
Utilisez le SDK Python officiel OpenAI ou tout client compatible. Définissez le base_url sur https://api.apertus.top/v1 et fournissez votre clé API. Cela vous permet de tirer parti des bases de code existantes conçues pour OpenAI. L'endpoint /v1/chat/completions gère toutes les générations de texte. L'ID de modèle est uncensored. Les paramètres tels que temperature, top_p et stop sont pris en charge. Les réponses en streaming incluent les détails d'utilisation des tokens dans le dernier chunk. L'appel de fonctions et le mode JSON sont également disponibles pour les sorties structurées.
from openai import OpenAI
client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Intégration SDK Node
Initialisez le client avec l'URL de base Apertus. La classe OpenAI accepte les paramètres de configuration standard. Transmettez votre clé API et définissez l'URL de base sur https://api.apertus.top/v1. Cela garantit la compatibilité avec les applications Node.js existantes. L'ID de modèle uncensored est requis pour toutes les requêtes. Vous pouvez contrôler la longueur de la sortie à l'aide de max_tokens. Le max de sortie par défaut est de 2 048 tokens si non spécifié, avec un plafond strict de 32 000 tokens par requête.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Réponses en streaming
Activez le streaming en définissant stream: true dans votre requête. L'API retourne un flux Server-Sent Events (SSE). Chaque chunk contient du texte partiel. Le dernier chunk inclut les statistiques complètes d'utilisation des tokens pour la requête. Cela vous permet d'afficher les résultats en temps réel tout en suivant les coûts. Le streaming fonctionne avec tous les paramètres, y compris l'appel de fonctions. Assurez-vous que votre client gère correctement les événements SSE. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens pour le prompt et la complétion combinés.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, erreurs & contexte
L'API impose une limite de 300 requêtes par minute et par clé et autorise 8 requêtes simultanées. La taille maximale du corps de la requête est de 8 Mo. Si la clé d'authentification est invalide, vous recevez une erreur 401. Si votre crédit prépayé est épuisé, vous recevez une erreur 402 indiquant des fonds insuffisants. La limite de débit est appliquée en fonction du quota par minute. La fenêtre de contexte est de 100 000 tokens au total. La sortie maximale par requête est de 32 000 tokens. Les requêtes dépassant cette limite sont gérées par le comportement standard du modèle. Aucun pourcentage de SLA n'est garanti. La confidentialité est préservée ; les prompts ne sont pas utilisés pour l'entraînement.
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.apertus.top/v1 |
| ID du modèle | uncensored |
| Authentification | Authorization: Bearer YOUR_KEY |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Sortie max. | jusqu'au reste de la fenêtre de 64 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Mode JSON | response_format: {"type": "json_object"} |
| Fenêtre de contexte | 64 000 tokens (entrée + sortie) |
| Limite de débit | 300 requêtes par minute et par clé |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Taille | jusqu'à 8 Mo par requête |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Connexion | Google ou e-mail et mot de passe |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Ma clé API expire-t-elle ?
Non, votre clé API n'expire pas. Il n'y a ni abonnement mensuel ni frais récurrents liés à votre compte. Vous pouvez utiliser votre clé indéfiniment jusqu'à ce que vous choisissiez de la révoquer.
Que se passe-t-il si je dépasse la limite de débit ?
L'API limite à 300 requêtes par minute et par clé. Si vous dépassez ce seuil, les requêtes suivantes peuvent être retardées ou rejetées. Vous pouvez également effectuer 8 requêtes simultanées à la fois. Surveillez votre utilisation pour rester dans ces limites.
La sortie est-elle tronquée si elle dépasse 32 000 tokens ?
Le modèle prend en charge une sortie maximale de 32 000 tokens par requête. Si le texte généré dépasse cette limite, la réponse est tronquée par le modèle. Vous pouvez ajuster le <code>max_tokens</code> paramètre pour contrôler la longueur de la sortie dans cette limite.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.