Prima richiesta in cinque minuti
Inizia con l'API LLM senza censura Apertus in pochi minuti. Questa guida rapida copre l'autenticazione, le richieste di base e lo streaming utilizzando l'interfaccia compatibile con OpenAI.
URL base e autenticazione
Accedi all'API utilizzando l'URL base dedicato https://api.apertus.top/v1. Il servizio è compatibile con OpenAI, quindi puoi usare SDK standard aggiornando il base_url e fornendo la tua chiave API. Iscriviti alla pagina Ottieni chiave API con Google o un indirizzo email. La tua chiave viene visualizzata immediatamente alla creazione. Ogni account ha una sola chiave attiva; generarne una nuova sostituisce quella precedente. Non ci sono abbonamenti mensili o date di scadenza delle chiavi. Il credito prepagato non scade mai e i fondi non utilizzati rimangono disponibili per le richieste future. Errori e rifiuti non consumano il tuo credito.
Prima richiesta
Invia una semplice richiesta di completamento di testo per testare connettività e fatturazione. Usa l'ID del modello uncensored per accedere all'unico modello a pesi aperti ospitato sui nostri server. Questo modello è ottimizzato per rispondere senza rifiuti di contenuto per uso adulto legale. L'URL base è https://api.apertus.top/v1. I prezzi sono trasparenti: $0,25 per 1M di token di input e $1,00 per 1M di token di output. Paghi solo ciò che usi.
curl https://api.apertus.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
La risposta restituisce il testo generato. Se il tuo credito è insufficiente, riceverai un errore di fatturazione. Gli errori durante l'elaborazione non addebitano il tuo account. Puoi ricaricare utilizzando USDT (TRC20) o USDC (Base) tramite il cruscotto.
Integrazione SDK Python
Usa l'SDK Python ufficiale di OpenAI o qualsiasi client compatibile. Imposta il base_url su https://api.apertus.top/v1 e fornisci la tua chiave API. Questo ti permette di sfruttare codebase esistenti progettate per OpenAI. L'endpoint /v1/chat/completions gestisce tutta la generazione di testo. L'ID del modello è uncensored. Sono supportati parametri come temperature, top_p e stop. Le risposte in streaming includono i dettagli sull'utilizzo dei token nell'ultimo chunk. Sono disponibili anche la chiamata di funzioni e la modalità JSON per output strutturati.
from openai import OpenAI
client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integrazione SDK Node.js
Inizializza il client con l'URL base Apertus. La classe OpenAI accetta i parametri di configurazione standard. Passa la tua chiave API e imposta l'URL base su https://api.apertus.top/v1. Questo garantisce la compatibilità con le applicazioni Node.js esistenti. L'ID del modello uncensored è richiesto per tutte le richieste. Puoi controllare la lunghezza dell'output usando max_tokens. Il max output di default è 2.048 token se non specificato, con un hard cap di 32.000 token per richiesta.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Risposte in streaming
Abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce uno stream Server-Sent Events (SSE). Ogni chunk contiene testo parziale. L'ultimo chunk include le statistiche complete sull'utilizzo dei token per la richiesta. Questo ti permette di visualizzare i risultati in tempo reale mentre monitori i costi. Lo streaming funziona con tutti i parametri, inclusa la chiamata di funzioni. Assicurati che il tuo client gestisca correttamente gli eventi SSE. La finestra di contesto supporta fino a 100.000 token per prompt e completamento combinati.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limiti, errori e contesto
L'API impone un limite di 300 richieste al minuto per chiave e consente 8 richieste concorrenti. La dimensione massima del corpo della richiesta è 8 MB. Se la chiave di autenticazione non è valida, ricevi un errore 401. Se il tuo credito prepagato è esaurito, ricevi un errore 402 che indica fondi insufficienti. Il rate limiting viene applicato in base al quota per minuto. La finestra di contesto è di 100.000 token in totale. Il massimo output per richiesta è 32.000 token. Le richieste che superano questo limite vengono gestite dal comportamento standard del modello. Non ci sono percentuali SLA garantite. La privacy è mantenuta; i prompt non sono usati per l'addestramento.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.apertus.top/v1 |
| ID modello | uncensored |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Output massimo | fino al resto della finestra di 64.000 token; max_tokens opzionale (nessun limite separato) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modalità JSON | response_format: {"type": "json_object"} |
| Finestra di contesto | 64.000 token (input + output) |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Concorrenza | 8 richieste contemporanee per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Dimensione | fino a 8 MB per richiesta |
| Bonus | +5% da $50, +10% da $100 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Accesso | Google oppure e-mail e password |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
La mia chiave API scade?
No, la tua chiave API non scade. Non ci sono abbonamenti mensili o costi ricorrenti associati al tuo account. Puoi usare la tua chiave indefinitamente finché non decidi di revocarla.
Cosa succede se supero il limite di richieste?
L'API limita a 300 richieste al minuto per chiave. Se superi questo limite, le richieste successive potrebbero essere ritardate o rifiutate. Puoi anche effettuare 8 richieste concorrenti alla volta. Monitora il tuo utilizzo per restare entro questi limiti.
L'output viene troncato se supera 32.000 token?
Il modello supporta un output massimo di 32.000 token per richiesta. Se il testo generato supera questo limite, la risposta viene troncata dal modello. Puoi regolare il parametro <code>max_tokens</code> per controllare la lunghezza dell'output entro questo limite.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.