IT ▾
apertus.topAPI LLM senza censura, pagamento per token

Prima richiesta in cinque minuti

Inizia con l'API LLM senza censura Apertus in pochi minuti. Questa guida rapida copre l'autenticazione, le richieste di base e lo streaming utilizzando l'interfaccia compatibile con OpenAI.

URL base e autenticazione

Accedi all'API utilizzando l'URL base dedicato https://api.apertus.top/v1. Il servizio è compatibile con OpenAI, quindi puoi usare SDK standard aggiornando il base_url e fornendo la tua chiave API. Iscriviti alla pagina Ottieni chiave API con Google o un indirizzo email. La tua chiave viene visualizzata immediatamente alla creazione. Ogni account ha una sola chiave attiva; generarne una nuova sostituisce quella precedente. Non ci sono abbonamenti mensili o date di scadenza delle chiavi. Il credito prepagato non scade mai e i fondi non utilizzati rimangono disponibili per le richieste future. Errori e rifiuti non consumano il tuo credito.

Prima richiesta

Invia una semplice richiesta di completamento di testo per testare connettività e fatturazione. Usa l'ID del modello uncensored per accedere all'unico modello a pesi aperti ospitato sui nostri server. Questo modello è ottimizzato per rispondere senza rifiuti di contenuto per uso adulto legale. L'URL base è https://api.apertus.top/v1. I prezzi sono trasparenti: $0,25 per 1M di token di input e $1,00 per 1M di token di output. Paghi solo ciò che usi.

curl https://api.apertus.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

La risposta restituisce il testo generato. Se il tuo credito è insufficiente, riceverai un errore di fatturazione. Gli errori durante l'elaborazione non addebitano il tuo account. Puoi ricaricare utilizzando USDT (TRC20) o USDC (Base) tramite il cruscotto.

Integrazione SDK Python

Usa l'SDK Python ufficiale di OpenAI o qualsiasi client compatibile. Imposta il base_url su https://api.apertus.top/v1 e fornisci la tua chiave API. Questo ti permette di sfruttare codebase esistenti progettate per OpenAI. L'endpoint /v1/chat/completions gestisce tutta la generazione di testo. L'ID del modello è uncensored. Sono supportati parametri come temperature, top_p e stop. Le risposte in streaming includono i dettagli sull'utilizzo dei token nell'ultimo chunk. Sono disponibili anche la chiamata di funzioni e la modalità JSON per output strutturati.

from openai import OpenAI

client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integrazione SDK Node.js

Inizializza il client con l'URL base Apertus. La classe OpenAI accetta i parametri di configurazione standard. Passa la tua chiave API e imposta l'URL base su https://api.apertus.top/v1. Questo garantisce la compatibilità con le applicazioni Node.js esistenti. L'ID del modello uncensored è richiesto per tutte le richieste. Puoi controllare la lunghezza dell'output usando max_tokens. Il max output di default è 2.048 token se non specificato, con un hard cap di 32.000 token per richiesta.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Risposte in streaming

Abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce uno stream Server-Sent Events (SSE). Ogni chunk contiene testo parziale. L'ultimo chunk include le statistiche complete sull'utilizzo dei token per la richiesta. Questo ti permette di visualizzare i risultati in tempo reale mentre monitori i costi. Lo streaming funziona con tutti i parametri, inclusa la chiamata di funzioni. Assicurati che il tuo client gestisca correttamente gli eventi SSE. La finestra di contesto supporta fino a 100.000 token per prompt e completamento combinati.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limiti, errori e contesto

L'API impone un limite di 300 richieste al minuto per chiave e consente 8 richieste concorrenti. La dimensione massima del corpo della richiesta è 8 MB. Se la chiave di autenticazione non è valida, ricevi un errore 401. Se il tuo credito prepagato è esaurito, ricevi un errore 402 che indica fondi insufficienti. Il rate limiting viene applicato in base al quota per minuto. La finestra di contesto è di 100.000 token in totale. Il massimo output per richiesta è 32.000 token. Le richieste che superano questo limite vengono gestite dal comportamento standard del modello. Non ci sono percentuali SLA garantite. La privacy è mantenuta; i prompt non sono usati per l'addestramento.

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.apertus.top/v1
ID modellouncensored
AutenticazioneAuthorization: Bearer YOUR_KEY
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Output massimofino al resto della finestra di 64.000 token; max_tokens opzionale (nessun limite separato)
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Modalità JSONresponse_format: {"type": "json_object"}
Finestra di contesto64.000 token (input + output)
Limite di frequenza300 richieste al minuto per chiave
Concorrenza8 richieste contemporanee per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Dimensionefino a 8 MB per richiesta
Bonus+5% da $50, +10% da $100
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Scadenzail credito pagato non scade, nessun abbonamento
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
AccessoGoogle oppure e-mail e password
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

La mia chiave API scade?

No, la tua chiave API non scade. Non ci sono abbonamenti mensili o costi ricorrenti associati al tuo account. Puoi usare la tua chiave indefinitamente finché non decidi di revocarla.

Cosa succede se supero il limite di richieste?

L'API limita a 300 richieste al minuto per chiave. Se superi questo limite, le richieste successive potrebbero essere ritardate o rifiutate. Puoi anche effettuare 8 richieste concorrenti alla volta. Monitora il tuo utilizzo per restare entro questi limiti.

L'output viene troncato se supera 32.000 token?

Il modello supporta un output massimo di 32.000 token per richiesta. Se il testo generato supera questo limite, la risposta viene troncata dal modello. Puoi regolare il parametro <code>max_tokens</code> per controllare la lunghezza dell'output entro questo limite.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.

Ottieni chiave APILeggi la documentazione