Permintaan pertama dalam lima menit
Mulai dengan API LLM tanpa sensor Apertus dalam hitungan menit. Panduan cepat ini mencakup autentikasi, permintaan dasar, dan streaming menggunakan antarmuka yang kompatibel dengan OpenAI.
URL Dasar & Autentikasi
Akses API menggunakan URL dasar khusus https://api.apertus.top/v1. Layanan ini kompatibel dengan OpenAI, artinya Anda dapat menggunakan SDK standar dengan memperbarui base_url dan menyediakan kunci API Anda. Daftar di halaman Dapatkan kunci API menggunakan Google atau alamat email. Kunci Anda ditampilkan segera setelah dibuat. Setiap akun memegang satu kunci aktif; menghasilkan kunci baru akan menggantikan kunci sebelumnya. Tidak ada langganan bulanan atau tanggal kedaluwarsa kunci. Saldo prabayar tidak pernah kedaluwarsa, dan dana yang belum digunakan tetap tersedia untuk permintaan di masa depan. Kesalahan dan penolakan tidak mengonsumsi saldo Anda.
Permintaan Pertama
Kirim permintaan penyelesaian teks sederhana untuk menguji konektivitas dan penagihan. Gunakan ID model uncensored untuk mengakses satu model bobot terbuka yang dihosting di server kami. Model ini disesuaikan untuk menjawab tanpa penolakan konten untuk penggunaan dewasa yang sah. URL dasar adalah https://api.apertus.top/v1. Harganya transparan: $0,25 per 1M token input dan $1,00 per 1M token output. Anda hanya membayar apa yang Anda gunakan.
curl https://api.apertus.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Respons mengembalikan teks yang dihasilkan. Jika saldo Anda tidak mencukupi, Anda akan menerima kesalahan penagihan. Kesalahan selama pemrosesan tidak membebani akun Anda. Anda dapat mengisi saldo menggunakan USDT (TRC20) atau USDC (Base) melalui dasbor.
Integrasi SDK Python
Gunakan SDK Python OpenAI resmi atau klien yang kompatibel. Atur base_url ke https://api.apertus.top/v1 dan berikan kunci API Anda. Ini memungkinkan Anda memanfaatkan basis kode yang ada yang dirancang untuk OpenAI. Endpoint /v1/chat/completions menangani semua generasi teks. ID model adalah uncensored. Parameter seperti temperature, top_p, dan stop didukung. Respons streaming mencakup detail penggunaan token dalam potongan terakhir. Pemanggilan fungsi dan mode JSON juga tersedia untuk output terstruktur.
from openai import OpenAI
client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integrasi SDK Node
Inisialisasi klien dengan URL dasar Apertus. Kelas OpenAI menerima parameter konfigurasi standar. Berikan kunci API Anda dan atur URL dasar ke https://api.apertus.top/v1. Ini memastikan kompatibilitas dengan aplikasi Node.js yang ada. ID model uncensored diperlukan untuk semua permintaan. Anda dapat mengontrol panjang output menggunakan max_tokens. Output maksimum default adalah 2.048 token jika tidak ditentukan, dengan batas keras 32.000 token per permintaan.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respons Streaming
Aktifkan streaming dengan mengatur stream: true dalam permintaan Anda. API mengembalikan aliran Server-Sent Events (SSE). Setiap potongan berisi teks parsial. Potongan terakhir mencakup statistik penggunaan token lengkap untuk permintaan tersebut. Ini memungkinkan Anda menampilkan hasil secara real-time sambil melacak biaya. Streaming berfungsi dengan semua parameter, termasuk pemanggilan fungsi. Pastikan klien Anda menangani peristiwa SSE dengan benar. Jendela konteks mendukung hingga 100.000 token untuk prompt dan penyelesaian gabungan.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Batas, Kesalahan & Konteks
API memberlakukan batas 300 permintaan per menit per kunci dan memungkinkan 8 permintaan paralel. Ukuran badan permintaan maksimum adalah 8 MB. Jika kunci autentikasi tidak valid, Anda menerima kesalahan 401. Jika saldo prabayar Anda habis, Anda menerima kesalahan 402 yang menunjukkan dana tidak mencukupi. Pembatasan laju diterapkan berdasarkan kuota per menit. Jendela konteks adalah 100.000 token total. Output maksimum per permintaan adalah 32.000 token. Permintaan yang melebihi batas ini ditangani oleh perilaku standar model. Tidak ada persentase SLA yang dijamin. Privasi terjaga; prompt tidak digunakan untuk pelatihan.
Spesifikasi API
Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.
| Item | Nilai |
|---|---|
| Format | kompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.apertus.top/v1 |
| ID model | uncensored |
| Autentikasi | Authorization: Bearer YOUR_KEY |
| Function calling | ya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool |
| Streaming | ya — server-sent events; potongan terakhir berisi penggunaan token |
| Output maksimal | hingga sisa jendela 64.000 token; max_tokens opsional (tanpa batas terpisah) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Mode JSON | response_format: {"type": "json_object"} |
| Jendela konteks | 64.000 token (input + output) |
| Batas laju | 300 permintaan per menit per kunci |
| Konkurensi | 8 permintaan bersamaan per kunci |
| Header respons | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ukuran permintaan | hingga 8 MB |
| Bonus | +5% mulai $50, +10% mulai $100 |
| Uji coba gratis | $0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama |
| Penagihan | saldo prabayar sesuai pemakaian nyata; error dan penolakan gratis |
| Isi saldo | USDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500 |
| Masa berlaku | saldo berbayar tidak kedaluwarsa, tanpa langganan |
| Harga | $0,25 per 1 juta token input · $1,00 per 1 juta token output |
| Masuk | Google atau email dan kata sandi |
| Konten | konten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak |
| Kunci | satu kunci aktif per akun; kunci baru menggantikan yang lama |
Kode error
Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.
| Kode | Tipe | Arti |
|---|---|---|
400 | bad_request | JSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang |
401 | missing_key · invalid_key · key_revoked | kunci tidak ada, salah, atau sudah diganti |
402 | no_credit | saldo habis — isi ulang dan lanjut seketika |
403 | content_blocked | konten seksual dengan anak di bawah umur — ditolak, tidak ditagih |
404 | not_found | endpoint tidak dikenal |
413 | request_too_large | body lebih dari 8 MB |
429 | rate_limited · concurrency | lebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi |
503 | upstream_busy | model sibuk — coba lagi beberapa detik lagi |
Tanya jawab
Apakah kunci API saya kedaluwarsa?
Tidak, kunci API Anda tidak kedaluwarsa. Tidak ada langganan bulanan atau biaya berulang yang terkait dengan akun Anda. Anda dapat menggunakan kunci Anda secara tak terbatas hingga Anda memilih untuk mencabutnya.
Apa yang terjadi jika saya mencapai batas laju?
API membatasi Anda hingga 300 permintaan per menit per kunci. Jika Anda melebihi ini, permintaan selanjutnya mungkin tertunda atau ditolak. Anda juga dapat melakukan 8 permintaan paralel secara bersamaan. Pantau penggunaan Anda untuk tetap berada dalam batas ini.
Apakah output dipotong jika melebihi 32.000 token?
Model mendukung output maksimum 32.000 token per permintaan. Jika teks yang dihasilkan melebihi ini, respons akan dipotong oleh model. Anda dapat menyesuaikan parameter <code>max_tokens</code> untuk mengontrol panjang output dalam batas ini.
Kunci Anda hanya selangkah lagi dari satu formulir
Buat akun, salin kuncinya, ubah URL dasar. Itu saja seluruh pengaturannya.