5分で最初のリクエスト
数分でApertus無検閲LLM APIの使い始めが可能です。このクイックスタートガイドでは、認証、基本リクエスト、OpenAI互換インターフェースを使用したストリーミングをカバーします。
ベースURLと認証
専用ベースURL https://api.apertus.top/v1 を使用してAPIにアクセスします。このサービスはOpenAI互換であり、base_urlを更新し、APIキーを提供することで標準SDKを使用できます。APIキーを取得ページでGoogleまたはメールアドレスを使用してサインアップしてください。キーは作成直後に表示されます。各アカウントにはアクティブなキーが1つあり、新しいキーを生成すると以前のキーが置き換えられます。月額サブスクリプションやキーの有効期限はありません。前払いクレジットの有効期限はなく、未使用の残高は将来のリクエストに使用できます。エラーや拒否はクレジットを消費しません。
最初のリクエスト
接続と課金のテストのために単純なテキスト補完リクエストを送信します。サーバー上でホストされている単一のオープンウェイトモデルにアクセスするには、モデルID uncensored を使用します。このモデルは、法的な成人用途に対してコンテンツ拒否なしで回答するようにチューニングされています。ベースURLは https://api.apertus.top/v1 です。料金は明確で、入力トークン100万トークンあたり$0.25、出力トークン100万トークンあたり$1.00です。使用した分だけ支払います。
curl https://api.apertus.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
応答には生成されたテキストが返されます。クレジットが不足している場合、課金エラーが発生します。処理中のエラーはアカウントに課金されません。ダッシュボードからUSDT (TRC20) または USDC (Base) を使用してチャージできます。
Python SDK統合
公式のOpenAI Python SDK、または互換クライアントを使用してください。base_urlをhttps://api.apertus.top/v1に設定し、APIキーを入力してください。これにより、OpenAI向けに設計された既存のコードベースを活用できます。エンドポイント/v1/chat/completionsはすべてのテキスト生成を処理します。モデルIDはuncensoredです。temperature、top_p、stopなどのパラメータがサポートされています。ストリーミングレスポンスでは、最終チャンクにトークン使用量の詳細が含まれます。構造化された出力に対して関数呼び出しとJSONモードも利用可能です。
from openai import OpenAI
client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK統合
ApertusベースURLを使用してクライアントを初期化します。OpenAI クラスは標準の構成パラメータを受け入れます。APIキーを渡してベースURLを https://api.apertus.top/v1 に設定します。これにより、既存のNode.jsアプリケーションとの互換性が確保されます。すべてのリクエストには uncensored モデルIDが必要です。max_tokens を使用して出力長を制御できます。指定しない場合のデフォルトの最大出力は2,048トークンで、1リクエストあたりのハードキャップは32,000トークンです。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
ストリーミング応答
リクエストに stream: true を設定してストリーミングを有効にします。APIはServer-Sent Events (SSE) ストリームを返します。各チャンクには部分的なテキストが含まれます。最終チャンクにはリクエストの完全なトークン使用統計が含まれます。これにより、コストを追跡しながらリアルタイムで結果を表示できます。ストリーミングは関数呼び出しを含むすべてのパラメータで機能します。クライアントがSSEイベントを正しく処理することを確認してください。コンテキストウィンドウは、プロンプトと補完を合わせて最大100,000トークンをサポートします。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
制限、エラー、コンテキスト
APIはキーごとに1分あたり300リクエストの制限を適用し、8つの同時リクエストを許可します。最大リクエストボディサイズは8 MBです。認証キーが無効な場合、401エラーが発生します。前払いクレジットが枯渇した場合、資金不足を示す402エラーが発生します。レート制限は1分あたりのクォータに基づいて適用されます。コンテキストウィンドウは合計100,000トークンです。1リクエストあたりの最大出力は32,000トークンです。この制限を超えるリクエストは、モデルの標準的な動作によって処理されます。SLAのパーセンテージは保証されません。プライバシーは維持され、プロンプトはトレーニングに使用されません。
API 仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.apertus.top/v1 |
| モデル ID | uncensored |
| 認証 | Authorization: Bearer YOUR_KEY |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| 最大出力 | 64,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| JSON モード | response_format: {"type": "json_object"} |
| コンテキスト長 | 64,000 トークン(入力+出力) |
| レート制限 | キーごとに毎分 300 リクエスト |
| 同時実行 | キーごとに同時 8 リクエストまで |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| リクエストサイズ | 最大 8 MB |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| ログイン | Google またはメール+パスワード |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
APIキーの有効期限はありますか?
いいえ、APIキーの有効期限はありません。アカウントには月額サブスクリプションや継続的な料金もありません。無効にするまでキーを無期限に使用できます。
レート制限に達するとどうなりますか?
APIはキーごとに1分あたり300リクエストに制限します。これを超えると、以降のリクエストは遅延または拒否される場合があります。同時に8つのリクエストも実行できます。これらの制限内に収まるよう使用状況を監視してください。
32,000トークンを超えると出力は切り捨てられますか?
モデルは1リクエストあたり最大32,000トークンの出力をサポートします。生成テキストがこの制限を超えると、モデルによって応答が切り捨てられます。この制限内で出力長を制御するために<code>max_tokens</code>パラメータを調整できます。
キーはフォーム 1 つで手に入ります
アカウントを作成し、キーをコピーし、ベースURLを変更します。セットアップはこれだけです。