HI ▾
apertus.topबिना सेंसर LLM API, टोकन के अनुसार भुगतान

पहला अनुरोध पाँच मिनट में

कम समय में Apertus बिना सेंसर LLM API के साथ शुरुआत करें। यह क्विकस्टार्ट गाइड ऑथेंटिकेशन, बेसिक अनुरोधों और OpenAI-कम्पैटिबल इंटरफ़ेस का उपयोग करके स्ट्रीमिंग कवर करती है।

बेस URL और ऑथ

समर्पित बेस URL https://api.apertus.top/v1 का उपयोग करके API तक पहुँचें। सेवा OpenAI-संगत है, जिसका अर्थ है कि आप base_url को अपडेट करके मानक SDK का उपयोग कर सकते हैं और अपनी API कुंजी प्रदान कर सकते हैं। Google या ईमेल पता का उपयोग करके API कुंजी प्राप्त करें पृष्ठ पर साइन इन करें। आपकी कुंजी निर्माण के तुरंत बाद प्रदर्शित होती है। प्रत्येक खाते में एक सक्रिय कुंजी होती है; एक नई कुंजी बनाने से पिछली कुंजी बदल जाती है। मासिक सदस्यता या कुंजी की समाप्ति तिथियाँ नहीं हैं। प्रीपेड क्रेडिट कभी समाप्त नहीं होता है, और अप्रयुक्त राशि भविष्य के अनुरोधों के लिए उपलब्ध रहती है। त्रुटियाँ और अस्वीकृतियाँ आपका क्रेडिट नहीं खर्च करती हैं।

पहला अनुरोध

कनेक्टिविटी और बिलिंग का परीक्षण करने के लिए एक सरल टेक्स्ट पूर्णता अनुरोध भेजें। हमारे सर्वर पर होस्ट किए गए एकमात्र ओपन-वेट मॉडल तक पहुँचने के लिए मॉडल ID uncensored का उपयोग करें। यह मॉडल कानूनी वयस्क उपयोग के लिए बिना सामग्री अस्वीकृति के उत्तर देने के लिए ट्यून्ड है। बेस URL https://api.apertus.top/v1 है। मूल्य पारदर्शी हैं: 1M इनपुट टोकन के लिए $0.25 और 1M आउटपुट टोकन के लिए $1.00। आप केवल उसी के लिए भुगतान करते हैं जिसका आप उपयोग करते हैं।

curl https://api.apertus.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

प्रतिक्रिया उत्पन्न टेक्स्ट लौटाती है। यदि आपका क्रेडिट अपर्याप्त है, तो आपको बिलिंग त्रुटि प्राप्त होगी। प्रसंस्करण के दौरान त्रुटियों के लिए आपके खाते पर चार्ज नहीं किया जाता है। आप डैशबोर्ड के माध्यम से USDT (TRC20) या USDC (Base) का उपयोग करके टॉप-अप कर सकते हैं।

Python SDK इंटीग्रेशन

आधिकारिक OpenAI Python SDK या किसी संगत क्लाइंट का उपयोग करें। base_url को https://api.apertus.top/v1 पर सेट करें और अपनी API कुंजी प्रदान करें। यह आपको OpenAI के लिए डिज़ाइन किए गए मौजूदा कोडबेस का लाभ उठाने की अनुमति देता है। /v1/chat/completions एंडपॉइंट सभी टेक्स्ट जनरेशन को संभालता है। मॉडल ID uncensored है। temperature, top_p, और stop जैसे पैरामीटर समर्थित हैं। स्ट्रीमिंग प्रतिक्रियाओं में अंतिम चंक में टोकन उपयोग विवरण शामिल होता है। संरचित आउटपुट के लिए फ़ंक्शन कॉलिंग और JSON मोड भी उपलब्ध हैं।

from openai import OpenAI

client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK इंटीग्रेशन

क्लाइंट को Apertus आधार URL के साथ इनिशियलाइज़ करें। OpenAI क्लास मानक कॉन्फ़िगरेशन पैरामीटर स्वीकार करता है। अपनी API कुंजी पास करें और आधार URL को https://api.apertus.top/v1 पर सेट करें। यह मौजूदा Node.js एप्लिकेशन के साथ संगतता सुनिश्चित करता है। सभी अनुरोधों के लिए uncensored मॉडल ID आवश्यक है। आप max_tokens का उपयोग करके आउटपुट लंबाई को नियंत्रित कर सकते हैं। यदि निर्दिष्ट नहीं किया गया है तो डिफ़ॉल्ट अधिकतम आउटपुट 2,048 टोकन होता है, प्रत्येक अनुरोध के लिए 32,000 टोकन की कठोर सीमा के साथ।

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

स्ट्रीमिंग रिस्पॉन्स

अपने अनुरोध में stream: true सेट करके स्ट्रीमिंग सक्षम करें। API एक सर्वर-सेंट इवेंट्स (SSE) स्ट्रीम लौटाता है। प्रत्येक चंक आंशिक टेक्स्ट शामिल करता है। अंतिम चंक अनुरोध के लिए पूर्ण टोकन उपयोग आँकड़े शामिल करता है। यह आपको लागत की निगरानी करते हुए परिणामों को रियल-टाइम में प्रदर्शित करने की अनुमति देता है। स्ट्रीमिंग फ़ंक्शन कॉलिंग सहित सभी पैरामीटर के साथ काम करता है। सुनिश्चित करें कि आपका क्लाइंट SSE इवेंट्स को सही ढंग से संभालता है। कॉन्टेक्स्ट विंडो प्रॉम्प्ट और पूर्णता को मिलाकर 100,000 टोकन तक समर्थित करती है।

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

लिमिट्स, एरर्स और कॉन्टेक्स्ट

API प्रति कुंजी प्रति मिनट 300 अनुरोधों की सीमा लागू करता है और 8 समानांतर अनुरोधों की अनुमति देता है। अधिकतम अनुरोध बॉडी आकार 8 MB है। यदि प्रमाणीकरण कुंजी अमान्य है, तो आपको 401 त्रुटि प्राप्त होती है। यदि आपका प्रीपेड क्रेडिट समाप्त हो जाता है, तो आपको अपर्याप्त फंड्स संकेत देने वाली 402 त्रुटि प्राप्त होती है। प्रति-मिनट क्वोटा के आधार पर रेट लिमिट लागू किया जाता है। कॉन्टेक्स्ट विंडो कुल 100,000 टोकन है। प्रति अनुरोध अधिकतम आउटपुट 32,000 टोकन है। इस सीमा से अधिक अनुरोध मॉडल के मानक व्यवहार द्वारा संभाले जाते हैं। SLA प्रतिशत की गारंटी नहीं दी जाती है। गोपनीयता बनाए रखी जाती है; प्रॉम्प्ट को प्रशिक्षण के लिए उपयोग नहीं किया जाता है।

API विवरण

API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।

मदमान
API फ़ॉर्मेटOpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें
एंडपॉइंटPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.apertus.top/v1
मॉडल IDuncensored
प्रमाणीकरणAuthorization: Bearer YOUR_KEY
फ़ंक्शन कॉलिंगहाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें
स्ट्रीमिंगहाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग
अधिकतम आउटपुट64,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं)
पैरामीटरtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON मोडresponse_format: {"type": "json_object"}
कॉन्टेक्स्ट विंडो64,000 टोकन (इनपुट + आउटपुट मिलाकर)
रेट लिमिटप्रति कुंजी प्रति मिनट 300 अनुरोध
समानांतर अनुरोधप्रति कुंजी एक साथ 8 तक
रिस्पॉन्स हेडरX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
अनुरोध का आकार8 MB तक
बोनस$50 से +5%, $100 से +10%
मुफ़्त ट्रायल क्रेडिट$0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300)
बिलिंगप्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त
टॉप-अपUSDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि
वैधताभुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं
कीमतप्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00
साइन इनGoogle या ईमेल और पासवर्ड
सामग्रीवयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार
कुंजियाँहर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है

त्रुटि कोड

त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।

कोडप्रकारअर्थ
400bad_requestअमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक
401missing_key · invalid_key · key_revokedकुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई
402no_creditक्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू
403content_blockedनाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं
404not_foundअज्ञात एंडपॉइंट
413request_too_largeबॉडी 8 MB से बड़ी
429rate_limited · concurrency300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें
503upstream_busyमॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें

प्रश्न और उत्तर

क्या मेरी API कुंजी समाप्त होती है?

नहीं, आपकी API कुंजी समाप्त नहीं होती है। आपके खाते से कोई मासिक सदस्यता या आवर्ती शुल्क जुड़ा नहीं है। आप अपनी कुंजी का उपयोग तब तक अनिश्चित काल तक कर सकते हैं जब तक कि आप उसे रद्द करने का चयन न करें।

यदि मैं रेट लिमिट पर पहुंच जाता हूं तो क्या होता है?

API आपको प्रति कुंजी प्रति मिनट 300 अनुरोधों तक सीमित करती है। यदि आप इससे अधिक करते हैं, तो बाद के अनुरोधों में विलंब हो सकता है या वे अस्वीकृत हो सकते हैं। आप एक साथ 8 समानांतर अनुरोध भी कर सकते हैं। इन सीमाओं के भीतर रहने के लिए अपने उपयोग की निगरानी करें।

क्या आउटपुट 32,000 टोकन से अधिक होने पर ट्रंकेट हो जाता है?

मॉडल प्रति अनुरोध 32,000 टोकन का अधिकतम आउटपुट समर्थित करता है। यदि उत्पन्न टेक्स्ट इससे अधिक होता है, तो प्रतिक्रिया मॉडल द्वारा ट्रंक कर दी जाती है। आप इस सीमा के भीतर आउटपुट लंबाई को नियंत्रित करने के लिए <code>max_tokens</code> पैरामीटर को एडजस्ट कर सकते हैं।

आपकी कुंजी बस एक फ़ॉर्म दूर है

एक खाता बनाएँ, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।

Get API keyRead the docs