पहला अनुरोध पाँच मिनट में
कम समय में Apertus बिना सेंसर LLM API के साथ शुरुआत करें। यह क्विकस्टार्ट गाइड ऑथेंटिकेशन, बेसिक अनुरोधों और OpenAI-कम्पैटिबल इंटरफ़ेस का उपयोग करके स्ट्रीमिंग कवर करती है।
बेस URL और ऑथ
समर्पित बेस URL https://api.apertus.top/v1 का उपयोग करके API तक पहुँचें। सेवा OpenAI-संगत है, जिसका अर्थ है कि आप base_url को अपडेट करके मानक SDK का उपयोग कर सकते हैं और अपनी API कुंजी प्रदान कर सकते हैं। Google या ईमेल पता का उपयोग करके API कुंजी प्राप्त करें पृष्ठ पर साइन इन करें। आपकी कुंजी निर्माण के तुरंत बाद प्रदर्शित होती है। प्रत्येक खाते में एक सक्रिय कुंजी होती है; एक नई कुंजी बनाने से पिछली कुंजी बदल जाती है। मासिक सदस्यता या कुंजी की समाप्ति तिथियाँ नहीं हैं। प्रीपेड क्रेडिट कभी समाप्त नहीं होता है, और अप्रयुक्त राशि भविष्य के अनुरोधों के लिए उपलब्ध रहती है। त्रुटियाँ और अस्वीकृतियाँ आपका क्रेडिट नहीं खर्च करती हैं।
पहला अनुरोध
कनेक्टिविटी और बिलिंग का परीक्षण करने के लिए एक सरल टेक्स्ट पूर्णता अनुरोध भेजें। हमारे सर्वर पर होस्ट किए गए एकमात्र ओपन-वेट मॉडल तक पहुँचने के लिए मॉडल ID uncensored का उपयोग करें। यह मॉडल कानूनी वयस्क उपयोग के लिए बिना सामग्री अस्वीकृति के उत्तर देने के लिए ट्यून्ड है। बेस URL https://api.apertus.top/v1 है। मूल्य पारदर्शी हैं: 1M इनपुट टोकन के लिए $0.25 और 1M आउटपुट टोकन के लिए $1.00। आप केवल उसी के लिए भुगतान करते हैं जिसका आप उपयोग करते हैं।
curl https://api.apertus.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
प्रतिक्रिया उत्पन्न टेक्स्ट लौटाती है। यदि आपका क्रेडिट अपर्याप्त है, तो आपको बिलिंग त्रुटि प्राप्त होगी। प्रसंस्करण के दौरान त्रुटियों के लिए आपके खाते पर चार्ज नहीं किया जाता है। आप डैशबोर्ड के माध्यम से USDT (TRC20) या USDC (Base) का उपयोग करके टॉप-अप कर सकते हैं।
Python SDK इंटीग्रेशन
आधिकारिक OpenAI Python SDK या किसी संगत क्लाइंट का उपयोग करें। base_url को https://api.apertus.top/v1 पर सेट करें और अपनी API कुंजी प्रदान करें। यह आपको OpenAI के लिए डिज़ाइन किए गए मौजूदा कोडबेस का लाभ उठाने की अनुमति देता है। /v1/chat/completions एंडपॉइंट सभी टेक्स्ट जनरेशन को संभालता है। मॉडल ID uncensored है। temperature, top_p, और stop जैसे पैरामीटर समर्थित हैं। स्ट्रीमिंग प्रतिक्रियाओं में अंतिम चंक में टोकन उपयोग विवरण शामिल होता है। संरचित आउटपुट के लिए फ़ंक्शन कॉलिंग और JSON मोड भी उपलब्ध हैं।
from openai import OpenAI
client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK इंटीग्रेशन
क्लाइंट को Apertus आधार URL के साथ इनिशियलाइज़ करें। OpenAI क्लास मानक कॉन्फ़िगरेशन पैरामीटर स्वीकार करता है। अपनी API कुंजी पास करें और आधार URL को https://api.apertus.top/v1 पर सेट करें। यह मौजूदा Node.js एप्लिकेशन के साथ संगतता सुनिश्चित करता है। सभी अनुरोधों के लिए uncensored मॉडल ID आवश्यक है। आप max_tokens का उपयोग करके आउटपुट लंबाई को नियंत्रित कर सकते हैं। यदि निर्दिष्ट नहीं किया गया है तो डिफ़ॉल्ट अधिकतम आउटपुट 2,048 टोकन होता है, प्रत्येक अनुरोध के लिए 32,000 टोकन की कठोर सीमा के साथ।
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
स्ट्रीमिंग रिस्पॉन्स
अपने अनुरोध में stream: true सेट करके स्ट्रीमिंग सक्षम करें। API एक सर्वर-सेंट इवेंट्स (SSE) स्ट्रीम लौटाता है। प्रत्येक चंक आंशिक टेक्स्ट शामिल करता है। अंतिम चंक अनुरोध के लिए पूर्ण टोकन उपयोग आँकड़े शामिल करता है। यह आपको लागत की निगरानी करते हुए परिणामों को रियल-टाइम में प्रदर्शित करने की अनुमति देता है। स्ट्रीमिंग फ़ंक्शन कॉलिंग सहित सभी पैरामीटर के साथ काम करता है। सुनिश्चित करें कि आपका क्लाइंट SSE इवेंट्स को सही ढंग से संभालता है। कॉन्टेक्स्ट विंडो प्रॉम्प्ट और पूर्णता को मिलाकर 100,000 टोकन तक समर्थित करती है।
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
लिमिट्स, एरर्स और कॉन्टेक्स्ट
API प्रति कुंजी प्रति मिनट 300 अनुरोधों की सीमा लागू करता है और 8 समानांतर अनुरोधों की अनुमति देता है। अधिकतम अनुरोध बॉडी आकार 8 MB है। यदि प्रमाणीकरण कुंजी अमान्य है, तो आपको 401 त्रुटि प्राप्त होती है। यदि आपका प्रीपेड क्रेडिट समाप्त हो जाता है, तो आपको अपर्याप्त फंड्स संकेत देने वाली 402 त्रुटि प्राप्त होती है। प्रति-मिनट क्वोटा के आधार पर रेट लिमिट लागू किया जाता है। कॉन्टेक्स्ट विंडो कुल 100,000 टोकन है। प्रति अनुरोध अधिकतम आउटपुट 32,000 टोकन है। इस सीमा से अधिक अनुरोध मॉडल के मानक व्यवहार द्वारा संभाले जाते हैं। SLA प्रतिशत की गारंटी नहीं दी जाती है। गोपनीयता बनाए रखी जाती है; प्रॉम्प्ट को प्रशिक्षण के लिए उपयोग नहीं किया जाता है।
API विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.apertus.top/v1 |
| मॉडल ID | uncensored |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| अधिकतम आउटपुट | 64,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON मोड | response_format: {"type": "json_object"} |
| कॉन्टेक्स्ट विंडो | 64,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| अनुरोध का आकार | 8 MB तक |
| बोनस | $50 से +5%, $100 से +10% |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| साइन इन | Google या ईमेल और पासवर्ड |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
क्या मेरी API कुंजी समाप्त होती है?
नहीं, आपकी API कुंजी समाप्त नहीं होती है। आपके खाते से कोई मासिक सदस्यता या आवर्ती शुल्क जुड़ा नहीं है। आप अपनी कुंजी का उपयोग तब तक अनिश्चित काल तक कर सकते हैं जब तक कि आप उसे रद्द करने का चयन न करें।
यदि मैं रेट लिमिट पर पहुंच जाता हूं तो क्या होता है?
API आपको प्रति कुंजी प्रति मिनट 300 अनुरोधों तक सीमित करती है। यदि आप इससे अधिक करते हैं, तो बाद के अनुरोधों में विलंब हो सकता है या वे अस्वीकृत हो सकते हैं। आप एक साथ 8 समानांतर अनुरोध भी कर सकते हैं। इन सीमाओं के भीतर रहने के लिए अपने उपयोग की निगरानी करें।
क्या आउटपुट 32,000 टोकन से अधिक होने पर ट्रंकेट हो जाता है?
मॉडल प्रति अनुरोध 32,000 टोकन का अधिकतम आउटपुट समर्थित करता है। यदि उत्पन्न टेक्स्ट इससे अधिक होता है, तो प्रतिक्रिया मॉडल द्वारा ट्रंक कर दी जाती है। आप इस सीमा के भीतर आउटपुट लंबाई को नियंत्रित करने के लिए <code>max_tokens</code> पैरामीटर को एडजस्ट कर सकते हैं।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएँ, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।