क्विकस्टार्ट: हमारी सस्ती AI API इंटीग्रेट करें
मानक OpenAI-संगत फॉर्मेट का उपयोग करके कुछ ही मिनटों में हमारे बिना सेंसर LLM API के साथ टेक्स्ट जनरेट करना शुरू करें। इस गाइड में प्रमाणीकरण, बुनियादी अनुरोध, स्ट्रीमिंग और शून्य वेंडर लॉक-इन के साथ फ़ंक्शन कॉलिंग शामिल है।
ऑथेंटिकेशन और बेस URL
हमारे cheap ai api का उपयोग करने के लिए, आपको अपने डैशबोर्ड से एक API कुंजी की आवश्यकता है। सभी अनुरोध बेस URL https://api.cheapaiapis.com/v1 पर टारगेट करते हैं। यह मौजूदा OpenAI SDKs और क्लाइंट्स के साथ संगतता सुनिश्चित करता है।
अपनी कुंजी को Authorization हेडर में Bearer टोकन के रूप में शामिल करें। यदि कुंजी अमान्य है, तो आपको 401 त्रुटि मिलेगी। यदि आपका प्रीपेड क्रेडिट समाप्त हो जाता है, तो आपको 402 त्रुटि मिलती है। तुरंत टोकन प्राप्त करने के लिए Get API key पर रजिस्टर करें।
हमारे बिना सेंसर LLM के लिए मॉडल पहचानकर्ता केवल "uncensored" है। यह एकल मॉडल सभी टेक्स्ट जनरेशन कार्यों को रूटिंग ओवरहेड के बिना संभालता है।
curl https://api.cheapaiapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
स्टैंडर्ड चैट कंप्लीशन्स
chat completions api एंडपॉइंट POST अनुरोधों को messages एरे स्वीकार करता है। प्रत्येक संदेश में एक भूमिका (system, user, या assistant) और सामग्री की आवश्यकता होती है। यह संरचना बहु-चरनीय वार्तालापों या सिंगल-शॉट प्रॉम्प्ट्स की अनुमति देती है।
हमारी संरचना टेक्स्ट इनपुट को प्रोसेस करती है और टेक्स्ट आउटपुट कुशलतापूर्वक लौटाती है। मॉडल लचीलेपन के लिए ट्यून्ड है, कानूनी वयस्कों के सामग्री के लिए अनावश्यक अस्वीकृतियों के बिना विविध विषयों को संभालता है। अनुरोध बॉडी 8 MB तक सीमित हैं।
त्वरित इंटीग्रेशन के लिए Python SDK का उपयोग करें। क्लाइंट स्वचालित रूप से सिरियलाइजेशन और HTTP अनुरोध संभालता है।
from openai import OpenAI
client = OpenAI(base_url="https://api.cheapaiapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
स्ट्रीमिंग रिस्पॉन्स (SSE)
ऐसे अनुप्रयोगों के लिए जो रियल-टाइम फीडबैक की आवश्यकता है, stream: true सेट करके स्ट्रीमिंग सक्षम करें। API आंशिक टोकन चंक वाले सर्वर-सेंट इवेंट्स (SSE) लौटाता है।
यह दृष्टिकोण अंत-उपयोगकर्ताओं के लिए अनुभूत विलंबता को कम करता है। आप प्रत्येक चंक को आने पर प्रोसेस करते हैं, अंतिम प्रतिक्रिया को इकट्ठा करते हैं। स्ट्रीमिंग सभी मानक OpenAI-संगत क्लाइंट्स के साथ काम करता है जो SSE के लिए कॉन्फ़िगर किए गए हैं।
प्रति कुंजी प्रति मिनट 300 अनुरोध की सीमा का ध्यान रखें। स्ट्रीमिंग रेट लिमिट को बायपास नहीं करता; यह केवल डेटा की डिलीवरी के तरीके को बदलता है।
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
फ़ंक्शन कॉलिंग सपोर्ट
हमारी फ़ंक्शन कॉलिंग API कार्यान्वयन आपको अनुरोध में टूल्स परिभाषित करने की अनुमति देता है। मॉडल आपके स्कीमा से मेल खाने वाला संरचित JSON लौटाता है, जिससे प्रोग्रामेटिक एक्शन संभव होते हैं।
नाम, विवरण और पैरामीटर स्कीमा के साथ फ़ंक्शन परिभाषित करें। API टूल कॉल के साथ प्रतिक्रिया देता है जिन्हें आप निष्पादित करते हैं, फिर अंतिम उत्तर के लिए परिणामों को वापस मॉडल को पास करते हैं। यह तर्क को जनरेशन से अलग रखता है।
सुनिश्चित करें कि आपके फ़ंक्शन परिभाषाएँ मान्य JSON हैं। स्कीमा संरचना में त्रुटियाँ मॉडल को खराब टूल कॉल लौटने का कारण बन सकती हैं।
मॉडल सूची और टोकन
उपलब्ध मॉडल प्राप्त करने के लिए GET /v1/models का उपयोग करें। आप "uncensored" मॉडल को अपनी विशिष्ट क्षमताओं के साथ सूचीबद्ध देखेंगे।
मॉडल 100,000 टोकन कॉन्टेक्स्ट विंडो का समर्थन करता है, प्रॉम्प्ट और कंप्लीशन टोकन को जोड़ता है। इससे विस्तृत दस्तावेज़ प्रसंस्करण या लंबी बातचीत को तुरंत ट्रंकेशन के बिना संभाला जा सकता है।
मूल्य निर्धारण पारदर्शी है: 1M इनपुट टोकन प्रति $0.25 और 1M आउटपुट टोकन प्रति $1.00। क्रेडिट कभी समाप्त नहीं होते, इसलिए आप केवल उसी के लिए भुगतान करते हैं जिसका आप उपयोग करते हैं।
सीमाएँ, त्रुटियाँ और कॉन्टेक्स्ट
डैशबोर्ड के माध्यम से अपने उपयोग की निगरानी करें। API प्रति कुंजी प्रति मिनट 300 अनुरोध की सीमा लागू करता है। इससे अधिक होने पर 429 त्रुटि आती है। स्थिति रीसेट करने के लिए अपनी कुंजी को रीजेनरेट करें यदि आवश्यक हो।
सामान्य त्रुटियों में 401 (अमान्य कुंजी), 402 (अपर्याप्त फंड) और 429 (रेट लिमिट) शामिल हैं। अपने क्लाइंट कोड में हमेशा इन्हें संयम से हैंडल करें।
कॉन्टेक्स्ट विंडो सीमाएँ भेजे और प्राप्त किए गए कुल टोकनों पर लागू होती हैं। 100k सीमा को कुशलता से अधिकतम करने के लिए अपने प्रॉम्प्ट संरचना की योजना बनाएं।
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.cheapaiapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);प्रश्न और उत्तर
दस्तावेज़ पढ़ेंक्या यह API OpenAI SDKs के साथ संगत है?
हाँ, यह मानक OpenAI-संगत चैट कंप्लीशन्स फॉर्मेट का उपयोग करता है। आपको केवल मौजूदा क्लाइंट कॉन्फ़िगरेशन में बेस URL और API कुंजी अपडेट करने की आवश्यकता है।
यदि मेरा क्रेडिट खत्म हो जाता है तो क्या होता है?
अनुरोध 402 त्रुटि लौटाएंगे। आप क्रिप्टो (USDT या USDC) के साथ टॉप-अप कर सकते हैं जो $10 से शुरू होता है। क्रेडिट कभी समाप्त नहीं होते, इसलिए आप तब फंड जोड़ सकते हैं जब सुविधाजनक हो।
क्या मॉडल सामग्री को अस्वीकार करता है?
मॉडल कानूनी वयस्क, काल्पनिक और विवादास्पद विषयों के लिए बिना सेंसर है। यह केवल किशोरों से संबंधित यौन सामग्री को ब्लॉक करता है, जो एक कठोर सीमा है।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।
API विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.cheapaiapis.com/v1 |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| मॉडल ID | uncensored |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| JSON मोड | response_format: {"type": "json_object"} |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| अनुरोध का आकार | 8 MB तक |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| बोनस | $50 से +5%, $100 से +10% |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
| साइन इन | Google या ईमेल और पासवर्ड |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |