बेस URL और प्रमाणीकरण
Get API key पृष्ठ पर खाता बनाने से शुरू करें। आपको केवल ईमेल और पासवर्ड की आवश्यकता है; ट्रायल क्रेडिट सक्रिय करने के लिए फ़ोन नंबर या क्रेडिट कार्ड की आवश्यकता नहीं है। पंजीकरण के बाद, आपकी API कुंजी तुरंत प्रदर्शित होती है। इस कुंजी को कॉपी करें और इसे सुरक्षित रूप से संग्रहीत करें। सभी अनुरोधों के लिए इसे Authorization हेडर में Bearer टोकन के रूप में उपयोग करें। सभी एंडपॉइंट्स के लिए बेस URL https://api.gemma4api.com/v1 है। यह URL किसी भी मानक OpenAI-संगत क्लाइंट के साथ काम करता है, जिससे आप केवल बेस URL और API कुंजी को अपनी कॉन्फ़िगरेशन में बदलकर प्रदाता बदल सकते हैं।
पहला अनुरोध
कनेक्टिविटी की जाँच करने के लिए curl का उपयोग करके अपना पहला प्रॉम्प्ट भेजें। YOUR_API_KEY को अपनी वास्तविक कुंजी से बदलें। मॉडल पहचानकर्ता uncensored है। यह सरल टेक्स्ट-इन, टेक्स्ट-आउट अनुरोध पुष्टि करता है कि आपकी प्रमाणीकरण सही है और मॉडल प्रतिक्रिया दे रहा है। यदि आपको choices सरणी के साथ एक JSON प्रतिक्रिया प्राप्त होती है, तो आपकी सेटअप पूरी हो गई है। अब आप अधिक जटिल वर्कफ़्लो के लिए SDK एकीकृत करने के लिए आगे बढ़ सकते हैं।
curl https://api.gemma4api.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK एकीकरण
आधिकारिक OpenAI Python पैकेज इंस्टॉल करें। बेस URL और API कुंजी एन्वायरमेंट वेरिएबल सेट करें या उन्हें सीधे क्लाइंट कंस्ट्रक्टर में पास करें। मॉडल ID uncensored का उपयोग करें ताकि सुनिश्चित हो सके कि आप हमारे विशिष्ट इंस्टेंस को कॉल कर रहे हैं। यह दृष्टिकोण सुनिश्चित करता है कि आपका कोड मानक OpenAI पैटर्न के साथ संगत रहे जबकि सामग्री जनरेशन के लिए हमारे बिना सेंसर मॉडल का लाभ उठाए। SDK रीट्राइज़ और JSON पार्सिंग को स्वचालित रूप से संभालता है।
from openai import OpenAI
client = OpenAI(base_url="https://api.gemma4api.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js SDK एकीकरण
JavaScript वातावरण के लिए, OpenAI Node.js पैकेज इंस्टॉल करें। क्लाइंट को बेस URL https://api.gemma4api.com/v1 और अपनी API कुंजी के साथ कॉन्फ़िगर करें। अपनी कम्प्लीशन कॉल्स में मॉडल ID uncensored का उपयोग करें। यह सेटअप आपको मानक OpenAI-संगत कोड संरचनाओं को बनाए रखने की अनुमति देता है जबकि हमारे सर्वरों पर होस्ट किए गए विशिष्ट मॉडल व्यवहार से लाभ उठाता है। सुनिश्चित करें कि आप अपने Node.js इवेंट लूप के भीतर एसेंक्रोनस प्रतिक्रियाओं को सही ढंग से संभालें।
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.gemma4api.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
स्ट्रीमिंग प्रतिक्रियाएँ
अपने API अनुरोध में stream पैरामीटर को true पर सेट करके स्ट्रीमिंग सक्षम करें। यह एक सर्वर-सेंट इवेंट्स (SSE) स्ट्रीम लौटाता है, जिससे आप टोकन को जनरेट होते हुए प्रदर्शित कर सकते हैं। यह चैट इंटरफ़ेस के लिए आदर्श है जहाँ लेटेंसी मायने रखती है। प्रत्येक चंक प्रतिक्रिया का एक आंशिक डेल्टा होता है। जनरेशन पूर्ण होने पर जानने के लिए स्ट्रीम एंड इवेंट को हैंडल करें। यह विधि पूर्ण प्रतिक्रिया का इंतज़ार करने की तुलना में अनुभूत लेटेंसी को काफी कम करती है।
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
सीमाएँ, त्रुटियाँ और कॉन्टेक्स्ट विंडो
आपके अनुरोध प्रॉम्प्ट और कम्प्लीशन दोनों के लिए 100,000 टोकन की कॉन्टेक्स्ट विंडो का समर्थन करते हैं। रेट लिमिट प्रति कुंजी प्रति मिनट 300 अनुरोध है, और अधिकतम अनुरोध बॉडी आकार 8 MB है। सामान्य त्रुटियों में 401 अमान्य कुंजियों के लिए, 402 यदि आपका प्रीपेड क्रेडिट समाप्त हो गया है, और 429 यदि आप प्रति-मिनट सीमा से अधिक हो जाते हैं, शामिल हैं। अपनी API कुंजी को पुनः जनरेट करने से पुरानी कुंजी रद्द हो जाती है लेकिन रेट काउंटर रीसेट नहीं होती है। सुनिश्चित करें कि आपका क्लाइंट इन HTTP स्टेटस कोड को उचित रूप से संभाले ताकि सुचारू संचालन बनाए रखा जा सके।
तकनीकी विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.gemma4api.com/v1 |
| मॉडल ID | uncensored |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| JSON मोड | response_format: {"type": "json_object"} |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| अनुरोध का आकार | 8 MB तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| बोनस | $50 से +5%, $100 से +10% |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| साइन इन | Google या ईमेल और पासवर्ड |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
क्या अपनी API कुंजी पुनः उत्पन्न करने से मेरा रेट लिमिट काउंटर रीसेट हो जाता है?
नहीं। अपनी कुंजी को पुनः जनरेट करने से पिछली कुंजी रद्द हो जाती है और एक नया प्रमाणपत्र जारी किया जाता है, लेकिन रेट लिमिट प्रति खाता लागू होता है और कुंजी परिवर्तनों के बावजूद बना रहता है। यदि आप 300 अनुरोध/मिनट की सीमा पर पहुँच जाते हैं, तो आपको मिनट विंडो के रीसेट होने का प्रतीक्षा करनी होगी।
'बिना सेंसर' ID के पीछे कौन सा मॉडल चल रहा है?
यह एक ओपन-वेट बड़ा भाषा मॉडल है जो हमारे अपने GPU सर्वरों पर होस्ट किया गया है। यह GPT, क्लॉड, जेमिनी या किसी अन्य विक्रेता का मॉडल नहीं है। इसे कानूनी वयस्क उपयोग के लिए बिना सामग्री अस्वीकृति के उत्तर देने के लिए ट्यून्ड किया गया है।
क्या मैं इस API का उपयोग टूल कॉलिंग के लिए कर सकता हूँ?
हाँ। <code>/v1/chat/completions</code> एंडपॉइंट टूल और फ़ंक्शन कॉलिंग का समर्थन करता है। आप अनुरोध में टूल परिभाषाएँ पास कर सकते हैं, और मॉडल मानक OpenAI SDK कार्यान्वयनों के साथ संगत संरचित JSON आउटपुट लौटाएगा।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएँ, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।