HI ▾
gemma4api.comAPI कुंजी पाएँ

Gemma API: पाँच मिनट में पहला अनुरोध

आपके बिना सेंसर मॉडल के साथ आधिकारिक OpenAI SDKs का उपयोग करके पाँच मिनट से भी कम समय में अपना पहला उत्तर प्राप्त करें। यह गाइड प्रमाणीकरण, बुनियादी अनुरोध, स्ट्रीमिंग और शून्य कॉन्फ़िगरेशन बाधा के साथ टूल कॉलिंग को कवर करती है।

बेस URL और प्रमाणीकरण

Get API key पृष्ठ पर खाता बनाने से शुरू करें। आपको केवल ईमेल और पासवर्ड की आवश्यकता है; ट्रायल क्रेडिट सक्रिय करने के लिए फ़ोन नंबर या क्रेडिट कार्ड की आवश्यकता नहीं है। पंजीकरण के बाद, आपकी API कुंजी तुरंत प्रदर्शित होती है। इस कुंजी को कॉपी करें और इसे सुरक्षित रूप से संग्रहीत करें। सभी अनुरोधों के लिए इसे Authorization हेडर में Bearer टोकन के रूप में उपयोग करें। सभी एंडपॉइंट्स के लिए बेस URL https://api.gemma4api.com/v1 है। यह URL किसी भी मानक OpenAI-संगत क्लाइंट के साथ काम करता है, जिससे आप केवल बेस URL और API कुंजी को अपनी कॉन्फ़िगरेशन में बदलकर प्रदाता बदल सकते हैं।

पहला अनुरोध

कनेक्टिविटी की जाँच करने के लिए curl का उपयोग करके अपना पहला प्रॉम्प्ट भेजें। YOUR_API_KEY को अपनी वास्तविक कुंजी से बदलें। मॉडल पहचानकर्ता uncensored है। यह सरल टेक्स्ट-इन, टेक्स्ट-आउट अनुरोध पुष्टि करता है कि आपकी प्रमाणीकरण सही है और मॉडल प्रतिक्रिया दे रहा है। यदि आपको choices सरणी के साथ एक JSON प्रतिक्रिया प्राप्त होती है, तो आपकी सेटअप पूरी हो गई है। अब आप अधिक जटिल वर्कफ़्लो के लिए SDK एकीकृत करने के लिए आगे बढ़ सकते हैं।

curl https://api.gemma4api.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK एकीकरण

आधिकारिक OpenAI Python पैकेज इंस्टॉल करें। बेस URL और API कुंजी एन्वायरमेंट वेरिएबल सेट करें या उन्हें सीधे क्लाइंट कंस्ट्रक्टर में पास करें। मॉडल ID uncensored का उपयोग करें ताकि सुनिश्चित हो सके कि आप हमारे विशिष्ट इंस्टेंस को कॉल कर रहे हैं। यह दृष्टिकोण सुनिश्चित करता है कि आपका कोड मानक OpenAI पैटर्न के साथ संगत रहे जबकि सामग्री जनरेशन के लिए हमारे बिना सेंसर मॉडल का लाभ उठाए। SDK रीट्राइज़ और JSON पार्सिंग को स्वचालित रूप से संभालता है।

from openai import OpenAI

client = OpenAI(base_url="https://api.gemma4api.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js SDK एकीकरण

JavaScript वातावरण के लिए, OpenAI Node.js पैकेज इंस्टॉल करें। क्लाइंट को बेस URL https://api.gemma4api.com/v1 और अपनी API कुंजी के साथ कॉन्फ़िगर करें। अपनी कम्प्लीशन कॉल्स में मॉडल ID uncensored का उपयोग करें। यह सेटअप आपको मानक OpenAI-संगत कोड संरचनाओं को बनाए रखने की अनुमति देता है जबकि हमारे सर्वरों पर होस्ट किए गए विशिष्ट मॉडल व्यवहार से लाभ उठाता है। सुनिश्चित करें कि आप अपने Node.js इवेंट लूप के भीतर एसेंक्रोनस प्रतिक्रियाओं को सही ढंग से संभालें।

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.gemma4api.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

स्ट्रीमिंग प्रतिक्रियाएँ

अपने API अनुरोध में stream पैरामीटर को true पर सेट करके स्ट्रीमिंग सक्षम करें। यह एक सर्वर-सेंट इवेंट्स (SSE) स्ट्रीम लौटाता है, जिससे आप टोकन को जनरेट होते हुए प्रदर्शित कर सकते हैं। यह चैट इंटरफ़ेस के लिए आदर्श है जहाँ लेटेंसी मायने रखती है। प्रत्येक चंक प्रतिक्रिया का एक आंशिक डेल्टा होता है। जनरेशन पूर्ण होने पर जानने के लिए स्ट्रीम एंड इवेंट को हैंडल करें। यह विधि पूर्ण प्रतिक्रिया का इंतज़ार करने की तुलना में अनुभूत लेटेंसी को काफी कम करती है।

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

सीमाएँ, त्रुटियाँ और कॉन्टेक्स्ट विंडो

आपके अनुरोध प्रॉम्प्ट और कम्प्लीशन दोनों के लिए 100,000 टोकन की कॉन्टेक्स्ट विंडो का समर्थन करते हैं। रेट लिमिट प्रति कुंजी प्रति मिनट 300 अनुरोध है, और अधिकतम अनुरोध बॉडी आकार 8 MB है। सामान्य त्रुटियों में 401 अमान्य कुंजियों के लिए, 402 यदि आपका प्रीपेड क्रेडिट समाप्त हो गया है, और 429 यदि आप प्रति-मिनट सीमा से अधिक हो जाते हैं, शामिल हैं। अपनी API कुंजी को पुनः जनरेट करने से पुरानी कुंजी रद्द हो जाती है लेकिन रेट काउंटर रीसेट नहीं होती है। सुनिश्चित करें कि आपका क्लाइंट इन HTTP स्टेटस कोड को उचित रूप से संभाले ताकि सुचारू संचालन बनाए रखा जा सके।

तकनीकी विवरण

API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।

मदमान
API फ़ॉर्मेटOpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें
प्रमाणीकरणAuthorization: Bearer YOUR_KEY
एंडपॉइंटPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.gemma4api.com/v1
मॉडल IDuncensored
कॉन्टेक्स्ट विंडो100,000 टोकन (इनपुट + आउटपुट मिलाकर)
स्ट्रीमिंगहाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग
फ़ंक्शन कॉलिंगहाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें
अधिकतम आउटपुट100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं)
JSON मोडresponse_format: {"type": "json_object"}
पैरामीटरtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
रेट लिमिटप्रति कुंजी प्रति मिनट 300 अनुरोध
अनुरोध का आकार8 MB तक
रिस्पॉन्स हेडरX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
समानांतर अनुरोधप्रति कुंजी एक साथ 8 तक
कीमतप्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00
वैधताभुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं
टॉप-अपUSDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि
मुफ़्त ट्रायल क्रेडिट$0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300)
बोनस$50 से +5%, $100 से +10%
बिलिंगप्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त
साइन इनGoogle या ईमेल और पासवर्ड
कुंजियाँहर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है
सामग्रीवयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार

त्रुटि कोड

त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।

कोडप्रकारअर्थ
400bad_requestअमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक
401missing_key · invalid_key · key_revokedकुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई
402no_creditक्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू
403content_blockedनाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं
404not_foundअज्ञात एंडपॉइंट
413request_too_largeबॉडी 8 MB से बड़ी
429rate_limited · concurrency300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें
503upstream_busyमॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें

प्रश्न और उत्तर

क्या अपनी API कुंजी पुनः उत्पन्न करने से मेरा रेट लिमिट काउंटर रीसेट हो जाता है?

नहीं। अपनी कुंजी को पुनः जनरेट करने से पिछली कुंजी रद्द हो जाती है और एक नया प्रमाणपत्र जारी किया जाता है, लेकिन रेट लिमिट प्रति खाता लागू होता है और कुंजी परिवर्तनों के बावजूद बना रहता है। यदि आप 300 अनुरोध/मिनट की सीमा पर पहुँच जाते हैं, तो आपको मिनट विंडो के रीसेट होने का प्रतीक्षा करनी होगी।

'बिना सेंसर' ID के पीछे कौन सा मॉडल चल रहा है?

यह एक ओपन-वेट बड़ा भाषा मॉडल है जो हमारे अपने GPU सर्वरों पर होस्ट किया गया है। यह GPT, क्लॉड, जेमिनी या किसी अन्य विक्रेता का मॉडल नहीं है। इसे कानूनी वयस्क उपयोग के लिए बिना सामग्री अस्वीकृति के उत्तर देने के लिए ट्यून्ड किया गया है।

क्या मैं इस API का उपयोग टूल कॉलिंग के लिए कर सकता हूँ?

हाँ। <code>/v1/chat/completions</code> एंडपॉइंट टूल और फ़ंक्शन कॉलिंग का समर्थन करता है। आप अनुरोध में टूल परिभाषाएँ पास कर सकते हैं, और मॉडल मानक OpenAI SDK कार्यान्वयनों के साथ संगत संरचित JSON आउटपुट लौटाएगा।

आपकी कुंजी बस एक फ़ॉर्म दूर है

एक खाता बनाएँ, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।

API कुंजी पाएँ