URL de base & Authentification
Commencez par créer un compte sur la page Obtenir la clé API. Vous n'avez besoin que d'un e-mail et d'un mot de passe ; aucun numéro de téléphone ni carte bancaire n'est requis pour activer le crédit d'essai gratuit. Une fois inscrit, votre clé API est affichée immédiatement. Copiez cette clé et stockez-la en toute sécurité. Utilisez-la dans l'en-tête Authorization comme jeton Bearer pour toutes les requêtes. L'URL de base pour tous les endpoints est https://api.gemma4api.com/v1. Cette URL fonctionne avec n'importe quel client compatible OpenAI standard, vous permettant de changer de fournisseur en modifiant simplement l'URL de base et la clé API dans votre configuration.
Première requête
Envoyez votre premier prompt en utilisant curl pour vérifier la connectivité. Remplacez YOUR_API_KEY par votre clé réelle. L'identifiant du modèle est uncensored. Cette simple requête texte en, texte sort confirme que votre authentification est correcte et que le modèle répond. Si vous recevez une réponse JSON avec un tableau choices, votre configuration est terminée. Vous pouvez maintenant passer à l'intégration du SDK pour des workflows plus complexes.
curl https://api.gemma4api.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Intégration SDK Python
Installez le package Python officiel OpenAI. Définissez les variables d'environnement de l'URL de base et de la clé API, ou passez-les directement au constructeur du client. Utilisez l'identifiant de modèle uncensored pour vous assurer d'appeler notre instance spécifique. Cette approche garantit que votre code reste compatible avec les modèles standard OpenAI tout en tirant parti de notre modèle sans censure pour la génération de contenu. Le SDK gère automatiquement les nouvelles tentatives et l'analyse JSON.
from openai import OpenAI
client = OpenAI(base_url="https://api.gemma4api.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Intégration SDK Node.js
Pour les environnements JavaScript, installez le package Node.js OpenAI. Configurez le client avec l'URL de base https://api.gemma4api.com/v1 et votre clé API. Utilisez l'identifiant de modèle uncensored dans vos appels de complétion. Cette configuration vous permet de maintenir des structures de code compatibles OpenAI standard tout en bénéficiant du comportement spécifique du modèle hébergé sur nos serveurs. Assurez-vous de gérer correctement les réponses asynchrones au sein de votre boucle d'événements Node.js.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.gemma4api.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Réponses en streaming
Activez le streaming en définissant le paramètre stream sur true dans votre requête API. Cela renvoie un flux Server-Sent Events (SSE), vous permettant d'afficher les tokens au fur et à mesure de leur génération. C'est idéal pour les interfaces de chat où la latence est importante. Chaque chunk contient un delta partiel de la réponse. Gérez l'événement de fin de flux pour savoir quand la génération est terminée. Cette méthode réduit considérablement la latence perçue par rapport à l'attente de la réponse complète.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, erreurs & fenêtre de contexte
Vos requêtes prennent en charge une fenêtre de contexte de 100 000 tokens pour le prompt et la complétion combinés. La limite de débit est de 300 requêtes par minute par clé, avec une taille maximale du corps de requête de 8 Mo. Les erreurs courantes incluent 401 pour les clés invalides, 402 si votre crédit prépayé est épuisé, et 429 si vous dépassez la limite par minute. Régénérer votre clé API révoque l'ancienne mais ne réinitialise pas le compteur de débit. Assurez-vous que votre client gère correctement ces codes de statut HTTP pour maintenir un fonctionnement fluide.
Caractéristiques techniques
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.gemma4api.com/v1 |
| ID du modèle | uncensored |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Mode JSON | response_format: {"type": "json_object"} |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Limite de débit | 300 requêtes par minute et par clé |
| Taille | jusqu'à 8 Mo par requête |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrence | 8 requêtes simultanées par clé |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
La régénération de ma clé API réinitialise-t-elle le compteur de limite de débit ?
Non. La régénération de votre clé révoque la précédente et émet un nouveau jeton d'identification, mais la limite de débit s'applique par compte et persiste malgré les changements de clé. Vous devez attendre la fin de la fenêtre d'une minute pour que la limite se réinitialise si vous atteignez la limite de 300 requêtes par minute.
Quel modèle fonctionne derrière l'ID « sans censure » ?
Il s'agit d'un modèle de langage à poids ouverts hébergé sur nos propres serveurs GPU. Ce n'est pas GPT, Claude, Gemini ou tout autre modèle d'un autre fournisseur. Il est ajusté pour répondre sans refus de contenu pour un usage adulte légal.
Puis-je utiliser cette API pour l'appel de fonctions ?
Oui. L'endpoint <code>/v1/chat/completions</code> prend en charge l'appel de fonctions et l'appel d'outils. Vous pouvez transmettre des définitions d'outils dans la requête, et le modèle renverra une sortie JSON structurée compatible avec les implémentations standard du SDK OpenAI.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.