FR ▾
gemma4api.comObtenir une clé API

API Gemma : première requête en cinq minutes

Obtenez votre première réponse en moins de cinq minutes en utilisant les SDK officiels OpenAI avec notre modèle sans censure. Ce guide couvre l'authentification, les requêtes de base, le streaming et l'appel de fonctions avec une friction de configuration nulle.

URL de base & Authentification

Commencez par créer un compte sur la page Obtenir la clé API. Vous n'avez besoin que d'un e-mail et d'un mot de passe ; aucun numéro de téléphone ni carte bancaire n'est requis pour activer le crédit d'essai gratuit. Une fois inscrit, votre clé API est affichée immédiatement. Copiez cette clé et stockez-la en toute sécurité. Utilisez-la dans l'en-tête Authorization comme jeton Bearer pour toutes les requêtes. L'URL de base pour tous les endpoints est https://api.gemma4api.com/v1. Cette URL fonctionne avec n'importe quel client compatible OpenAI standard, vous permettant de changer de fournisseur en modifiant simplement l'URL de base et la clé API dans votre configuration.

Première requête

Envoyez votre premier prompt en utilisant curl pour vérifier la connectivité. Remplacez YOUR_API_KEY par votre clé réelle. L'identifiant du modèle est uncensored. Cette simple requête texte en, texte sort confirme que votre authentification est correcte et que le modèle répond. Si vous recevez une réponse JSON avec un tableau choices, votre configuration est terminée. Vous pouvez maintenant passer à l'intégration du SDK pour des workflows plus complexes.

curl https://api.gemma4api.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Intégration SDK Python

Installez le package Python officiel OpenAI. Définissez les variables d'environnement de l'URL de base et de la clé API, ou passez-les directement au constructeur du client. Utilisez l'identifiant de modèle uncensored pour vous assurer d'appeler notre instance spécifique. Cette approche garantit que votre code reste compatible avec les modèles standard OpenAI tout en tirant parti de notre modèle sans censure pour la génération de contenu. Le SDK gère automatiquement les nouvelles tentatives et l'analyse JSON.

from openai import OpenAI

client = OpenAI(base_url="https://api.gemma4api.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Intégration SDK Node.js

Pour les environnements JavaScript, installez le package Node.js OpenAI. Configurez le client avec l'URL de base https://api.gemma4api.com/v1 et votre clé API. Utilisez l'identifiant de modèle uncensored dans vos appels de complétion. Cette configuration vous permet de maintenir des structures de code compatibles OpenAI standard tout en bénéficiant du comportement spécifique du modèle hébergé sur nos serveurs. Assurez-vous de gérer correctement les réponses asynchrones au sein de votre boucle d'événements Node.js.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.gemma4api.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Réponses en streaming

Activez le streaming en définissant le paramètre stream sur true dans votre requête API. Cela renvoie un flux Server-Sent Events (SSE), vous permettant d'afficher les tokens au fur et à mesure de leur génération. C'est idéal pour les interfaces de chat où la latence est importante. Chaque chunk contient un delta partiel de la réponse. Gérez l'événement de fin de flux pour savoir quand la génération est terminée. Cette méthode réduit considérablement la latence perçue par rapport à l'attente de la réponse complète.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limites, erreurs & fenêtre de contexte

Vos requêtes prennent en charge une fenêtre de contexte de 100 000 tokens pour le prompt et la complétion combinés. La limite de débit est de 300 requêtes par minute par clé, avec une taille maximale du corps de requête de 8 Mo. Les erreurs courantes incluent 401 pour les clés invalides, 402 si votre crédit prépayé est épuisé, et 429 si vous dépassez la limite par minute. Régénérer votre clé API révoque l'ancienne mais ne réinitialise pas le compteur de débit. Assurez-vous que votre client gère correctement ces codes de statut HTTP pour maintenir un fonctionnement fluide.

Caractéristiques techniques

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
AuthentificationAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.gemma4api.com/v1
ID du modèleuncensored
Fenêtre de contexte100 000 tokens (entrée + sortie)
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Mode JSONresponse_format: {"type": "json_object"}
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Limite de débit300 requêtes par minute et par clé
Taillejusqu'à 8 Mo par requête
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concurrence8 requêtes simultanées par clé
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Validitéle crédit payé n'expire jamais, sans abonnement
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Bonus+5 % dès 50 $, +10 % dès 100 $
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
ConnexionGoogle ou e-mail et mot de passe
Clésune clé active par compte ; une nouvelle remplace l'ancienne
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé

Codes d'erreur

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

La régénération de ma clé API réinitialise-t-elle le compteur de limite de débit ?

Non. La régénération de votre clé révoque la précédente et émet un nouveau jeton d'identification, mais la limite de débit s'applique par compte et persiste malgré les changements de clé. Vous devez attendre la fin de la fenêtre d'une minute pour que la limite se réinitialise si vous atteignez la limite de 300 requêtes par minute.

Quel modèle fonctionne derrière l'ID « sans censure » ?

Il s'agit d'un modèle de langage à poids ouverts hébergé sur nos propres serveurs GPU. Ce n'est pas GPT, Claude, Gemini ou tout autre modèle d'un autre fournisseur. Il est ajusté pour répondre sans refus de contenu pour un usage adulte légal.

Puis-je utiliser cette API pour l'appel de fonctions ?

Oui. L'endpoint <code>/v1/chat/completions</code> prend en charge l'appel de fonctions et l'appel d'outils. Vous pouvez transmettre des définitions d'outils dans la requête, et le modèle renverra une sortie JSON structurée compatible avec les implémentations standard du SDK OpenAI.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API