IT ▾
gemma4api.comOttieni la chiave API

API Gemma: prima richiesta in cinque minuti

Ottieni la tua prima risposta in meno di cinque minuti usando gli SDK ufficiali OpenAI con il nostro modello senza censura. Questa guida copre l'autenticazione, le richieste di base, lo streaming e la chiamata di funzioni con zero attrito di configurazione.

URL di base e Autenticazione

Inizia creando un account nella pagina Ottieni chiave API. Ti servono solo email e password; non è richiesto un numero di telefono o una carta di credito per attivare il credito di prova. Una volta registrato, la tua chiave API viene visualizzata immediatamente. Copia questa chiave e memorizzala in modo sicuro. Usala nell'intestazione Authorization come token Bearer per tutte le richieste. L'URL di base per tutti gli endpoint è https://api.gemma4api.com/v1. Questo URL funziona con qualsiasi client compatibile con OpenAI, permettendoti di cambiare provider semplicemente modificando l'URL di base e la chiave API nella tua configurazione.

Prima Richiesta

Invia il tuo primo prompt usando curl per verificare la connettività. Sostituisci YOUR_API_KEY con la tua chiave effettiva. L'identificatore del modello è uncensored. Questa semplice richiesta testo-in, testo-out conferma che l'autenticazione è corretta e che il modello risponde. Se ricevi una risposta JSON con un array choices, la configurazione è completa. Ora puoi procedere a integrare l'SDK per flussi di lavoro più complessi.

curl https://api.gemma4api.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Integrazione SDK Python

Installa il pacchetto Python ufficiale di OpenAI. Imposta le variabili di ambiente per l'URL di base e la chiave API o passale direttamente al costruttore del client. Usa l'ID del modello uncensored per assicurarti di chiamare la nostra istanza specifica. Questo approccio garantisce che il tuo codice rimanga compatibile con gli standard OpenAI sfruttando al contempo il nostro modello senza censura per la generazione di contenuti. L'SDK gestisce automaticamente i tentativi e l'analisi JSON.

from openai import OpenAI

client = OpenAI(base_url="https://api.gemma4api.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integrazione SDK Node.js

Per gli ambienti JavaScript, installa il pacchetto OpenAI Node.js. Configura il client con l'URL di base https://api.gemma4api.com/v1 e la tua chiave API. Usa l'ID del modello uncensored nelle tue chiamate di completamento. Questa configurazione ti permette di mantenere strutture di codice compatibili con OpenAI beneficiando del comportamento specifico del modello ospitato sui nostri server. Assicurati di gestire correttamente le risposte asincrone all'interno del ciclo degli eventi Node.js.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.gemma4api.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Risposte in Streaming

Abilita lo streaming impostando il parametro stream su true nella tua richiesta API. Questo restituisce uno stream di Server-Sent Events (SSE), permettendoti di visualizzare i token man mano che vengono generati. È ideale per le interfacce chat dove la latenza è importante. Ogni chunk contiene un delta parziale della risposta. Gestisci l'evento di fine stream per sapere quando la generazione è completa. Questo metodo riduce significativamente la latenza percepita rispetto all'attesa della risposta completa.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limiti, Errori e Finestra di Contesto

Le tue richieste supportano una finestra di contesto di 100.000 token per prompt e completamento combinati. Il limite di richieste è di 300 richieste al minuto per chiave, con una dimensione massima del corpo della richiesta di 8 MB. Gli errori comuni includono 401 per chiavi non valide, 402 se il tuo credito prepagato è esaurito e 429 se superi il limite per minuto. Rigenerare la chiave API revoca quella vecchia ma non resetta il contatore del limite. Assicurati che il tuo client gestisca appropriatamente questi codici di stato HTTP per mantenere un funzionamento fluido.

Specifiche tecniche

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
AutenticazioneAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.gemma4api.com/v1
ID modellouncensored
Finestra di contesto100.000 token (input + output)
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Modalità JSONresponse_format: {"type": "json_object"}
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Limite di frequenza300 richieste al minuto per chiave
Dimensionefino a 8 MB per richiesta
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concorrenza8 richieste contemporanee per chiave
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Scadenzail credito pagato non scade, nessun abbonamento
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Bonus+5% da $50, +10% da $100
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
AccessoGoogle oppure e-mail e password
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

La rigenerazione della chiave API resetta il contatore del limite di richieste?

No. Rigenerare la chiave revoca quella precedente ed emette nuove credenziali, ma il limite di richieste si applica per account e persiste indipendentemente dai cambiamenti della chiave. Devi attendere che la finestra di un minuto si resetti se superi il limite di 300 richieste/minuto.

Quale modello è attivo con l'ID 'uncensored'?

È un modello linguistico a pesi aperti ospitato sui nostri server GPU. Non è GPT, Claude, Gemini o il modello di alcun altro fornitore. È ottimizzato per rispondere senza rifiuti di contenuti per uso adulto lecito.

Posso usare questa API per la chiamata di funzioni?

Sì. L'endpoint <code>/v1/chat/completions</code> supporta la chiamata di funzioni e strumenti. Puoi passare le definizioni degli strumenti nella richiesta e il modello restituirà un output JSON strutturato compatibile con le implementazioni standard degli SDK OpenAI.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API