PL ▾
gemma4api.comPobierz klucz API

API Gemma: pierwsze zapytanie w pięć minut

Otrzymaj pierwszą odpowiedź w ciągu pięciu minut, korzystając z oficjalnych SDK OpenAI z naszym modelem bez cenzury. Przewodnik obejmuje uwierzytelnianie, podstawowe zapytania, strumieniowanie i wywoływanie funkcji bezproblemową konfiguracją.

Base URL i uwierzytelnianie

Zacznij od utworzenia konta na stronie Pobierz klucz API. Potrzebujesz tylko adresu e-mail i hasła; nie jest wymagany numer telefonu ani karta kredytowa do aktywacji kredytu próbnego. Po rejestracji Twój klucz API jest wyświetlany natychmiast. Skopiuj ten klucz i przechowaj go bezpiecznie. Użyj go w nagłówku Authorization jako token Bearer dla wszystkich zapytań. Base URL dla wszystkich endpointów to https://api.gemma4api.com/v1. Ten URL działa z każdym standardowym klientem kompatybilnym z OpenAI, pozwalając na zmianę dostawcy poprzez prostą zmianę base URL i klucza API w konfiguracji.

Pierwsze zapytanie

Wyślij swój pierwszy prompt, używając curl, aby zweryfikować łączność. Zastąp YOUR_API_KEY swoim właściwym kluczem. Identyfikator modelu to uncensored. To proste zapytanie tekst na tekst potwierdza, że uwierzytelnienie jest poprawne i model odpowiada. Jeśli otrzymasz odpowiedź JSON z tablicą choices, konfiguracja jest zakończona. Możesz teraz przejść do integracji SDK dla bardziej złożonych przepływów pracy.

curl https://api.gemma4api.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Integracja z Python SDK

Zainstaluj oficjalny pakiet Python OpenAI. Ustaw zmienne środowiskowe base URL i klucz API lub przekaż je bezpośrednio do konstruktora klienta. Użyj identyfikatora modelu uncensored, aby upewnić się, że wywołujesz naszą konkretną instancję. To podejście zapewnia, że Twój kod pozostaje zgodny ze standardowymi wzorcami OpenAI, jednocześnie wykorzystując nasz model bez cenzury do generowania treści. SDK obsługuje ponowne próby i parsowanie JSON automatycznie.

from openai import OpenAI

client = OpenAI(base_url="https://api.gemma4api.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integracja z Node.js SDK

W środowiskach JavaScript zainstaluj pakiet OpenAI Node.js. Skonfiguruj klienta z base URL https://api.gemma4api.com/v1 i swoim kluczem API. Użyj identyfikatora modelu uncensored w swoich zapytaniach completion. Ta konfiguracja pozwala zachować standardowe struktury kodu zgodne z OpenAI, czerpiąc jednocześnie korzyści ze specyficznego zachowania modelu hostowanego na naszych serwerach. Upewnij się, że poprawnie obsługujesz odpowiedzi asynchroniczne w pętli zdarzeń Node.js.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.gemma4api.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Strumieniowanie odpowiedzi

Włącz strumieniowanie, ustawiając parametr stream na true w swoim zapytaniu API. Zwraca to strumień Server-Sent Events (SSE), pozwalając wyświetlać tokeny w miarę ich generowania. Jest to idealne dla interfejsów czatu, gdzie liczy się opóźnienie. Każdy fragment zawiera częściowy deltę odpowiedzi. Obsłuż zdarzenie końca strumienia, aby wiedzieć, kiedy generowanie się zakończyło. Ta metoda znacznie redukuje postrzegane opóźnienie w porównaniu do czekania na pełną odpowiedź.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limity, błędy i okno kontekstu

Twoje zapytania obsługują okno kontekstu 100 000 tokenów dla promptu i completion łącznie. Limit zapytań to 300 zapytań na minutę na klucz, z maksymalnym rozmiarem ciała zapytania 8 MB. Powszechne błędy to 401 dla nieprawidłowych kluczy, 402 jeśli Twój przedpłacony kredyt został wyczerpany oraz 429 jeśli przekroczysz limit na minutę. Wygenerowanie ponownie klucza API unieważnia stary klucz, ale nie resetuje licznika limitów. Upewnij się, że Twój klient odpowiednio obsługuje te kody statusu HTTP, aby utrzymać płynną pracę.

Specyfikacja techniczna

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
UwierzytelnianieAuthorization: Bearer YOUR_KEY
EndpointyPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.gemma4api.com/v1
ID modeluuncensored
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Tryb JSONresponse_format: {"type": "json_object"}
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Limit zapytań300 zapytań na minutę na klucz
Rozmiar zapytaniado 8 MB
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Równoległe zapytaniado 8 jednocześnie na klucz
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Bonus+5% od $50, +10% od $100
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
LogowanieGoogle albo e-mail i hasło
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Czy regeneracja klucza API resetuje licznik limitu zapytań?

Nie. Regeneracja klucza unieważnia poprzedni i wydaje nowe poświadczenie, ale limit zapytań dotyczy konta i utrzymuje się niezależnie od zmiany klucza. Musisz poczekać na reset okresu minutowego, jeśli przekroczysz limit 300 zapytań na minutę.

Jaki model stoi za identyfikatorem „bez cenzury”?

Jest to model dużego języka o otwartych wagach hostowany na naszych własnych serwerach GPU. Nie jest to GPT, Claude, Gemini ani żaden inny model dostawcy. Jest dostrojony do odpowiadania bez odmów treści dla prawnego użytku dorosłego.

Czy mogę używać tego API do wywoływania funkcji?

Tak. Endpoint <code>/v1/chat/completions</code> obsługuje wywoływanie narzędzi i funkcji. Możesz przekazać definicje narzędzi w zapytaniu, a model zwróci strukturalny output JSON kompatybilny ze standardowymi implementacjami SDK OpenAI.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień base URL. To cała konfiguracja.

Pobierz klucz API