VI ▾
gemma4api.comLấy khóa API

API Gemma: Yêu cầu đầu tiên trong năm phút

Nhận phản hồi đầu tiên của bạn trong vòng năm phút bằng các SDK chính thức của OpenAI với mô hình không kiểm duyệt của chúng tôi. Hướng dẫn này bao gồm xác thực, yêu cầu cơ bản, truyền phát và gọi công cụ với ít ma sát cấu hình nhất.

URL cơ sở & Xác thực

Bắt đầu bằng cách tạo tài khoản trên trang Lấy khóa API. Bạn chỉ cần email và mật khẩu; không cần số điện thoại hay thẻ tín dụng để kích hoạt tín dụng dùng thử. Sau khi đăng ký, khóa API của bạn sẽ được hiển thị ngay lập tức. Sao chép khóa này và lưu trữ nó một cách an toàn. Sử dụng khóa này trong tiêu đề Authorization dưới dạng mã thông báo Bearer cho tất cả các yêu cầu. URL cơ sở cho tất cả các endpoint là https://api.gemma4api.com/v1. URL này hoạt động với bất kỳ máy khách tương thích OpenAI tiêu chuẩn nào, cho phép bạn chuyển đổi nhà cung cấp chỉ bằng cách thay đổi URL cơ sở và khóa API trong cấu hình của bạn.

Yêu cầu đầu tiên

Gửi prompt đầu tiên của bạn bằng curl để xác minh kết nối. Thay thế YOUR_API_KEY bằng khóa thực tế của bạn. Định danh mô hình là uncensored. Yêu cầu văn bản vào, văn bản ra đơn giản này xác nhận xác thực của bạn đúng và mô hình đang phản hồi. Nếu bạn nhận được phản hồi JSON có mảng choices, thiết lập của bạn đã hoàn tất. Bạn có thể tiếp tục tích hợp SDK cho các quy trình làm việc phức tạp hơn.

curl https://api.gemma4api.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Tích hợp SDK Python

Cài đặt gói Python chính thức của OpenAI. Đặt các biến môi trường URL cơ sở và khóa API hoặc truyền trực tiếp chúng vào hàm tạo máy khách. Sử dụng định danh mô hình uncensored để đảm bảo bạn đang gọi phiên bản cụ thể của chúng tôi. Cách tiếp cận này đảm bảo mã của bạn tương thích với các mẫu OpenAI tiêu chuẩn trong khi tận dụng mô hình không kiểm duyệt của chúng tôi để tạo nội dung. SDK xử lý việc thử lại và phân tích JSON tự động.

from openai import OpenAI

client = OpenAI(base_url="https://api.gemma4api.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Tích hợp SDK Node.js

Đối với môi trường JavaScript, hãy cài đặt gói Node.js của OpenAI. Định cấu hình máy khách với URL cơ sở https://api.gemma4api.com/v1 và khóa API của bạn. Sử dụng định danh mô hình uncensored trong các lệnh gọi hoàn tất của bạn. Thiết lập này cho phép bạn duy trì các cấu trúc mã tương thích với OpenAI tiêu chuẩn trong khi hưởng lợi từ hành vi mô hình cụ thể được lưu trữ trên máy chủ của chúng tôi. Đảm bảo bạn xử lý các phản hồi không đồng bộ đúng cách trong vòng lặp sự kiện Node.js của bạn.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.gemma4api.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Phản hồi truyền phát

Bật truyền phát bằng cách đặt tham số stream thành true trong yêu cầu API của bạn. Điều này trả về luồng Sự kiện được gửi qua máy chủ (SSE), cho phép bạn hiển thị token khi chúng được tạo. Điều này rất lý tưởng cho các giao diện trò chuyện nơi độ trễ quan trọng. Mỗi đoạn chứa một phần delta của phản hồi. Xử lý sự kiện kết thúc luồng để biết khi nào quá trình tạo hoàn tất. Phương pháp này giảm đáng kể độ trễ cảm nhận so với việc chờ phản hồi đầy đủ.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Giới hạn, Lỗi & Cửa sổ ngữ cảnh

Yêu cầu của bạn hỗ trợ cửa sổ ngữ cảnh 100.000 token cho cả prompt và hoàn tất kết hợp. Giới hạn tốc độ là 300 yêu cầu mỗi phút trên mỗi khóa, với kích thước thân yêu cầu tối đa là 8 MB. Các lỗi phổ biến bao gồm 401 cho khóa không hợp lệ, 402 nếu tín dụng trả trước của bạn đã cạn kiệt và 429 nếu bạn vượt quá giới hạn mỗi phút. Việc tạo lại khóa API của bạn sẽ thu hồi khóa cũ nhưng không đặt lại bộ đếm giới hạn tốc độ. Đảm bảo máy khách của bạn xử lý các mã trạng thái HTTP này một cách thích hợp để duy trì hoạt động trơn tru.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Xác thựcAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.gemma4api.com/v1
ID mô hìnhuncensored
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Chế độ JSONresponse_format: {"type": "json_object"}
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Thưởng+5% từ $50, +10% từ $100
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Tạo lại khóa API có đặt lại bộ đếm giới hạn tốc độ không?

Không. Việc tạo lại khóa của bạn sẽ thu hồi khóa cũ và cấp một chứng chỉ mới, nhưng giới hạn tốc độ áp dụng cho mỗi tài khoản và không thay đổi khi khóa thay đổi. Bạn phải đợi cửa sổ phút tiếp theo để đặt lại nếu bạn đạt giới hạn 300 yêu cầu mỗi phút.

Mô hình nào đang chạy dưới ID 'uncensored'?

Đây là mô hình ngôn ngữ lớn trọng số mở được lưu trữ trên máy chủ GPU của chúng tôi. Nó không phải là GPT, Claude, Gemini hay mô hình của nhà cung cấp nào khác. Nó được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người lớn hợp pháp.

Tôi có thể sử dụng API này cho gọi hàm không?

Có. Endpoint <code>/v1/chat/completions</code> hỗ trợ gọi công cụ và gọi hàm. Bạn có thể truyền định nghĩa công cụ trong yêu cầu, và mô hình sẽ trả về kết xuất JSON có cấu trúc tương thích với các triển khai SDK OpenAI tiêu chuẩn.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.

Lấy khóa API