URL cơ sở & Xác thực
Bắt đầu bằng cách tạo tài khoản trên trang Lấy khóa API. Bạn chỉ cần email và mật khẩu; không cần số điện thoại hay thẻ tín dụng để kích hoạt tín dụng dùng thử. Sau khi đăng ký, khóa API của bạn sẽ được hiển thị ngay lập tức. Sao chép khóa này và lưu trữ nó một cách an toàn. Sử dụng khóa này trong tiêu đề Authorization dưới dạng mã thông báo Bearer cho tất cả các yêu cầu. URL cơ sở cho tất cả các endpoint là https://api.gemma4api.com/v1. URL này hoạt động với bất kỳ máy khách tương thích OpenAI tiêu chuẩn nào, cho phép bạn chuyển đổi nhà cung cấp chỉ bằng cách thay đổi URL cơ sở và khóa API trong cấu hình của bạn.
Yêu cầu đầu tiên
Gửi prompt đầu tiên của bạn bằng curl để xác minh kết nối. Thay thế YOUR_API_KEY bằng khóa thực tế của bạn. Định danh mô hình là uncensored. Yêu cầu văn bản vào, văn bản ra đơn giản này xác nhận xác thực của bạn đúng và mô hình đang phản hồi. Nếu bạn nhận được phản hồi JSON có mảng choices, thiết lập của bạn đã hoàn tất. Bạn có thể tiếp tục tích hợp SDK cho các quy trình làm việc phức tạp hơn.
curl https://api.gemma4api.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Tích hợp SDK Python
Cài đặt gói Python chính thức của OpenAI. Đặt các biến môi trường URL cơ sở và khóa API hoặc truyền trực tiếp chúng vào hàm tạo máy khách. Sử dụng định danh mô hình uncensored để đảm bảo bạn đang gọi phiên bản cụ thể của chúng tôi. Cách tiếp cận này đảm bảo mã của bạn tương thích với các mẫu OpenAI tiêu chuẩn trong khi tận dụng mô hình không kiểm duyệt của chúng tôi để tạo nội dung. SDK xử lý việc thử lại và phân tích JSON tự động.
from openai import OpenAI
client = OpenAI(base_url="https://api.gemma4api.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Tích hợp SDK Node.js
Đối với môi trường JavaScript, hãy cài đặt gói Node.js của OpenAI. Định cấu hình máy khách với URL cơ sở https://api.gemma4api.com/v1 và khóa API của bạn. Sử dụng định danh mô hình uncensored trong các lệnh gọi hoàn tất của bạn. Thiết lập này cho phép bạn duy trì các cấu trúc mã tương thích với OpenAI tiêu chuẩn trong khi hưởng lợi từ hành vi mô hình cụ thể được lưu trữ trên máy chủ của chúng tôi. Đảm bảo bạn xử lý các phản hồi không đồng bộ đúng cách trong vòng lặp sự kiện Node.js của bạn.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.gemma4api.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Phản hồi truyền phát
Bật truyền phát bằng cách đặt tham số stream thành true trong yêu cầu API của bạn. Điều này trả về luồng Sự kiện được gửi qua máy chủ (SSE), cho phép bạn hiển thị token khi chúng được tạo. Điều này rất lý tưởng cho các giao diện trò chuyện nơi độ trễ quan trọng. Mỗi đoạn chứa một phần delta của phản hồi. Xử lý sự kiện kết thúc luồng để biết khi nào quá trình tạo hoàn tất. Phương pháp này giảm đáng kể độ trễ cảm nhận so với việc chờ phản hồi đầy đủ.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Giới hạn, Lỗi & Cửa sổ ngữ cảnh
Yêu cầu của bạn hỗ trợ cửa sổ ngữ cảnh 100.000 token cho cả prompt và hoàn tất kết hợp. Giới hạn tốc độ là 300 yêu cầu mỗi phút trên mỗi khóa, với kích thước thân yêu cầu tối đa là 8 MB. Các lỗi phổ biến bao gồm 401 cho khóa không hợp lệ, 402 nếu tín dụng trả trước của bạn đã cạn kiệt và 429 nếu bạn vượt quá giới hạn mỗi phút. Việc tạo lại khóa API của bạn sẽ thu hồi khóa cũ nhưng không đặt lại bộ đếm giới hạn tốc độ. Đảm bảo máy khách của bạn xử lý các mã trạng thái HTTP này một cách thích hợp để duy trì hoạt động trơn tru.
Thông số kỹ thuật
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.gemma4api.com/v1 |
| ID mô hình | uncensored |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Kích thước yêu cầu | tối đa 8 MB |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Thưởng | +5% từ $50, +10% từ $100 |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Đăng nhập | Google hoặc email và mật khẩu |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
Tạo lại khóa API có đặt lại bộ đếm giới hạn tốc độ không?
Không. Việc tạo lại khóa của bạn sẽ thu hồi khóa cũ và cấp một chứng chỉ mới, nhưng giới hạn tốc độ áp dụng cho mỗi tài khoản và không thay đổi khi khóa thay đổi. Bạn phải đợi cửa sổ phút tiếp theo để đặt lại nếu bạn đạt giới hạn 300 yêu cầu mỗi phút.
Mô hình nào đang chạy dưới ID 'uncensored'?
Đây là mô hình ngôn ngữ lớn trọng số mở được lưu trữ trên máy chủ GPU của chúng tôi. Nó không phải là GPT, Claude, Gemini hay mô hình của nhà cung cấp nào khác. Nó được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người lớn hợp pháp.
Tôi có thể sử dụng API này cho gọi hàm không?
Có. Endpoint <code>/v1/chat/completions</code> hỗ trợ gọi công cụ và gọi hàm. Bạn có thể truyền định nghĩa công cụ trong yêu cầu, và mô hình sẽ trả về kết xuất JSON có cấu trúc tương thích với các triển khai SDK OpenAI tiêu chuẩn.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.