Base URL & การตรวจสอบสิทธิ์
เริ่มโดยสร้างบัญชีที่หน้า Get API key คุณต้องการเพียงอีเมลและรหัสผ่าน ไม่ต้องใช้เบอร์โทรหรือบัตรเครดิตเพื่อเปิดใช้เครดิตทดลองใช้ เมื่อลงทะเบียนแล้ว คีย์ API จะแสดงทันที คัดลอกคีย์นี้และเก็บไว้อย่างปลอดภัย ใช้ใน Authorization header เป็น Bearer token สำหรับทุกคำขอ Base URL สำหรับทุก endpoint คือ https://api.gemma4api.com/v1 URL นี้ใช้กับไคลเอนต์ที่เข้ากันได้กับ OpenAI มาตรฐาน ทำให้เปลี่ยนผู้ให้บริการได้โดยเปลี่ยน Base URL และคีย์ API ในค่ากำหนดของคุณ
คำขอแรก
ส่งพรอมต์แรกของคุณโดยใช้ curl เพื่อตรวจสอบการเชื่อมต่อ แทนที่ YOUR_API_KEY ด้วยคีย์จริงของคุณ รหัสโมเดลคือ uncensored คำขอข้อความเข้า-ข้อความออกอย่างง่ายนี้ยืนยันว่าการตรวจสอบสิทธิ์ของคุณถูกต้องและโมเดลกำลังตอบสนอง หากคุณได้รับ JSON response ที่มีอาร์เรย์ choices การตั้งค่าของคุณเสร็จสมบูรณ์แล้ว คุณสามารถดำเนินการต่อไปเพื่อผสานรวม SDK สำหรับเวิร์กโฟลว์ที่ซับซ้อนมากขึ้นได้
curl https://api.gemma4api.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
การผสานรวม Python SDK
ติดตั้งแพ็กเกจ Python ทางการของ OpenAI ตั้งค่าตัวแปรสภาพแวดล้อมของ Base URL และคีย์ API หรือส่งผ่านไปยังคอนสตรัคเตอร์ไคลเอนต์โดยตรง ใช้รหัสโมเดล uncensored เพื่อให้แน่ใจว่าคุณกำลังเรียกอินสแตนซ์เฉพาะของเรา วิธีนี้ทำให้โค้ดของคุณเข้ากันได้กับรูปแบบ OpenAI มาตรฐานในขณะที่ใช้โมเดลที่ไม่มีการเซ็นเซอร์ของเราสำหรับการสร้างเนื้อหา SDK จัดการการลองใหม่และการแยกวิเคราะห์ JSON โดยอัตโนมัติ
from openai import OpenAI
client = OpenAI(base_url="https://api.gemma4api.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
การผสานรวม Node.js SDK
สำหรับสภาพแวดล้อม JavaScript ให้ติดตั้งแพ็กเกจ OpenAI Node.js กำหนดค่าไคลเอนต์ด้วย Base URL https://api.gemma4api.com/v1 และคีย์ API ของคุณ ใช้รหัสโมเดล uncensored ในคำขอ completion ของคุณ การตั้งค่านี้ช่วยให้คุณรักษาโครงสร้างโค้ดที่เข้ากันได้กับ OpenAI มาตรฐานในขณะที่ได้รับประโยชน์จากพฤติกรรมโมเดลเฉพาะที่โฮสต์บนเซิร์ฟเวอร์ของเรา ตรวจสอบให้แน่ใจว่าคุณจัดการการตอบสนองแบบอะซิงโครนัสได้อย่างถูกต้องภายในลูปเหตุการณ์ Node.js ของคุณ
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.gemma4api.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
การตอบสนองแบบสตรีมมิง
เปิดใช้งานสตรีมมิงโดยการตั้งค่าพารามิเตอร์ stream เป็น true ในคำขอ API ของคุณ สิ่งนี้จะส่งสตรีม Server-Sent Events (SSE) ซึ่งช่วยให้คุณแสดงโทเคนเมื่อถูกสร้างขึ้น เหมาะสำหรับอินเทอร์เฟซแชทที่ความหน่วงเวลาสำคัญ แต่ละชิ้นมีข้อมูลบางส่วน (partial delta) ของการตอบสนอง จัดการเหตุการณ์สิ้นสุดสตรีมเพื่อทราบเมื่อการสร้างเสร็จสิ้น วิธีนี้ลดความหน่วงเวลาโดยรับรู้ได้อย่างมีนัยสำคัญเมื่อเทียบกับการรอการตอบสนองทั้งหมด
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
ขีดจำกัด ข้อผิดพลาด และหน้าต่างบริบท
คำขอของคุณรองรับหน้าต่างบริบท 100,000 โทเคนสำหรับพรอมต์และการสร้างรวมกัน ขีดจำกัดอัตราคือ 300 คำขอต่อนาทีต่อคีย์ พร้อมขนาดบอดี้คำขอสูงสุด 8 MB ข้อผิดพลาดทั่วไป ได้แก่ 401 สำหรับคีย์ที่ไม่ถูกต้อง 402 หากเครดิตแบบเติมเงินล่วงหน้าของคุณหมด และ 429 หากคุณเกินขีดจำกัดต่อนาที การสร้างคีย์ API ใหม่จะเพิกถอนคีย์เก่าแต่จะไม่รีเซ็ตตัวนับอัตรา ตรวจสอบให้แน่ใจว่าไคลเอนต์ของคุณจัดการรหัสสถานะ HTTP เหล่านี้ได้อย่างเหมาะสมเพื่อรักษาการทำงานที่ราบรื่น
ข้อมูลจำเพาะทางเทคนิค
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.gemma4api.com/v1 |
| ID โมเดล | uncensored |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| โหมด JSON | response_format: {"type": "json_object"} |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
การสร้างคีย์ API ใหม่จะรีเซ็ตตัวนับขีดจำกัดอัตราหรือไม่?
ไม่ การสร้างคีย์ใหม่จะยกเลิกคีย์เดิมและออกใบรับรองใหม่ แต่ขีดจำกัดอัตราจะนับต่อบัญชีและคงอยู่ไม่ว่าคีย์จะเปลี่ยนหรือไม่ คุณต้องรอให้หน้าต่างเวลาหนึ่งนาทีรีเซ็ตหากคุณถึงขีดจำกัด 300 คำขอต่อนาที
โมเดลใดทำงานอยู่ภายใต้ ID 'uncensored'?
เป็นโมเดลภาษาขนาดใหญ่แบบเปิดน้ำหนักที่โฮสต์บนเซิร์ฟเวอร์ GPU ของเราเอง ไม่ใช่ GPT, Claude, Gemini หรือโมเดลของผู้จัดจำหน่ายรายอื่น โมเดลนี้ปรับแต่งให้ตอบโดยไม่มีการปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย
ฉันสามารถใช้ API นี้สำหรับการเรียกใช้ฟังก์ชันได้หรือไม่?
ใช่ เอนด์พอยต์ <code>/v1/chat/completions</code> รองรับเครื่องมือและการเรียกใช้ฟังก์ชัน คุณสามารถส่งคำจำกัดความเครื่องมือในคำขอ และโมเดลจะส่งคืน JSON output ที่เข้ากันได้กับการใช้งาน SDK มาตรฐานของ OpenAI
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน Base URL นั่นคือการตั้งค่าทั้งหมด