เริ่มต้นอย่างรวดเร็ว: ผสาน API AI ราคาถูกของเรา
เริ่มสร้างข้อความด้วย API LLM แบบไม่เซ็นเซอร์ของเราในไม่กี่นาทีโดยใช้รูปแบบที่เข้ากันได้กับ OpenAI คู่มือนี้ครอบคลุมการตรวจสอบสิทธิ์ คำขอพื้นฐาน การสตรีมมิง และการเรียกใช้ฟังก์ชันโดยไม่มีการผูกมัดผู้ขาย
การตรวจสอบสิทธิ์และ Base URL
เพื่อใช้ cheap ai api ของคุณ จำเป็นต้องมี API key จากแดชบอร์ดของคุณ คำขอทั้งหมดจะกำหนดเป้าหมายไปที่ base URL https://api.cheapaiapis.com/v1 สิ่งนี้ช่วยให้เข้ากันได้กับ SDK และไคลเอนต์ OpenAI ที่มีอยู่
ใส่คีย์ของคุณใน header Authorization เป็นโทเคน Bearer หากคีย์ไม่ถูกต้อง คุณจะรับข้อผิดพลาด 401 หากเครดิตแบบเติมเงินล่วงหน้าของคุณหมด คุณจะรับข้อผิดพลาด 402 ลงทะเบียนที่ Get API key เพื่อรับโทเคนของคุณทันที
ตัวระบุโมเดลสำหรับ LLM แบบไม่เซ็นเซอร์ของเราคือ "uncensored" โมเดลเดียวนี้จัดการงานสร้างข้อความทั้งหมดโดยไม่มีความล้นจากการเปลี่ยนเส้นทาง
curl https://api.cheapaiapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Chat Completions มาตรฐาน
เอนด์พอยต์ chat completions api รับคำขอ POST พร้อมอาร์เรย์ messages แต่ละข้อความต้องมี role (system, user หรือ assistant) และ content โครงสร้างนี้ช่วยให้สนทนาหลายรอบหรือพรอมต์แบบครั้งเดียวได้
โครงสร้างพื้นฐานของเราประมวลผลอินพุตข้อความและส่งออกเอาต์พุตข้อความอย่างมีประสิทธิภาพ โมเดลปรับแต่งเพื่อความยืดหยุ่น จัดการหัวข้อที่หลากหลายได้โดยไม่ปฏิเสธเนื้อหาผู้ใหญ่ตามกฎหมายที่ไม่จำเป็น ขนาดของ body คำขอจำกัดไว้ที่ 8 MB
ใช้ Python SDK เพื่อผสานรวมอย่างรวดเร็ว ไคลเอนต์จัดการการทำให้เป็นมาตรฐานและคำขอ HTTP โดยอัตโนมัติ
from openai import OpenAI
client = OpenAI(base_url="https://api.cheapaiapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
การตอบสนองแบบสตรีมมิง (SSE)
สำหรับแอปพลิเคชันที่ต้องการการตอบสนองแบบเรียลไทม์ ให้เปิดใช้งานสตรีมมิงโดยการตั้งค่า stream: true API ส่งคืน Server-Sent Events (SSE) ที่มีชิ้นส่วนโทเคนบางส่วน
แนวทางนี้ลดความล่าช้าที่รับรู้สำหรับผู้ใช้ปลายทาง คุณประมวลผลแต่ละชิ้นเมื่อมาถึง ประกอบการตอบสนองสุดท้าย สตรีมมิงทำงานกับไคลเอนต์ที่เข้ากันได้กับ OpenAI ทั้งหมดที่กำหนดค่าสำหรับ SSE
โปรดระวังขีดจำกัด 300 คำขอต่อนาทีต่อคีย์ สตรีมมิงไม่ข้ามขีดจำกัดอัตรา; มันเพียงเปลี่ยนวิธีการส่งข้อมูล
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
การรองรับการเรียกใช้ฟังก์ชัน
การดำเนินการ function calling api ของคุณอนุญาตให้คุณกำหนดเครื่องมือในคำขอ โมเดลส่งคืน JSON ที่มีโครงสร้างตรงกับสคีมาของคุณ เปิดใช้งานการดำเนินการแบบโปรแกรม
กำหนดฟังก์ชันด้วยชื่อ คำอธิบาย และสคีมาพารามิเตอร์ API ตอบกลับด้วยการเรียกใช้ tool_calls ที่คุณดำเนินการ จากนั้นส่งผลลัพธ์กลับไปยังโมเดลเพื่อคำตอบสุดท้าย สิ่งนี้ทำให้ตรรกะแยกจากการสร้าง
ตรวจสอบให้แน่ใจว่าการกำหนดฟังก์ชันของคุณเป็น JSON ที่ถูกต้อง ข้อผิดพลาดในโครงสร้างสคีมาอาจทำให้โมเดลส่งคืน tool_calls ที่ผิดปกติ
การระบุโมเดลและโทเคน
ใช้ GET /v1/models เพื่อดึงโมเดลที่มีอยู่ คุณจะเห็นโมเดล "uncensored" ที่แสดงพร้อมความสามารถเฉพาะ
โมเดลรองรับหน้าต่างบริบท 100,000 โทเคน โดยรวมโทเคนพรอมต์และโทเคน completion เข้าด้วยกัน สิ่งนี้ทำให้สามารถประมวลผลเอกสารขนาดใหญ่หรือการสนทนาที่ยาวนานได้โดยไม่มีการตัดทอนทันที
ราคาโปร่งใส: $0.25 ต่อ 1M โทเคนนำเข้า และ $1.00 ต่อ 1M โทเคนส่งออก เครดิตไม่หมดอายุ ดังนั้นคุณจ่ายเฉพาะสิ่งที่ใช้
ขีดจำกัด ข้อผิดพลาด และบริบท
ตรวจสอบการใช้งานของคุณผ่านแดชบอร์ด API กำหนดขีดจำกัดอัตรา 300 คำขอต่อนาทีต่อคีย์ การเกินขีดจำกัดนี้จะทำให้เกิดข้อผิดพลาด 429 สร้างคีย์ใหม่หากจำเป็นเพื่อรีเซ็ตสถานะ
ข้อผิดพลาดทั่วไปรวมถึง 401 (คีย์ไม่ถูกต้อง), 402 (เงินทุนไม่เพียงพอ) และ 429 (ขีดจำกัดอัตรา) จัดการข้อผิดพลาดเหล่านี้อย่างสุภาพในโค้ดไคลเอนต์ของคุณเสมอ
ขีดจำกัดหน้าต่างบริบทใช้กับโทเคนทั้งหมดที่ส่งและรับ วางโครงสร้างพรอมต์ของคุณเพื่อใช้ขีดจำกัด 100k อย่างมีประสิทธิภาพสูงสุด
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.cheapaiapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);ถาม-ตอบ
อ่านเอกสารAPI นี้เข้ากันได้กับ SDK ของ OpenAI หรือไม่?
ใช่ ใช้รูปแบบ chat completions ที่เข้ากันได้กับ OpenAI มาตรฐาน คุณเพียงอัปเดต base URL และ API key ในการกำหนดค่าไคลเอนต์ที่มีอยู่
เกิดอะไรขึ้นหากเครดิตของฉันหมด?
คำขอจะส่งข้อผิดพลาด 402 คุณสามารถเติมเงินด้วยคริปโต (USDT หรือ USDC) เริ่มต้นที่ $10 เครดิตไม่หมดอายุ ดังนั้นคุณสามารถเติมเงินเมื่อสะดวก
โมเดลปฏิเสธเนื้อหาหรือไม่?
โมเดลไม่เซ็นเซอร์สำหรับเนื้อหาผู้ใหญ่ กฎหมาย นามสมมติ และหัวข้อที่ถกเถียงได้ มันบล็อกเฉพาะเนื้อหาทางเพศที่เกี่ยวข้องกับเด็ก ซึ่งเป็นขีดจำกัดที่เข้มงวด
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน base URL นั่นคือการตั้งค่าทั้งหมด
https://api.cheapaiapis.com/v1
ข้อมูลจำเพาะ API
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.cheapaiapis.com/v1 |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| ID โมเดล | uncensored |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| โหมด JSON | response_format: {"type": "json_object"} |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |