Bắt đầu nhanh: Tích hợp API AI giá rẻ của chúng tôi
Bắt đầu tạo văn bản với API LLM không kiểm duyệt của chúng tôi trong vài phút bằng định dạng tương thích OpenAI. Hướng dẫn này bao gồm xác thực, yêu cầu cơ bản, streaming và gọi hàm mà không bị khóa nhà cung cấp.
Xác thực & Base URL
Để sử dụng API AI giá rẻ của chúng tôi, bạn cần một khóa API từ bảng điều khiển của bạn. Tất cả các yêu cầu đều nhắm vào base URL https://api.cheapaiapis.com/v1. Điều này đảm bảo tương thích với các SDK và client OpenAI hiện có.
Bao gồm khóa của bạn trong tiêu đề Authorization dưới dạng token Bearer. Nếu khóa không hợp lệ, bạn sẽ nhận được lỗi 401. Nếu tín dụng trả trước của bạn đã cạn kiệt, bạn sẽ nhận được lỗi 402. Đăng ký tại Lấy khóa API để nhận token của bạn ngay lập tức.
Mã định danh mô hình cho LLM không kiểm duyệt của chúng tôi đơn giản là "uncensored". Mô hình đơn lẻ này xử lý tất cả các tác vụ tạo văn bản mà không có chi phí định tuyến.
curl https://api.cheapaiapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Chat Completions Tiêu chuẩn
Endpoint chat completions api chấp nhận các yêu cầu POST với một mảng messages. Mỗi message yêu cầu một role (system, user hoặc assistant) và nội dung. Cấu trúc này cho phép các cuộc hội thoại nhiều lượt hoặc các prompt đơn.
Cơ sở hạ tầng của chúng tôi xử lý đầu vào văn bản và trả về đầu ra văn bản một cách hiệu quả. Mô hình được tinh chỉnh để linh hoạt, xử lý các chủ đề đa dạng mà không từ chối không cần thiết đối với nội dung người trưởng thành hợp pháp. Thân yêu cầu được giới hạn ở 8 MB.
Sử dụng SDK Python để tích hợp nhanh chóng. Client tự động xử lý việc tuần tự hóa và các yêu cầu HTTP.
from openai import OpenAI
client = OpenAI(base_url="https://api.cheapaiapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Phản hồi Streaming (SSE)
Đối với các ứng dụng yêu cầu phản hồi thời gian thực, hãy bật streaming bằng cách đặt stream: true. API trả về các Sự kiện do Máy chủ Gửi (SSE) chứa các chunk token một phần.
Phương pháp này giảm độ trễ cảm nhận đối với người dùng cuối. Bạn xử lý từng chunk khi nó đến, lắp ráp phản hồi cuối cùng. Streaming hoạt động với tất cả các client tương thích OpenAI được cấu hình cho SSE.
Hãy lưu ý giới hạn 300 yêu cầu mỗi phút trên mỗi khóa. Streaming không bỏ qua giới hạn tốc độ; nó chỉ thay đổi cách dữ liệu được gửi.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Hỗ trợ Gọi hàm
Cài đặt gọi hàm api của chúng tôi cho phép bạn xác định các công cụ trong yêu cầu. Mô hình trả về JSON có cấu trúc khớp với lược đồ của bạn, cho phép các hành động lập trình.
Xác định các hàm với tên, mô tả và lược đồ tham số. API phản hồi với các tool_calls mà bạn thực thi, sau đó truyền kết quả lại cho mô hình để có câu trả lời cuối cùng. Điều này giữ cho logic tách biệt với việc tạo nội dung.
Đảm bảo các định nghĩa hàm của bạn là JSON hợp lệ. Lỗi trong cấu trúc lược đồ có thể khiến mô hình trả về các tool_calls bị lỗi.
Danh sách Mô hình & Token
Sử dụng GET /v1/models để lấy các mô hình có sẵn. Bạn sẽ thấy mô hình "uncensored" được liệt kê với các khả năng cụ thể của nó.
Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token, kết hợp các token prompt và completion. Điều này cho phép xử lý tài liệu rộng rãi hoặc các cuộc hội thoại dài mà không bị cắt ngắn ngay lập tức.
Giá cả minh bạch: $0,25 cho mỗi 1M token đầu vào và $1,00 cho mỗi 1M token đầu ra. Tín dụng không bao giờ hết hạn, vì vậy bạn chỉ trả tiền cho những gì bạn sử dụng.
Giới hạn, Lỗi & Ngữ cảnh
Theo dõi mức sử dụng của bạn qua bảng điều khiển. API áp dụng giới hạn 300 yêu cầu mỗi phút trên mỗi khóa. Vượt quá giới hạn này sẽ dẫn đến lỗi 429. Tạo lại khóa của bạn nếu cần để đặt lại trạng thái.
Các lỗi phổ biến bao gồm 401 (khóa không hợp lệ), 402 (không đủ tiền) và 429 (giới hạn tốc độ). Luôn xử lý các lỗi này một cách duyên dáng trong mã client của bạn.
Giới hạn cửa sổ ngữ cảnh áp dụng cho tổng số token gửi và nhận. Hãy lập kế hoạch cấu trúc prompt của bạn để tối đa hóa giới hạn 100k một cách hiệu quả.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.cheapaiapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Hỏi đáp
Đọc tài liệuAPI này có tương thích với SDK OpenAI không?
Có, API sử dụng định dạng chat completions tương thích chuẩn OpenAI. Bạn chỉ cần cập nhật base URL và khóa API trong cấu hình client hiện có.
Điều gì xảy ra nếu tôi hết tín dụng?
Các yêu cầu sẽ trả về lỗi 402. Bạn có thể nạp tiền bằng tiền điện tử (USDT hoặc USDC) bắt đầu từ $10. Tín dụng không bao giờ hết hạn, vì vậy bạn có thể thêm tiền bất cứ khi nào thuận tiện.
Mô hình có từ chối nội dung không?
Mô hình không kiểm duyệt đối với các chủ đề người trưởng thành hợp pháp, hư cấu và gây tranh cãi. Nó chỉ chặn nội dung tình dục liên quan đến trẻ vị thành niên, đây là giới hạn cứng.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ quá trình thiết lập.
https://api.cheapaiapis.com/v1
Thông số API
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.cheapaiapis.com/v1 |
| Xác thực | Authorization: Bearer YOUR_KEY |
| ID mô hình | uncensored |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Kích thước yêu cầu | tối đa 8 MB |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Thưởng | +5% từ $50, +10% từ $100 |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
| Đăng nhập | Google hoặc email và mật khẩu |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |