Szybki start: Integracja z naszym tanim API AI
Zacznij generować tekst za pomocą naszego modelu LLM bez cenzury w kilka minut, korzystając ze standardowego formatu kompatybilnego z OpenAI. Ten przewodnik obejmuje uwierzytelnianie, podstawowe zapytania, strumieniowanie i wywoływanie funkcji przy zerowym zablokowaniu.
Uwierzytelnianie i bazowy URL
Aby korzystać z naszego taniego API AI, potrzebujesz klucza API z pulpitu nawigacyjnego. Wszystkie zapytania kierują się na bazowy adres URL https://api.cheapaiapis.com/v1. Zapewnia to kompatybilność z istniejącymi SDK i klientami OpenAI.
Dołącz swój klucz w nagłówku Authorization jako token Bearer. Jeśli klucz jest nieprawidłowy, otrzymasz błąd 401. Jeśli wyczerpiesz swój przedpłacony kredyt, otrzymasz błąd 402. Zarejestruj się na stronie Get API key, aby natychmiast otrzymać swój token.
Identyfikator modelu naszego LLM bez cenzury to po prostu "uncensored". Ten pojedynczy model obsługuje wszystkie zadania generowania tekstu bez narzutów routingu.
curl https://api.cheapaiapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Standardowe chat completions
Endpoint chat completions api przyjmuje zapytania POST z tablicą messages. Każda wiadomość wymaga roli (system, user lub assistant) oraz treści. Ta struktura pozwala na rozmowy wieloetapowe lub pojedyncze prompty.
Nasza infrastruktura przetwarza wejście tekstowe i zwraca wyjście tekstowe wydajnie. Model jest dostrojony do elastyczności, obsługując różnorodne tematy bez niepotrzebnych odrzuceń dla legalnych treści dla dorosłych. Ciała żądań są ograniczone do 8 MB.
Użyj SDK Python, aby szybko zintegrować. Klient automatycznie obsługuje serializację i żądania HTTP.
from openai import OpenAI
client = OpenAI(base_url="https://api.cheapaiapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Strumieniowanie odpowiedzi (SSE)
Dla aplikacji wymagających informacji w czasie rzeczywistym włącz strumieniowanie, ustawiając stream: true. API zwraca zdarzenia SSE (Server-Sent Events) zawierające częściowe fragmenty tokenów.
To podejście zmniejsza postrzeganą latencję dla użytkowników końcowych. Przetwarzaj każdy fragment po jego nadejściu, składając ostateczną odpowiedź. Strumieniowanie działa ze wszystkimi standardowymi klientami kompatybilnymi z OpenAI skonfigurowanymi do SSE.
Pamiętaj o limicie 300 zapytań na minutę na klucz. Strumieniowanie nie omija limitów zapytań; zmienia tylko sposób dostarczania danych.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Wsparcie dla wywoływania funkcji
Nasza implementacja wywoływanie funkcji api pozwala zdefiniować narzędzia w zapytaniu. Model zwraca strukturalny JSON zgodny z Twoim schematem, umożliwiając działania programistyczne.
Zdefiniuj funkcje z nazwami, opisami i schematami parametrów. API odpowiada wywołaniami narzędzi, które wykonujesz, a następnie przekazujesz wyniki z powrotem do modelu w celu uzyskania ostatecznej odpowiedzi. To oddziela logikę od generowania.
Upewnij się, że definicje Twoich funkcji są poprawnym JSON. Błędy w strukturze schematu mogą spowodować, że model zwróci niepoprawne wywołania narzędzi.
Lista modeli i tokeny
Użyj GET /v1/models, aby pobrać dostępne modele. Zobaczysz model "uncensored" na liście z jego konkretnymi możliwościami.
Model obsługuje okno kontekstu 100 000 tokenów, łączące tokeny promptu i uzupełnienia. Pozwala to na przetwarzanie rozległych dokumentów lub długie rozmowy bez natychmiastowego przycinania.
Cennik jest przejrzysty: $0,25 za 1M tokenów wejściowych i $1,00 za 1M tokenów wyjściowych. Kredyty nigdy nie wygasają, więc płacisz tylko za to, czego używasz.
Limity, błędy i kontekst
Monitoruj swoje zużycie przez panel. API narzuca limit 300 zapytań na minutę na klucz. Przekroczenie tego wyniku spowoduje błąd 429. Wygeneruj ponownie klucz, jeśli jest to konieczne, aby zresetować stan.
Typowe błędy to 401 (nieprawidłowy klucz), 402 (niewystarczające środki) i 429 (limit zapytań). Zawsze obsługuj je poprawnie w kodzie klienta.
Limity okna kontekstu dotyczą całkowitej liczby tokenów wysłanych i odebranych. Zaplanuj strukturę promptu, aby maksymalnie wykorzystać limit 100k.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.cheapaiapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Pytania i odpowiedzi
Czytaj dokumentacjęCzy to API jest kompatybilne z SDK OpenAI?
Tak, korzysta ze standardowego formatu chat completions kompatybilnego z OpenAI. Musisz tylko zaktualizować bazowy adres URL i klucz API w konfiguracji istniejącego klienta.
Co się stanie, gdy zabraknie kredytu?
Zapytania zwrócą błąd 402. Możesz doładować środki kryptowalutą (USDT lub USDC) od kwoty $10. Kredyty nigdy nie wygasają, więc możesz doładować środki w dowolnym momencie.
Czy model odrzuca treści?
Model jest bez cenzury dla legalnych treści dla dorosłych, fikcyjnych i kontrowersyjnych. Blokuje tylko treści seksualne z udziałem małoletnich, co jest twardym limitem.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.
https://api.cheapaiapis.com/v1
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.cheapaiapis.com/v1 |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| ID modelu | uncensored |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Tryb JSON | response_format: {"type": "json_object"} |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Rozmiar zapytania | do 8 MB |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Bonus | +5% od $50, +10% od $100 |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |