PL ▾
Pobierz klucz API

Szybki start: Integracja z naszym tanim API AI

Zacznij generować tekst za pomocą naszego modelu LLM bez cenzury w kilka minut, korzystając ze standardowego formatu kompatybilnego z OpenAI. Ten przewodnik obejmuje uwierzytelnianie, podstawowe zapytania, strumieniowanie i wywoływanie funkcji przy zerowym zablokowaniu.

Wypróbuj jednym zapytaniem

Bazowy URL
https://api.cheapaiapis.com/v1
Model
uncensored
Pobierz klucz API

Uwierzytelnianie i bazowy URL

Aby korzystać z naszego taniego API AI, potrzebujesz klucza API z pulpitu nawigacyjnego. Wszystkie zapytania kierują się na bazowy adres URL https://api.cheapaiapis.com/v1. Zapewnia to kompatybilność z istniejącymi SDK i klientami OpenAI.

Dołącz swój klucz w nagłówku Authorization jako token Bearer. Jeśli klucz jest nieprawidłowy, otrzymasz błąd 401. Jeśli wyczerpiesz swój przedpłacony kredyt, otrzymasz błąd 402. Zarejestruj się na stronie Get API key, aby natychmiast otrzymać swój token.

Identyfikator modelu naszego LLM bez cenzury to po prostu "uncensored". Ten pojedynczy model obsługuje wszystkie zadania generowania tekstu bez narzutów routingu.

curl https://api.cheapaiapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Standardowe chat completions

Endpoint chat completions api przyjmuje zapytania POST z tablicą messages. Każda wiadomość wymaga roli (system, user lub assistant) oraz treści. Ta struktura pozwala na rozmowy wieloetapowe lub pojedyncze prompty.

Nasza infrastruktura przetwarza wejście tekstowe i zwraca wyjście tekstowe wydajnie. Model jest dostrojony do elastyczności, obsługując różnorodne tematy bez niepotrzebnych odrzuceń dla legalnych treści dla dorosłych. Ciała żądań są ograniczone do 8 MB.

Użyj SDK Python, aby szybko zintegrować. Klient automatycznie obsługuje serializację i żądania HTTP.

from openai import OpenAI

client = OpenAI(base_url="https://api.cheapaiapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Strumieniowanie odpowiedzi (SSE)

Dla aplikacji wymagających informacji w czasie rzeczywistym włącz strumieniowanie, ustawiając stream: true. API zwraca zdarzenia SSE (Server-Sent Events) zawierające częściowe fragmenty tokenów.

To podejście zmniejsza postrzeganą latencję dla użytkowników końcowych. Przetwarzaj każdy fragment po jego nadejściu, składając ostateczną odpowiedź. Strumieniowanie działa ze wszystkimi standardowymi klientami kompatybilnymi z OpenAI skonfigurowanymi do SSE.

Pamiętaj o limicie 300 zapytań na minutę na klucz. Strumieniowanie nie omija limitów zapytań; zmienia tylko sposób dostarczania danych.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Wsparcie dla wywoływania funkcji

Nasza implementacja wywoływanie funkcji api pozwala zdefiniować narzędzia w zapytaniu. Model zwraca strukturalny JSON zgodny z Twoim schematem, umożliwiając działania programistyczne.

Zdefiniuj funkcje z nazwami, opisami i schematami parametrów. API odpowiada wywołaniami narzędzi, które wykonujesz, a następnie przekazujesz wyniki z powrotem do modelu w celu uzyskania ostatecznej odpowiedzi. To oddziela logikę od generowania.

Upewnij się, że definicje Twoich funkcji są poprawnym JSON. Błędy w strukturze schematu mogą spowodować, że model zwróci niepoprawne wywołania narzędzi.

Lista modeli i tokeny

Użyj GET /v1/models, aby pobrać dostępne modele. Zobaczysz model "uncensored" na liście z jego konkretnymi możliwościami.

Model obsługuje okno kontekstu 100 000 tokenów, łączące tokeny promptu i uzupełnienia. Pozwala to na przetwarzanie rozległych dokumentów lub długie rozmowy bez natychmiastowego przycinania.

Cennik jest przejrzysty: $0,25 za 1M tokenów wejściowych i $1,00 za 1M tokenów wyjściowych. Kredyty nigdy nie wygasają, więc płacisz tylko za to, czego używasz.

Limity, błędy i kontekst

Monitoruj swoje zużycie przez panel. API narzuca limit 300 zapytań na minutę na klucz. Przekroczenie tego wyniku spowoduje błąd 429. Wygeneruj ponownie klucz, jeśli jest to konieczne, aby zresetować stan.

Typowe błędy to 401 (nieprawidłowy klucz), 402 (niewystarczające środki) i 429 (limit zapytań). Zawsze obsługuj je poprawnie w kodzie klienta.

Limity okna kontekstu dotyczą całkowitej liczby tokenów wysłanych i odebranych. Zaplanuj strukturę promptu, aby maksymalnie wykorzystać limit 100k.

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.cheapaiapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Pytania i odpowiedzi

Czytaj dokumentację
Czy to API jest kompatybilne z SDK OpenAI?

Tak, korzysta ze standardowego formatu chat completions kompatybilnego z OpenAI. Musisz tylko zaktualizować bazowy adres URL i klucz API w konfiguracji istniejącego klienta.

Co się stanie, gdy zabraknie kredytu?

Zapytania zwrócą błąd 402. Możesz doładować środki kryptowalutą (USDT lub USDC) od kwoty $10. Kredyty nigdy nie wygasają, więc możesz doładować środki w dowolnym momencie.

Czy model odrzuca treści?

Model jest bez cenzury dla legalnych treści dla dorosłych, fikcyjnych i kontrowersyjnych. Blokuje tylko treści seksualne z udziałem małoletnich, co jest twardym limitem.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.

Pobierz klucz API

https://api.cheapaiapis.com/v1

Parametry API

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
EndpointyPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.cheapaiapis.com/v1
UwierzytelnianieAuthorization: Bearer YOUR_KEY
ID modeluuncensored
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Tryb JSONresponse_format: {"type": "json_object"}
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Limit zapytań300 zapytań na minutę na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Równoległe zapytaniado 8 jednocześnie na klucz
Rozmiar zapytaniado 8 MB
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Bonus+5% od $50, +10% od $100
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane
LogowanieGoogle albo e-mail i hasło

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund