Schnellstart: Integriere unsere günstige KI-API
Erstelle mit unserer unzensierten LLM-API in Minuten Text mit dem Standardformat für OpenAI-kompatible Chat-Vervollständigungen. Diese Anleitung behandelt Authentifizierung, einfache Anfragen, Streaming und Function Calling ohne Anbieterbindung.
Probiere es mit einer einzigen Anfrage aus
- Base-URL
https://api.cheapaiapis.com/v1- Modell
uncensored
Authentifizierung & Basis-URL
To use our cheap ai api, you need an API key from your dashboard. All requests target the base URL https://api.cheapaiapis.com/v1. This ensures compatibility with existing OpenAI SDKs and clients.
Füge deinen Schlüssel im Authorization-Header als Bearer-Token ein. Wenn der Schlüssel ungültig ist, erhältst du einen 401-Fehler. Wenn dein Prepaid-Guthaben aufgebraucht ist, erhältst du einen 402-Fehler. Registriere dich unter API-Schlüssel erhalten, um dein Token sofort zu erhalten.
Die Modellkennung für unser unzensiertes LLM ist einfach „unzensiert“. Dieses einzelne Modell übernimmt alle Textgenerierungsaufgaben ohne Routing-Overhead.
curl https://api.cheapaiapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Standard-Chat-Vervollständigungen
Der chat completions api-Endpunkt akzeptiert POST-Anfragen mit einem messages-Array. Jede Nachricht benötigt eine Rolle (system, user oder assistant) und Inhalt. Diese Struktur ermöglicht Mehrfach-Dialoge oder Single-Shot-Prompts.
Unsere Infrastruktur verarbeitet Texteingaben und gibt Textausgaben effizient zurück. Das Modell ist auf Flexibilität abgestimmt und behandelt verschiedene Themen ohne unnötige Ablehnungen für legale erwachsene Inhalte. Anforderungstexte sind auf 8 MB begrenzt.
Verwende das Python-SDK für eine schnelle Integration. Der Client verarbeitet automatisch die Serialisierung und HTTP-Anfragen.
from openai import OpenAI
client = OpenAI(base_url="https://api.cheapaiapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Streaming-Antworten (SSE)
Für Anwendungen, die Echtzeit-Feedback erfordern, aktiviere das Streaming, indem du stream: true festlegst. Die API gibt Server-Sent Events (SSE) zurück, die teilweise Token-Chunks enthalten.
Dieser Ansatz reduziert die wahrgenommene Latenz für Endbenutzer. Du verarbeit jeden Chunk, sobald er eintrifft, und stellst die endgültige Antwort zusammen. Das Streaming funktioniert mit allen Standard-OpenAI-kompatiblen Clients, die für SSE konfiguriert sind.
Achte auf das Limit von 300 Anfragen pro Minute pro Schlüssel. Das Streaming umgeht keine Ratenlimits; es ändert nur, wie Daten geliefert werden.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Unterstützung für Function Calling
Unsere function calling api-Implementierung erlaubt es dir, Tools in der Anfrage zu definieren. Das Modell gibt strukturiertes JSON zurück, das deinem Schema entspricht, und ermöglicht programmatische Aktionen.
Definiere Funktionen mit Namen, Beschreibungen und Parameterschemata. Die API antwortet mit Tool-Aufrufen, die du ausführst, und übergibst Ergebnisse zurück an das Modell für eine endgültige Antwort. Dies hält die Logik von der Generierung getrennt.
Stelle sicher, dass deine Funktionsdefinitionen gültiges JSON sind. Fehler in der Sstruktur können dazu führen, dass das Modell fehlerhafte Tool-Aufrufe zurückgibt.
Modellauflistung & Token
Verwende GET /v1/models, um verfügbare Modelle abzurufen. Du siehst das Modell „unzensiert“ mit seinen spezifischen Fähigkeiten aufgelistet.
Das Modell unterstützt ein Kontextfenster von 100.000 Token, das Prompt- und Completion-Token kombiniert. Dies ermöglicht die Verarbeitung umfangreicher Dokumente oder langer Gespräche ohne sofortige Kürzung.
Die Preise sind transparent: 0,25 $ pro 1 Mio. Input-Token und 1,00 $ pro 1 Mio. Output-Token. Guthaben verfällt nie, also zahlst du nur für das, was du nutzt.
Grenzen, Fehler & Kontext
Überwache deine Nutzung über das Dashboard. Die API erzwingt ein Limit von 300 Anfragen pro Minute pro Schlüssel. Das Überschreiten führt zu einem 429-Fehler. Generiere deinen Schlüssel bei Bedarf neu, um den Status zurückzusetzen.
Häufige Fehler sind 401 (ungültiger Schlüssel), 402 (unzureichende Mittel) und 429 (Ratenlimit). Behandle diese immer angemessen in deinem Client-Code.
Grenzen des Kontextfensters gelten für die Gesamtzahl der gesendeten und empfangenen Token. Plane deine Prompt-Struktur so, dass du das Limit von 100k effizient nutzt.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.cheapaiapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Fragen und Antworten
Dokumentation lesenIst diese API mit OpenAI-SDKs kompatibel?
Ja, sie verwendet das Standardformat für OpenAI-kompatible Chat-Vervollständigungen. Du musst nur die Basis-URL und den API-Schlüssel in deiner bestehenden Client-Konfiguration aktualisieren.
Was passiert, wenn mein Guthaben aufgebraucht ist?
Anfragen geben einen 402-Fehler zurück. Du kannst mit Kryptowährung (USDT oder USDC) ab 10 $ aufladen. Guthaben verfällt nie, also kannst du Geld hinzufügen, wann es dir passt.
Lehnt das Modell Inhalte ab?
Das Modell ist unzensiert für legale erwachsene, fiktive und kontroverse Themen. Es blockiert nur sexuellen Inhalt, der Minderjährige betrifft, was eine harte Grenze ist.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.
https://api.cheapaiapis.com/v1
Funktionen und Limits
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.cheapaiapis.com/v1 |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| JSON-Modus | response_format: {"type": "json_object"} |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Anfragegröße | bis 8 MB |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |