Démarrage rapide : Intégrez notre API IA à bas prix
Commencez à générer du texte avec notre API LLM sans censure en quelques minutes en utilisant le format standard compatible OpenAI. Ce guide couvre l'authentification, les requêtes de base, le streaming et l'appel de fonctions sans dépendance à un fournisseur.
Essayez avec une seule requête
- URL de base
https://api.cheapaiapis.com/v1- Modèle
uncensored
Authentification et URL de base
Pour utiliser notre API IA à bas prix, vous avez besoin d'une clé API depuis votre tableau de bord. Toutes les requêtes ciblent l'URL de base https://api.cheapaiapis.com/v1. Cela garantit la compatibilité avec les SDK et clients OpenAI existants.
Incluez votre clé dans l'en-tête Authorization en tant que jeton Bearer. Si la clé est invalide, vous recevrez une erreur 401. Si votre crédit prépayé est épuisé, vous recevrez une erreur 402. Inscrivez-vous à Get API key pour recevoir votre token immédiatement.
L'identifiant du modèle de notre LLM sans censure est simplement "uncensored". Ce modèle unique gère toutes les tâches de génération de texte sans frais de routage.
curl https://api.cheapaiapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Complétions de chat standard
L'endpoint chat completions api accepte les requêtes POST avec un tableau de messages. Chaque message nécessite un rôle (system, user ou assistant) et un contenu. Cette structure permet des conversations multi-tours ou des prompts single-shot.
Notre infrastructure traite l'entrée textuelle et renvoie une sortie textuelle efficacement. Le modèle est ajusté pour la flexibilité, gérant des sujets divers sans refus superflus pour le contenu adulte légal. Les corps de requête sont limités à 8 Mo.
Utilisez le SDK Python pour une intégration rapide. Le client gère automatiquement la sérialisation et les requêtes HTTP.
from openai import OpenAI
client = OpenAI(base_url="https://api.cheapaiapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Réponses en streaming (SSE)
Pour les applications nécessitant une rétroaction en temps réel, activez le streaming en définissant stream: true. L'API renvoie des Server-Sent Events (SSE) contenant des parties de tokens partielles.
Cette approche réduit la latence perçue pour les utilisateurs finaux. Vous traitez chaque bloc à mesure qu'il arrive, en assemblant la réponse finale. Le streaming fonctionne avec tous les clients OpenAI compatibles configurés pour les SSE.
Soyez conscient de la limite de 300 requêtes par minute par clé. Le streaming ne contourne pas les limites de débit ; il modifie uniquement la manière dont les données sont livrées.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Support de l'appel de fonctions
Notre API d'appel de fonctions vous permet de définir des outils dans la requête. Le modèle renvoie du JSON structuré conforme à votre schéma, ce qui permet d'exécuter des actions programmatiques.
Définissez des fonctions avec des noms, des descriptions et des schémas de paramètres. L'API répond avec des tool_calls que vous exécutez, puis transmettez les résultats au modèle pour une réponse finale. Cela garde la logique séparée de la génération.
Assurez-vous que vos définitions de fonctions sont du JSON valide. Les erreurs de structure de schéma peuvent amener le modèle à renvoyer des tool_calls mal formés.
Liste des modèles et tokens
Utilisez GET /v1/models pour récupérer les modèles disponibles. Vous verrez le modèle "uncensored" listé avec ses capacités spécifiques.
Le modèle prend en charge une fenêtre de contexte de 100 000 tokens, combinant les tokens de prompt et de complétion. Cela permet un traitement de documents étendu ou des conversations longues sans troncation immédiate.
La tarification est transparente : 0,25 $ par 1 M de tokens d'entrée et 1,00 $ par 1 M de tokens de sortie. Les crédits n'expirent jamais, vous ne payez que ce que vous utilisez.
Limites, erreurs et contexte
Surveillez votre utilisation via le tableau de bord. L'API applique une limite de 300 requêtes par minute par clé. Le dépassement de cette limite entraîne une erreur 429. Régénérez votre clé si nécessaire pour réinitialiser l'état.
Les erreurs courantes incluent 401 (clé invalide), 402 (fonds insuffisants) et 429 (limite de débit). Gérez toujours ces erreurs avec élégance dans votre code client.
Les limites de la fenêtre de contexte s'appliquent au total des tokens envoyés et reçus. Planifiez la structure de votre prompt pour maximiser efficacement la limite de 100 k.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.cheapaiapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Questions et réponses
Lire la documentationCette API est-elle compatible avec les SDK OpenAI ?
Oui, elle utilise le format standard de complétions de chat compatible OpenAI. Vous devez simplement mettre à jour l'URL de base et la clé API dans votre configuration client existante.
Que se passe-t-il si je manque de crédit ?
Les requêtes renverront une erreur 402. Vous pouvez recharger avec de la cryptomonnaie (USDT ou USDC) à partir de 10 $. Les crédits n'expirent jamais, vous pouvez donc ajouter des fonds quand vous le souhaitez.
Le modèle refuse-t-il du contenu ?
Le modèle est sans censure pour les sujets adultes légaux, fictifs et controversés. Il bloque uniquement le contenu sexuel impliquant des mineurs, ce qui est une limite stricte.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, changez l'URL de base. C'est toute la configuration.
https://api.cheapaiapis.com/v1
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.cheapaiapis.com/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| ID du modèle | uncensored |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Mode JSON | response_format: {"type": "json_object"} |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Limite de débit | 300 requêtes par minute et par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrence | 8 requêtes simultanées par clé |
| Taille | jusqu'à 8 Mo par requête |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |