Inicio rápido: Integra nuestra API de IA económica
Empieza a generar texto con nuestra API LLM sin censura en minutos usando el formato estándar compatible con OpenAI. Esta guía cubre autenticación, peticiones básicas, streaming y llamadas a funciones sin dependencia de proveedor.
Pruébalo con una sola petición
- URL base
https://api.cheapaiapis.com/v1- Modelo
uncensored
Autenticación y URL base
Para usar nuestra cheap ai api, necesitas una clave de API desde tu panel. Todas las peticiones apuntan a la URL base https://api.cheapaiapis.com/v1. Esto garantiza compatibilidad con los SDK y clientes existentes de OpenAI.
Incluye tu clave en el encabezado Authorization como token Bearer. Si la clave no es válida, recibirás un error 401. Si tu crédito prepago se agota, obtienes un error 402. Regístrate en Obtener clave de API para recibir tu token inmediatamente.
El identificador del modelo para nuestro LLM sin censura es simplemente "uncensored". Este único modelo maneja todas las tareas de generación de texto sin sobrecarga de enrutamiento.
curl https://api.cheapaiapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Chat completions estándar
El endpoint chat completions api acepta peticiones POST con un array de messages. Cada mensaje requiere un role (system, user, o assistant) y content. Esta estructura permite conversaciones de múltiples turnos o prompts de un solo disparo.
Nuestra infraestructura procesa entrada de texto y devuelve salida de texto de manera eficiente. El modelo está ajustado para flexibilidad, manejando diversos temas sin rechazos innecesarios para contenido adulto lícito. Los cuerpos de petición están limitados a 8 MB.
Usa el SDK de Python para integrar rápidamente. El cliente maneja automáticamente la serialización y las peticiones HTTP.
from openai import OpenAI
client = OpenAI(base_url="https://api.cheapaiapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Respuestas en streaming (SSE)
Para aplicaciones que requieren retroalimentación en tiempo real, habilita el streaming estableciendo stream: true. La API devuelve Server-Sent Events (SSE) que contienen fragmentos parciales de token.
Este enfoque reduce la latencia percibida para los usuarios finales. Procesa cada fragmento a medida que llega, ensamblando la respuesta final. El streaming funciona con todos los clientes compatibles con OpenAI configurados para SSE.
Ten en cuenta el límite de 300 peticiones por minuto por clave. El streaming no elude los límites de peticiones; solo cambia cómo se entregan los datos.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Soporte para llamadas a funciones
Nuestra implementación de la function calling api te permite definir herramientas en la petición. El modelo devuelve un JSON estructurado que coincide con tu esquema, lo que permite acciones programáticas.
Define funciones con nombres, descripciones y esquemas de parámetros. La API responde con llamadas a tool_calls que ejecutas, luego pasas los resultados de vuelta al modelo para una respuesta final. Esto mantiene la lógica separada de la generación.
Asegúrate de que tus definiciones de función sean JSON válido. Los errores en la estructura del esquema pueden hacer que el modelo devuelva llamadas a tool_calls mal formadas.
Listado de modelos y tokens
Usa GET /v1/models para recuperar modelos disponibles. Verás el modelo "uncensored" listado con sus capacidades específicas.
El modelo admite una ventana de contexto de 100.000 tokens, combinando tokens de prompt y completion. Esto permite procesamiento extenso de documentos o conversaciones largas sin truncamiento inmediato.
La tarifa es transparente: $0,25 por 1M de tokens de entrada y $1,00 por 1M de tokens de salida. Los créditos no caducan, así que pagas solo por lo que usas.
Límites, errores y contexto
Monitorea tu uso a través del panel. La API aplica un límite de 300 peticiones por minuto por clave. Excederlo resulta en un error 429. Regenera tu clave si es necesario para restablecer el estado.
Los errores comunes incluyen 401 (clave inválida), 402 (fondos insuficientes) y 429 (límite de tasa). Maneja siempre estos errores de forma adecuada en tu código cliente.
Los límites de la ventana de contexto se aplican al total de tokens enviados y recibidos. Planifica tu estructura de prompt para maximizar eficientemente el límite de 100k.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.cheapaiapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Preguntas y respuestas
Leer la documentación¿Es esta API compatible con los SDK de OpenAI?
Sí, utiliza el formato estándar de chat completions compatible con OpenAI. Solo necesitas actualizar la URL base y la clave de API en la configuración de tu cliente existente.
¿Qué pasa si me quedo sin crédito?
Las peticiones devolverán un error 402. Puedes recargar con criptomonedas (USDT o USDC) a partir de $10. Los créditos no caducan, así que puedes añadir fondos cuando te convenga.
¿El modelo rechaza contenido?
El modelo es sin censura para temas adultos lícitos, ficticios y controversiales. Solo bloquea contenido sexual que involucre menores, que es un límite estricto.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.
https://api.cheapaiapis.com/v1
Funciones y límites
Una tabla con cada límite, función y precio.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.cheapaiapis.com/v1 |
| Autenticación | Authorization: Bearer YOUR_KEY |
| ID del modelo | uncensored |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Modo JSON | response_format: {"type": "json_object"} |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Límite de peticiones | 300 por minuto por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrencia | 8 peticiones a la vez por clave |
| Tamaño de petición | hasta 8 MB |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Bono | +5 % desde $50, +10 % desde $100 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Acceso | Google o correo y contraseña |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |