PT ▾
Obter chave de API

Início rápido: integre nossa API de IA barata

Comece a gerar texto com nossa API de LLM sem censura em minutos usando o formato padrão compatível com OpenAI. Este guia cobre autenticação, requisições básicas, streaming e chamada de funções, sem lock-in de fornecedor.

Teste com uma única requisição

URL base
https://api.cheapaiapis.com/v1
Modelo
uncensored
Obter chave de API

Autenticação e URL base

Para usar nossa API de IA barata, você precisa de uma chave de API no seu painel. Todas as requisições apontam para a URL base https://api.cheapaiapis.com/v1. Isso garante compatibilidade com SDKs e clientes existentes da OpenAI.

Inclua sua chave no cabeçalho Authorization como token Bearer. Se a chave for inválida, você receberá um erro 401. Se o seu crédito pré-pago se esgotar, você receberá um erro 402. Registre-se em Get API key para receber seu token imediatamente.

O identificador do modelo para nosso LLM sem censura é simplesmente "uncensored". Este único modelo lida com todas as tarefas de geração de texto sem sobrecarga de roteamento.

curl https://api.cheapaiapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Chat completions padrão

O endpoint chat completions api aceita requisições POST com um array de mensagens. Cada mensagem requer uma role (system, user ou assistant) e conteúdo. Essa estrutura permite conversas em múltiplas rodadas ou prompts de única rodada.

Nossa infraestrutura processa entrada de texto e retorna saída de texto de forma eficiente. O modelo é ajustado para flexibilidade, lidando com diversos tópicos sem recusas desnecessárias para conteúdo adulto lícito. Os corpos das requisições são limitados a 8 MB.

Use o SDK Python para integrar rapidamente. O cliente lida automaticamente com serialização e requisições HTTP.

from openai import OpenAI

client = OpenAI(base_url="https://api.cheapaiapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Respostas em streaming (SSE)

Para aplicações que exigem feedback em tempo real, ative o streaming definindo stream: true. A API retorna Server-Sent Events (SSE) contendo chunks parciais de tokens.

Essa abordagem reduz a latência percebida para usuários finais. Você processa cada chunk conforme ele chega, montando a resposta final. O streaming funciona com todos os clientes compatíveis com OpenAI configurados para SSE.

Esteja ciente do limite de 300 requisições por minuto por chave. O streaming não contorna os limites de requisições; ele apenas altera a forma como os dados são entregues.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Suporte a chamada de funções

Nossa implementação da API de chamada de funções permite que você defina ferramentas na requisição. O modelo retorna JSON estruturado correspondente ao seu esquema, permitindo ações programáticas.

Defina funções com nomes, descrições e schemas de parâmetros. A API responde com tool_calls que você executa e, em seguida, passa os resultados de volta ao modelo para uma resposta final. Isso mantém a lógica separada da geração.

Certifique-se de que suas definições de função sejam JSON válidos. Erros na estrutura do esquema podem fazer o modelo retornar chamadas de ferramentas malformadas.

Listagem de modelos e tokens

Use GET /v1/models para recuperar modelos disponíveis. Você verá o modelo "uncensored" listado com suas capacidades específicas.

O modelo suporta uma janela de contexto de 100.000 tokens, combinando tokens de prompt e de resposta. Isso permite o processamento extensivo de documentos ou conversas longas sem truncamento imediato.

O preço é transparente: $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída. Os créditos nunca expiram, então você paga apenas pelo que usa.

Limites, erros e contexto

Monitore seu uso pelo painel. A API impõe um limite de 300 requisições por minuto por chave. Exceder isso resulta em erro 429. Regere sua chave se necessário para redefinir o estado.

Erros comuns incluem 401 (chave inválida), 402 (fundos insuficientes) e 429 (limite de requisições). Sempre trate esses erros de forma adequada no seu código de cliente.

Os limites da janela de contexto aplicam-se aos tokens totais enviados e recebidos. Planeje sua estrutura de prompt para maximizar o limite de 100k de forma eficiente.

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.cheapaiapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Perguntas e respostas

Ler a documentação
Esta API é compatível com SDKs da OpenAI?

Sim, ele usa o formato padrão de chat completions compatível com OpenAI. Você só precisa atualizar a URL base e a chave de API na configuração do seu cliente existente.

O que acontece se eu ficar sem crédito?

As requisições retornarão um erro 402. Você pode recarregar com criptomoeda (USDT ou USDC) a partir de $10. Os créditos nunca expiram, então você pode adicionar fundos quando for conveniente.

O modelo recusa conteúdo?

O modelo é sem censura para tópicos adultos lícitos, fictícios e controversos. Ele apenas bloqueia conteúdo sexual envolvendo menores, o que é um limite rígido.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API

https://api.cheapaiapis.com/v1

Recursos e limites

Uma tabela com cada limite, recurso e preço.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.cheapaiapis.com/v1
AutenticaçãoAuthorization: Bearer YOUR_KEY
ID do modelouncensored
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Modo JSONresponse_format: {"type": "json_object"}
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Janela de contexto100.000 tokens (entrada + saída)
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Limite de taxa300 requisições por minuto por chave
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concorrência8 requisições ao mesmo tempo por chave
Tamanhoaté 8 MB por requisição
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Validadecrédito pago não expira, sem assinatura
Bônus+5% a partir de $50, +10% a partir de $100
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Chavesuma chave ativa por conta; uma nova substitui a anterior
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
LoginGoogle ou e-mail e senha

Códigos de erro

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos