KO ▾
API 키 받기

빠른 시작: 저렴한 AI API 통합

표준 OpenAI 호환 형식을 사용하여 몇 분 안에 무검열 LLM API로 텍스트 생성을 시작하세요. 이 가이드는 인증, 기본 요청, 스트리밍 및 벤더 종속성 없는 함수 호출을 다룹니다.

요청 한 번으로 시험해 보세요

기본 URL
https://api.cheapaiapis.com/v1
모델
uncensored
API 키 받기

인증 및 기본 URL

To use our cheap ai api, you need an API key from your dashboard. All requests target the base URL https://api.cheapaiapis.com/v1. This ensures compatibility with existing OpenAI SDKs and clients.

Authorization 헤더에 Bearer 토큰으로 키를 포함하세요. 키가 유효하지 않으면 401 오류가 발생합니다. 선불 크레딧이 고갈되면 402 오류가 발생합니다. Get API key에서 등록하여 토큰을 즉시 받으세요.

무검열 LLM의 모델 식별자는 "uncensored"입니다. 이 단일 모델은 라우팅 오버헤드 없이 모든 텍스트 생성 작업을 처리합니다.

curl https://api.cheapaiapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

표준 채팅 완료

채팅 완료 api 엔드포인트는 messages 배열이 포함된 POST 요청을 받습니다. 각 메시지에는 role(system, user, 또는 assistant)과 content가 필요합니다. 이 구조는 다중 턴 대화 또는 단일 프롬프트를 가능하게 합니다.

인프라는 텍스트 입력을 처리하고 효율적으로 텍스트 출력을 반환합니다. 모델은 유연성을 위해 조정되었으며 합법적인 성인 콘텐츠에 대한 불필요한 거부 없이 다양한 주제를 처리합니다. 요청 본문은 8 MB로 제한됩니다.

Python SDK를 사용하여 빠르게 통합하세요. 클라이언트는 직렬화 및 HTTP 요청을 자동으로 처리합니다.

from openai import OpenAI

client = OpenAI(base_url="https://api.cheapaiapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

스트리밍 응답 (SSE)

실시간 피드백이 필요한 애플리케이션의 경우 stream: true을 설정하여 스트리밍을 활성화하세요. API는 부분 토큰 청크를 포함하는 서버 전송 이벤트(SSE)를 반환합니다.

이 접근 방식은 최종 사용자의 지각된 지연 시간을 줄입니다. 청크가 도착할 때마다 처리하여 최종 응답을 조립합니다. 스트리밍은 SSE가 구성된 모든 표준 OpenAI 호환 클라이언트에서 작동합니다.

키당 분당 300개 요청 제한을 유의하세요. 스트리밍은 속도 제한을 우회하지 않으며 데이터 전달 방식만 변경합니다.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

함수 호출 지원

함수 호출 api 구현을 사용하면 요청에서 도구를 정의할 수 있습니다. 모델은 스키마와 일치하는 구조화된 JSON을 반환하여 프로그래밍 가능한 작업을 가능하게 합니다.

이름, 설명 및 매개변수 스키마로 함수를 정의하세요. API는 실행할 tool calls를 응답하고 결과를 모델에 다시 전달하여 최종 답변을 얻습니다. 이렇게 하면 로직이 생성과 분리됩니다.

함수 정의가 유효한 JSON인지 확인하세요. 스키마 구조의 오류로 인해 모델이 잘못된 tool calls를 반환할 수 있습니다.

모델 목록 및 토큰

사용 가능한 모델을 검색하려면 GET /v1/models을 사용하세요. "uncensored" 모델이 특정 기능과 함께 나열되어 표시됩니다.

모델은 프롬프트 토큰과 완료 토큰을 결합한 100,000 토큰 컨텍스트 창을 지원합니다. 이는 즉각적인 잘림 없이 광범위한 문서 처리 또는 긴 대화를 가능하게 합니다.

가격은 투명합니다: 입력 토큰 100만 개당 $0.25, 출력 토큰 100만 개당 $1.00입니다. 크레딧은 만료되지 않으므로 사용한 만큼만 지불합니다.

제한, 오류 및 컨텍스트

대시보드를 통해 사용량을 모니터링하세요. API는 키당 분당 300개 요청 제한을 적용합니다. 이를 초과하면 429 오류가 발생합니다. 상태를 재설정하려면 키를 재생성하세요.

흔한 오류로는 401(잘못된 키), 402(잔액 부족), 429(속도 제한)이 있습니다. 클라이언트 코드에서 이러한 오류를 적절히 처리하세요.

컨텍스트 창 제한은 전송 및 수신된 총 토큰에 적용됩니다. 100k 제한을 효율적으로 활용하기 위해 프롬프트 구조를 계획하세요.

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.cheapaiapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

질문과 답변

문서 읽기
이 API는 OpenAI SDK와 호환되나요?

네, 표준 OpenAI 호환 채팅 완료 형식을 사용합니다. 기존 클라이언트 구성의 기본 URL과 API 키만 업데이트하면 됩니다.

크레딧이 부족하면 어떻게 되나요?

요청 시 402 오류가 반환됩니다. USDT 또는 USDC로 10달러부터 크리트를 충전할 수 있습니다. 크레딧은 만료되지 않으므로 언제든지 자금을 추가할 수 있습니다.

모델이 콘텐츠를 거부하나요?

모델은 합법적인 성인, 픽션, 논쟁적인 주제에 대해 무검열입니다. 미성년자가 포함된 성적 콘텐츠만 하드 제한으로 차단합니다.

키는 양식 하나만 작성하면 받을 수 있습니다

계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 설정은 이것뿐입니다.

API 키 받기

https://api.cheapaiapis.com/v1

API 사양

크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.

항목내용
형식OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작
엔드포인트POST /v1/chat/completions · GET /v1/models
Base URLhttps://api.cheapaiapis.com/v1
인증Authorization: Bearer YOUR_KEY
모델 IDuncensored
함수 호출지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송
JSON 모드response_format: {"type": "json_object"}
스트리밍지원 — SSE, 마지막 청크에 토큰 사용량 포함
파라미터temperature, top_p, stop, seed, presence_penalty, frequency_penalty
컨텍스트 창100,000 토큰 (입력 + 출력)
최대 출력100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음)
속도 제한키당 분당 300회
응답 헤더X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
동시 요청키당 동시 8개
요청 크기최대 8 MB
무료 체험$0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용
유효기간유료 크레딧은 만료되지 않으며 구독 없음
보너스$50 이상 +5%, $100 이상 +10%
가격입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00
과금선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료
충전USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액
키계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효
콘텐츠성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부
로그인Google 또는 이메일과 비밀번호

오류 코드

오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.

코드유형의미
400bad_request잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과
401missing_key · invalid_key · key_revoked키 없음·잘못됨·새 키로 교체됨
402no_credit잔액 없음 — 충전하면 즉시 재개
403content_blocked미성년자 관련 성적 콘텐츠 — 거부, 과금 없음
404not_found알 수 없는 엔드포인트
413request_too_large본문 8 MB 초과
429rate_limited · concurrency분당 300회 또는 동시 8개 초과 — 잠시 후 재시도
503upstream_busy모델 혼잡 — 몇 초 후 재시도