JA ▾
API キーを取得

クイックスタート:お手頃なAI APIの統合

標準的なOpenAI互換フォーマットを使用して、数分で無検閲LLM APIによるテキスト生成を開始できます。このガイドでは、認証、基本リクエスト、ストリーミング、ベンダーロックインゼロの関数呼び出しを扱います。

1 回のリクエストで試す

ベース URL
https://api.cheapaiapis.com/v1
モデル
uncensored
API キーを取得

認証とベースURL

cheap ai apiを利用するには、ダッシュボードからAPIキーを取得する必要があります。すべてのリクエストはベースURL https://api.cheapaiapis.com/v1 を対象とします。これにより、既存のOpenAI SDKやクライアントとの互換性が確保されます。

キーをAuthorizationヘッダーにBearerトークンとして含めてください。キーが無効な場合は401エラーが返されます。前払いクレジットが枯渇した場合は402エラーになります。Get API keyで登録すると、すぐにトークンを受け取れます。

無検閲LLMのモデル識別子は「uncensored」のみです。この単一モデルはルーティングオーバーヘッドなしですべてのテキスト生成タスクを処理します。

curl https://api.cheapaiapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

標準チャット完了

チャット完了APIエンドポイントは、messages配列を持つPOSTリクエストを受け付けます。各メッセージにはrole(system、user、またはassistant)とcontentが必要です。この構造により、マルチターン会話や単一ショットプロンプトが可能になります。

当社のインフラはテキスト入力を処理し、効率的にテキスト出力を返します。モデルは柔軟性のためにチューニングされており、法的な成人コンテンツに対して不要な拒否なしで多様なトピックを処理します。リクエストボディは8 MBに制限されます。

Python SDKを使用して迅速に統合できます。クライアントはシリアライゼーションとHTTPリクエストを自動的に処理します。

from openai import OpenAI

client = OpenAI(base_url="https://api.cheapaiapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

ストリーミングレスポンス(SSE)

リアルタイムフィードバックが必要なアプリケーションでは、stream: trueを設定してストリーミングを有効にします。APIは部分的なトークンチャンクを含むServer-Sent Events(SSE)を返します。

このアプローチはエンドユーザーの知覚されるレイテンシーを削減します。各チャンクを受信するたびに処理し、最終的なレスポンスを組み立てます。ストリーミングはSSE用に設定されたすべての標準的なOpenAI互換クライアントで動作します。

キーあたり1分あたり300リクエストの制限に注意してください。ストリーミングはレート制限を回避するものではなく、データの配信方法のみを変更します。

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

関数呼び出しサポート

当社の関数呼び出しAPI実装では、リクエスト内でツールを定義できます。モデルはスキーマに一致する構造化JSONを返すため、プログラムによるアクションが可能になります。

名前、説明、パラメータスキーマを持つ関数を定義します。APIは実行するツール呼び出しを返し、結果をモデルに渡して最終的な回答を得ます。これによりロジックを生成から分離します。

関数定義が有効なJSONであることを確認してください。スキーマ構造のエラーは、モデルが不適切なツール呼び出しを返す原因になる場合があります。

モデル一覧とトークン

利用可能なモデルを取得するにはGET /v1/modelsを使用します。「uncensored」モデルが特定の機能とともにリストされます。

モデルはプロンプトトークンと完了トークンを組み合わせた100,000トークンのコンテキストウィンドウをサポートします。これにより、即時の切り捨てなしで広範なドキュメント処理や長い会話が可能です。

価格は透明です:入力トークン1Mあたり$0.25、出力トークン1Mあたり$1.00。クレジットは期限切れにならないため、使用した分のみ課金されます。

制限、エラーとコンテキスト

ダッシュボードで使用状況を監視してください。APIはキーあたり1分あたり300リクエストの制限を適用します。これを超えると429エラーになります。必要に応じてキーを再生成して状態をリセットしてください。

一般的なエラーには、401(無効なキー)、402(資金不足)、429(レート制限)が含まれます。クライアントコードでこれらを適切に処理してください。

コンテキストウィンドウの制限は送信および受信されたトークンの合計に適用されます。100kの制限を効率的に最大化するようにプロンプト構造を計画してください。

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.cheapaiapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
このAPIはOpenAI SDKと互換性がありますか?

はい、標準的なOpenAI互換のチャット完了フォーマットを使用しています。既存のクライアント設定でベースURLとAPIキーを更新するだけです。

クレジットが枯渇するとどうなりますか?

リクエストは402エラーを返します。暗号通貨(USDTまたはUSDC)で最低$10からチャージできます。クレジットは期限切れにならないため、都合の良い時に資金を追加できます。

モデルはコンテンツを拒否しますか?

モデルは法的な成人向け、フィクション、論争の多いトピックについて無検閲です。未成年者を含む性的コンテンツのみをハードリミットとしてブロックします。

キーはフォーム 1 つで手に入ります

アカウントを作成し、キーをコピーし、ベースURLを変更します。セットアップはこれだけです。

API キーを取得

https://api.cheapaiapis.com/v1

API 仕様

購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。

項目内容
形式OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作
エンドポイントPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.cheapaiapis.com/v1
認証Authorization: Bearer YOUR_KEY
モデル IDuncensored
関数呼び出し対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送
JSON モードresponse_format: {"type": "json_object"}
ストリーミング対応 — SSE、最後のチャンクにトークン使用量
パラメータtemperature、top_p、stop、seed、presence_penalty、frequency_penalty
コンテキスト長100,000 トークン(入力+出力)
最大出力100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし)
レート制限キーごとに毎分 300 リクエスト
レスポンスヘッダーX-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency
同時実行キーごとに同時 8 リクエストまで
リクエストサイズ最大 8 MB
無料トライアル$0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大
有効期限購入クレジットは失効なし、サブスクなし
ボーナス$50 以上で +5%、$100 以上で +10%
料金入力 100 万トークン $0.25 · 出力 100 万トークン $1.00
課金前払いクレジットから実使用量で課金。エラーと拒否は無料
チャージUSDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額
キーアカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効
コンテンツ成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否
ログインGoogle またはメール+パスワード

エラーコード

エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。

コードタイプ意味
400bad_requestJSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過
401missing_key · invalid_key · key_revokedキーなし・誤り・新しいキーに置換済み
402no_credit残高ゼロ — チャージすれば即再開
403content_blocked未成年者を含む性的コンテンツ — 拒否、課金なし
404not_found不明なエンドポイント
413request_too_large本文が 8 MB 超
429rate_limited · concurrency毎分 300 回または同時 8 件を超過 — 待って再試行
503upstream_busyモデル混雑 — 数秒後に再試行