LLM Hosting APILLM ホスティング:LLM API クイックスタートガイド
LLM ホスティング:LLM API クイックスタートガイド
ベース URL と API キーを変更するだけで、数分で無検閲 LLM API を統合できます。このガイドでは、認証、チャット完了、ストリーミング、および OpenAI 互換エンドポイントでの関数呼び出しについて説明します。
認証とキー
LLM ホスティング API を使用するには、アカウントダッシュボードから API キーが必要です。このキーはすべてのリクエストを認証します。キーを安全に保管してください。キーを持っている人は誰でも前払いクレジットを使用できます。キーはいつでも再生成でき、以前のキーは直ちに無効になります。各アカウントは 1 つのアクティブなキーをサポートします。新しいアカウントには試用クレジットが付与されるため、電話番号やクレジットカードは必要ありません。
ベース URL の設定
当 API は OpenAI と完全に互換性があります。切り替えるには、クライアントのベース URL を https://api.llmhostingapi.com/v1 に更新し、認証ヘッダーに API キーを設定してください。これは公式の OpenAI SDK および互換性のある任意のクライアントライブラリで動作します。コードロジックを変更する必要はなく、エンドポイントと認証情報のみを変更してください。使用するモデル識別子は uncensored です。
curl https://api.llmhostingapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
チャット完了エンドポイント
POST /v1/chat/completions を介してモデルにテキストを送信します。API はメッセージを受け取り、テキストレスポンスを返します。入力と出力の両方で 100,000 トークンのコンテキストウィンドウをサポートしています。構造化データ抽出のための関数呼び出しもサポートしています。このモデルは、追加設定なしでクリエイティブ、研究、または成人向けコンテンツの生成に適した、法的な成人向け用途でのコンテンツ拒否なしの回答にチューニングされています。
from openai import OpenAI
client = OpenAI(base_url="https://api.llmhostingapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
ストリーミングレスポンス(SSE)
低レイテンシとリアルタイムのユーザー体験のために、stream: true を設定してストリーミングを有効にします。API はサーバー送信イベント(SSE)チャンクを返します。これにより、生成されながら部分的なレスポンスを表示できます。ストリーミングは価格やトークン数に影響しません。ユーザーが即時フィードバックを期待するチャットインターフェースに推奨されます。クライアントが SSE パースを正しく処理することを確認してください。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
関数呼び出しサポート
リクエストボディのtoolsパラメータを使用して関数を定義します。モデルは適切な場合にプレーンテキストの代わりに関数呼び出しを返します。関数はクライアント側で実行し、その結果を次の会話ターンで送信する必要があります。これにより、データベースクエリやAPI統合などの複雑なワークフローが可能になります。モデルはユーザーのプロンプトと利用可能な関数の定義に基づいてツール選択を自動的に行います。
モデル一覧エンドポイント
利用可能なモデルを一覧表示するには GET /v1/models をクエリします。ID、作成日、所有者フィールド付きの uncensored モデルが表示されます。このエンドポイントは接続とモデルの利用可能性を確認するのに役立ちます。標準的な OpenAI 形式の JSON を返します。チャットリクエストを送信する前に認証の問題をデバッグするために使用してください。このエンドポイントは軽量で、すぐに返されます。
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmhostingapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);質問と回答
レート制限とエラーは何ですか?
キーごとに毎分最大 300 リクエストが制限されます。401 エラーは API キーが無効であることを意味します。402 エラーは前払いクレジットが不足していることを示します。429 エラーはレート制限を超えたことを意味します。リクエストボディは 8 MB に制限されます。
価格設定はどのように機能しますか?
価格設定は従量課金制で前払いクレジットを使用します。入力トークンは 100 万トークンあたり $0.25、出力トークンは 100 万トークンあたり $1.00 です。クレジットは期限切れになりません。10 ドルからチャージでき、大口入金にはボーナスがあります。月額料金やサブスクリプションはありません。
モデルは無検閲ですか?
はい、このモデルは法的に許可された大人向け、フィクション、または論争的なトピックについても拒否応答なしで回答します。標準的な政治的または社会的規範に基づいてコンテンツをブロックすることはありません。唯一の硬性制限は、未成年者に関する性的コンテンツで、これは常にブロックされます。
キーはフォーム 1 つで手に入ります
アカウントを作成し、キーをコピーし、ベース URL を変更します。セットアップはこれだけです。
API キーを取得API 仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| 認証 | Authorization: Bearer YOUR_KEY |
| モデル ID | uncensored |
| Base URL | https://api.llmhostingapi.com/v1 |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| コンテキスト長 | 100,000 トークン(入力+出力) |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| 最大出力 | 100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| JSON モード | response_format: {"type": "json_object"} |
| 同時実行 | キーごとに同時 8 リクエストまで |
| レート制限 | キーごとに毎分 300 リクエスト |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| リクエストサイズ | 最大 8 MB |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
| ログイン | Google またはメール+パスワード |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |