LLM Hosting APIHosting LLM: Panduan Cepat API LLM
Hosting LLM: Panduan Cepat API LLM
Integrasikan API LLM tanpa sensor kami dalam hitungan menit dengan mengganti URL dasar dan kunci API Anda. Panduan ini mencakup autentikasi, penyelesaian obrolan, streaming, dan pemanggilan fungsi dengan endpoint yang kompatibel dengan OpenAI kami.
Autentikasi & Kunci
Untuk menggunakan API llm hosting, Anda memerlukan kunci API dari dasbor akun Anda. Kunci ini mengautentikasi semua permintaan. Jaga agar tetap aman; siapa pun yang memiliki kunci tersebut dapat menggunakan saldo prabayar Anda. Anda dapat membuat ulang kunci kapan saja, yang secara langsung membuat kunci sebelumnya tidak valid. Setiap akun mendukung satu kunci aktif. Tidak diperlukan nomor telepon atau kartu kredit untuk memulai, karena akun baru menerima kredit uji coba gratis.
Konfigurasi URL Dasar
API kami sepenuhnya kompatibel dengan OpenAI. Untuk beralih, perbarui URL dasar klien Anda menjadi https://api.llmhostingapi.com/v1 dan atur kunci API Anda di header otorisasi. Ini berfungsi dengan SDK OpenAI resmi dan pustaka klien kompatibel apa pun. Anda tidak perlu mengubah logika kode Anda, hanya endpoint dan kredensial. Pengidentifikasi model yang harus digunakan adalah uncensored.
curl https://api.llmhostingapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Endpoint Penyelesaian Obrolan
Kirim teks ke model melalui POST /v1/chat/completions. API menerima pesan dan mengembalikan respons teks. Kami mendukung jendela konteks 100.000 token untuk input dan output. Pemanggilan fungsi didukung untuk ekstraksi data terstruktur. Model ini disesuaikan untuk menjawab tanpa penolakan konten untuk penggunaan dewasa yang sah, menjadikannya ideal untuk pembuatan konten kreatif, penelitian, atau konten dewasa tanpa konfigurasi tambahan.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmhostingapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Respons Streaming (SSE)
Untuk latensi lebih rendah dan pengalaman pengguna waktu nyata, aktifkan streaming dengan mengatur stream: true. API mengembalikan potongan Acara yang Dikirim Server (SSE). Ini memungkinkan Anda menampilkan respons parsial saat dihasilkan. Streaming tidak memengaruhi harga atau hitungan token. Disarankan untuk antarmuka obrolan di mana pengguna mengharapkan umpan balik segera. Pastikan klien Anda menangani parsing SSE dengan benar.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Dukungan Pemanggilan Fungsi
Tentukan fungsi dalam badan permintaan Anda menggunakan parameter tools. Model akan merespons dengan panggilan fungsi alih-alih teks biasa ketika sesuai. Anda harus menjalankan fungsi di sisi Anda dan mengirimkan hasilnya kembali dalam giliran percakapan berikutnya. Ini memungkinkan alur kerja kompleks seperti kueri basis data atau integrasi API. Model menangani pemilihan alat secara otomatis berdasarkan prompt pengguna dan definisi fungsi yang tersedia.
Endpoint Daftar Model
Kueri GET /v1/models untuk daftar model yang tersedia. Anda akan melihat model uncensored dengan ID, tanggal pembuatan, dan bidang yang dimiliki. Endpoint ini membantu memverifikasi konektivitas dan ketersediaan model. Ini mengembalikan JSON format OpenAI standar. Gunakan ini untuk mendebug masalah autentikasi sebelum mengirim permintaan obrolan. Endpoint ini ringan dan mengembalikan segera.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmhostingapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Tanya jawab
Apa saja batas laju dan error?
Anda dibatasi hingga 300 permintaan per menit per kunci. Error 401 berarti kunci API Anda tidak valid. Error 402 menunjukkan saldo prabayar tidak cukup. Error 429 berarti Anda telah melebihi batas laju. Badan permintaan dibatasi hingga 8 MB.
Bagaimana cara kerja harganya?
Harga bersifat bayar sesuai penggunaan dengan saldo prabayar. Token input berharga $0,25 per 1M token, dan token output berharga $1,00 per 1M token. Saldo tidak pernah kedaluwarsa. Anda dapat mengisi saldo mulai dari $10, dengan bonus untuk deposit yang lebih besar. Tidak ada biaya langganan bulanan.
Apakah modelnya tanpa sensor?
Ya, model menjawab tanpa penolakan untuk topik dewasa yang sah, fiksi, atau kontroversial. Model tidak memblokir konten berdasarkan norma politik atau sosial standar. Satu-satunya batas keras adalah tidak ada konten seksual yang melibatkan anak di bawah umur, yang selalu diblokir.
Kunci Anda hanya selangkah lagi dari satu formulir
Buat akun, salin kuncinya, ubah URL dasar. Itu saja seluruh pengaturannya.
Dapatkan kunci APISpesifikasi API
Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.
| Item | Nilai |
|---|---|
| Format | kompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autentikasi | Authorization: Bearer YOUR_KEY |
| ID model | uncensored |
| Base URL | https://api.llmhostingapi.com/v1 |
| Streaming | ya — server-sent events; potongan terakhir berisi penggunaan token |
| Jendela konteks | 100.000 token (input + output) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | ya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool |
| Output maksimal | hingga sisa jendela 100.000 token; max_tokens opsional (tanpa batas terpisah) |
| Mode JSON | response_format: {"type": "json_object"} |
| Konkurensi | 8 permintaan bersamaan per kunci |
| Batas laju | 300 permintaan per menit per kunci |
| Header respons | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ukuran permintaan | hingga 8 MB |
| Uji coba gratis | $0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama |
| Masa berlaku | saldo berbayar tidak kedaluwarsa, tanpa langganan |
| Isi saldo | USDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500 |
| Penagihan | saldo prabayar sesuai pemakaian nyata; error dan penolakan gratis |
| Harga | $0,25 per 1 juta token input · $1,00 per 1 juta token output |
| Bonus | +5% mulai $50, +10% mulai $100 |
| Kunci | satu kunci aktif per akun; kunci baru menggantikan yang lama |
| Masuk | Google atau email dan kata sandi |
| Konten | konten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak |
Kode error
Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.
| Kode | Tipe | Arti |
|---|---|---|
400 | bad_request | JSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang |
401 | missing_key · invalid_key · key_revoked | kunci tidak ada, salah, atau sudah diganti |
402 | no_credit | saldo habis — isi ulang dan lanjut seketika |
403 | content_blocked | konten seksual dengan anak di bawah umur — ditolak, tidak ditagih |
404 | not_found | endpoint tidak dikenal |
413 | request_too_large | body lebih dari 8 MB |
429 | rate_limited · concurrency | lebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi |
503 | upstream_busy | model sibuk — coba lagi beberapa detik lagi |