ID ▾
Dapatkan kunci API

LLM Hosting APIHosting LLM: Panduan Cepat API LLM

Hosting LLM: Panduan Cepat API LLM

Integrasikan API LLM tanpa sensor kami dalam hitungan menit dengan mengganti URL dasar dan kunci API Anda. Panduan ini mencakup autentikasi, penyelesaian obrolan, streaming, dan pemanggilan fungsi dengan endpoint yang kompatibel dengan OpenAI kami.

Autentikasi & Kunci

Untuk menggunakan API llm hosting, Anda memerlukan kunci API dari dasbor akun Anda. Kunci ini mengautentikasi semua permintaan. Jaga agar tetap aman; siapa pun yang memiliki kunci tersebut dapat menggunakan saldo prabayar Anda. Anda dapat membuat ulang kunci kapan saja, yang secara langsung membuat kunci sebelumnya tidak valid. Setiap akun mendukung satu kunci aktif. Tidak diperlukan nomor telepon atau kartu kredit untuk memulai, karena akun baru menerima kredit uji coba gratis.

Konfigurasi URL Dasar

API kami sepenuhnya kompatibel dengan OpenAI. Untuk beralih, perbarui URL dasar klien Anda menjadi https://api.llmhostingapi.com/v1 dan atur kunci API Anda di header otorisasi. Ini berfungsi dengan SDK OpenAI resmi dan pustaka klien kompatibel apa pun. Anda tidak perlu mengubah logika kode Anda, hanya endpoint dan kredensial. Pengidentifikasi model yang harus digunakan adalah uncensored.

curl https://api.llmhostingapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Endpoint Penyelesaian Obrolan

Kirim teks ke model melalui POST /v1/chat/completions. API menerima pesan dan mengembalikan respons teks. Kami mendukung jendela konteks 100.000 token untuk input dan output. Pemanggilan fungsi didukung untuk ekstraksi data terstruktur. Model ini disesuaikan untuk menjawab tanpa penolakan konten untuk penggunaan dewasa yang sah, menjadikannya ideal untuk pembuatan konten kreatif, penelitian, atau konten dewasa tanpa konfigurasi tambahan.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmhostingapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Respons Streaming (SSE)

Untuk latensi lebih rendah dan pengalaman pengguna waktu nyata, aktifkan streaming dengan mengatur stream: true. API mengembalikan potongan Acara yang Dikirim Server (SSE). Ini memungkinkan Anda menampilkan respons parsial saat dihasilkan. Streaming tidak memengaruhi harga atau hitungan token. Disarankan untuk antarmuka obrolan di mana pengguna mengharapkan umpan balik segera. Pastikan klien Anda menangani parsing SSE dengan benar.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Dukungan Pemanggilan Fungsi

Tentukan fungsi dalam badan permintaan Anda menggunakan parameter tools. Model akan merespons dengan panggilan fungsi alih-alih teks biasa ketika sesuai. Anda harus menjalankan fungsi di sisi Anda dan mengirimkan hasilnya kembali dalam giliran percakapan berikutnya. Ini memungkinkan alur kerja kompleks seperti kueri basis data atau integrasi API. Model menangani pemilihan alat secara otomatis berdasarkan prompt pengguna dan definisi fungsi yang tersedia.

Endpoint Daftar Model

Kueri GET /v1/models untuk daftar model yang tersedia. Anda akan melihat model uncensored dengan ID, tanggal pembuatan, dan bidang yang dimiliki. Endpoint ini membantu memverifikasi konektivitas dan ketersediaan model. Ini mengembalikan JSON format OpenAI standar. Gunakan ini untuk mendebug masalah autentikasi sebelum mengirim permintaan obrolan. Endpoint ini ringan dan mengembalikan segera.

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmhostingapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Tanya jawab

Apa saja batas laju dan error?

Anda dibatasi hingga 300 permintaan per menit per kunci. Error 401 berarti kunci API Anda tidak valid. Error 402 menunjukkan saldo prabayar tidak cukup. Error 429 berarti Anda telah melebihi batas laju. Badan permintaan dibatasi hingga 8 MB.

Bagaimana cara kerja harganya?

Harga bersifat bayar sesuai penggunaan dengan saldo prabayar. Token input berharga $0,25 per 1M token, dan token output berharga $1,00 per 1M token. Saldo tidak pernah kedaluwarsa. Anda dapat mengisi saldo mulai dari $10, dengan bonus untuk deposit yang lebih besar. Tidak ada biaya langganan bulanan.

Apakah modelnya tanpa sensor?

Ya, model menjawab tanpa penolakan untuk topik dewasa yang sah, fiksi, atau kontroversial. Model tidak memblokir konten berdasarkan norma politik atau sosial standar. Satu-satunya batas keras adalah tidak ada konten seksual yang melibatkan anak di bawah umur, yang selalu diblokir.

Kunci Anda hanya selangkah lagi dari satu formulir

Buat akun, salin kuncinya, ubah URL dasar. Itu saja seluruh pengaturannya.

Dapatkan kunci API

Spesifikasi API

Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.

ItemNilai
Formatkompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci
EndpointPOST /v1/chat/completions · GET /v1/models
AutentikasiAuthorization: Bearer YOUR_KEY
ID modeluncensored
Base URLhttps://api.llmhostingapi.com/v1
Streamingya — server-sent events; potongan terakhir berisi penggunaan token
Jendela konteks100.000 token (input + output)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool
Output maksimalhingga sisa jendela 100.000 token; max_tokens opsional (tanpa batas terpisah)
Mode JSONresponse_format: {"type": "json_object"}
Konkurensi8 permintaan bersamaan per kunci
Batas laju300 permintaan per menit per kunci
Header responsX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Ukuran permintaanhingga 8 MB
Uji coba gratis$0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama
Masa berlakusaldo berbayar tidak kedaluwarsa, tanpa langganan
Isi saldoUSDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500
Penagihansaldo prabayar sesuai pemakaian nyata; error dan penolakan gratis
Harga$0,25 per 1 juta token input · $1,00 per 1 juta token output
Bonus+5% mulai $50, +10% mulai $100
Kuncisatu kunci aktif per akun; kunci baru menggantikan yang lama
MasukGoogle atau email dan kata sandi
Kontenkonten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak

Kode error

Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.

KodeTipeArti
400bad_requestJSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang
401missing_key · invalid_key · key_revokedkunci tidak ada, salah, atau sudah diganti
402no_creditsaldo habis — isi ulang dan lanjut seketika
403content_blockedkonten seksual dengan anak di bawah umur — ditolak, tidak ditagih
404not_foundendpoint tidak dikenal
413request_too_largebody lebih dari 8 MB
429rate_limited · concurrencylebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi
503upstream_busymodel sibuk — coba lagi beberapa detik lagi