LLM Hosting APILLM-hosting: LLM API Snelle startgids
LLM-hosting: LLM API Snelle startgids
Integreer onze ongecensureerde LLM-API in enkele minuten door je base URL en API-sleutel aan te passen. Deze gids behandelt authenticatie, chatcompleties, streaming en function calling met ons OpenAI-compatibele endpoint.
Authenticatie & Sleutels
Om de llm hosting API te gebruiken, heb je een API-sleutel nodig vanuit je accountdashboard. De sleutel verifieert alle verzoeken. Bewaar deze veilig; iedereen met de sleutel kan je prepaid tegoed gebruiken. Je kunt de sleutel op elk moment opnieuw genereren, waardoor de vorige direct ongeldig wordt. Elk account ondersteunt één actieve sleutel. Er is geen telefoonnummer of creditcard nodig om te beginnen, omdat nieuwe accounts trial tegoed ontvangen.
Base URL-configuratie
Onze API is volledig OpenAI-compatibel. Om te schakelen, pas je de base URL van je client aan naar https://api.llmhostingapi.com/v1 en stel je je API-sleutel in de autorisatieheader in. Dit werkt met de officiële OpenAI SDKs en elke compatibele clientbibliotheek. Je hoeft je codelogica niet aan te passen, alleen het endpoint en de referenties. De te gebruiken modelidentificatie is uncensored.
curl https://api.llmhostingapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Chat Completies Endpoint
Stuur tekst naar het model via POST /v1/chat/completions. De API accepteert berichten en retourneert tekstantwoorden. We ondersteunen een contextvenster van 100.000 tokens voor zowel input als output. Function calling wordt ondersteund voor gestructureerde gegevensextractie. Het model is afgestemd om zonder inhoudsweigeringen te antwoorden voor wettelijk volwassen gebruik, wat het ideaal maakt voor creatieve, onderzoeks- of volwassen inhoudsgeneratie zonder extra configuratie.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmhostingapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Streaming Reacties (SSE)
Voor lagere latentie en realtime gebruikerservaringen, activeer streaming door stream: true in te stellen. De API retourneert Server-Sent Events (SSE) chunks. Hiermee kun je gedeeltelijke reacties weergeven terwijl ze worden gegenereerd. Streaming heeft geen invloed op de prijs of het tokenaantal. Het wordt aanbevolen voor chatinterfaces waar gebruikers directe feedback verwachten. Zorg dat je client SSE-parsing correct verwerkt.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Ondersteuning voor Function Calling
Definieer functies in je request body met het tools parameter. Het model reageert met function calls in plaats van platte tekst wanneer dit gepast is. Je moet de functie aan je kant uitvoeren en het resultaat in de volgende gesprekstuur terugsturen. Dit maakt complexe workflows mogelijk zoals databasequeries of API-integraties. Het model selecteert automatisch de juiste tool op basis van de prompt van de gebruiker en de beschikbare functiedefinities.
Model Lijst Endpoint
Voer GET /v1/models uit om beschikbare modellen te bekijken. Je ziet het uncensored model met de ID, de datum van aanmaken en de veld 'eigenaar'. Dit endpoint helpt bij het verifiëren van de verbinding en de beschikbaarheid van modellen. Het retourneert standaard JSON in OpenAI-formaat. Gebruik dit om authenticatieproblemen te debuggen voordat je chatverzoeken verstuurt. Het endpoint is lichtgewicht en retourneert direct.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmhostingapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Vragen en antwoorden
Wat zijn de rate limits en fouten?
Je bent beperkt tot 300 verzoeken per minuut per sleutel. Een 401-fout betekent dat je API-sleutel ongeldig is. Een 402-fout geeft aan dat je prepaid tegoed onvoldoende is. Een 429-fout betekent dat je de rate limit hebt overschreden. Aanvraaglichamen zijn beperkt tot 8 MB.
Hoe werkt de prijsstelling?
Prijzen zijn pay-as-you-go met prepaid tegoed. Input tokens kosten $0,25 per 1M tokens, en output tokens kosten $1,00 per 1M tokens. Het tegoed verloopt nooit. Je kunt opwaarderen vanaf $10, met bonussen voor hogere stortingen. Er zijn geen maandelijkse kosten of abonnementen.
Is het model ongecensureerd?
Ja, het model antwoordt zonder weigeringen voor wettelijke volwassen, fictieve of controversiële onderwerpen. Het blokkeert geen inhoud op basis van standaard politieke of sociale normen. De enige harde limiet is geen seksuele inhoud met minderjarigen, wat altijd wordt geblokkeerd.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele installatie.
API-sleutel aanvragenAPI-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Model-ID | uncensored |
| Base URL | https://api.llmhostingapi.com/v1 |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| JSON-modus | response_format: {"type": "json_object"} |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Verzoekgrootte | tot 8 MB |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inloggen | Google of e-mail en wachtwoord |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |