NL ▾
API-sleutel aanvragen

LLM Hosting APILLM-hosting: LLM API Snelle startgids

LLM-hosting: LLM API Snelle startgids

Integreer onze ongecensureerde LLM-API in enkele minuten door je base URL en API-sleutel aan te passen. Deze gids behandelt authenticatie, chatcompleties, streaming en function calling met ons OpenAI-compatibele endpoint.

Authenticatie & Sleutels

Om de llm hosting API te gebruiken, heb je een API-sleutel nodig vanuit je accountdashboard. De sleutel verifieert alle verzoeken. Bewaar deze veilig; iedereen met de sleutel kan je prepaid tegoed gebruiken. Je kunt de sleutel op elk moment opnieuw genereren, waardoor de vorige direct ongeldig wordt. Elk account ondersteunt één actieve sleutel. Er is geen telefoonnummer of creditcard nodig om te beginnen, omdat nieuwe accounts trial tegoed ontvangen.

Base URL-configuratie

Onze API is volledig OpenAI-compatibel. Om te schakelen, pas je de base URL van je client aan naar https://api.llmhostingapi.com/v1 en stel je je API-sleutel in de autorisatieheader in. Dit werkt met de officiële OpenAI SDKs en elke compatibele clientbibliotheek. Je hoeft je codelogica niet aan te passen, alleen het endpoint en de referenties. De te gebruiken modelidentificatie is uncensored.

curl https://api.llmhostingapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Chat Completies Endpoint

Stuur tekst naar het model via POST /v1/chat/completions. De API accepteert berichten en retourneert tekstantwoorden. We ondersteunen een contextvenster van 100.000 tokens voor zowel input als output. Function calling wordt ondersteund voor gestructureerde gegevensextractie. Het model is afgestemd om zonder inhoudsweigeringen te antwoorden voor wettelijk volwassen gebruik, wat het ideaal maakt voor creatieve, onderzoeks- of volwassen inhoudsgeneratie zonder extra configuratie.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmhostingapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Streaming Reacties (SSE)

Voor lagere latentie en realtime gebruikerservaringen, activeer streaming door stream: true in te stellen. De API retourneert Server-Sent Events (SSE) chunks. Hiermee kun je gedeeltelijke reacties weergeven terwijl ze worden gegenereerd. Streaming heeft geen invloed op de prijs of het tokenaantal. Het wordt aanbevolen voor chatinterfaces waar gebruikers directe feedback verwachten. Zorg dat je client SSE-parsing correct verwerkt.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Ondersteuning voor Function Calling

Definieer functies in je request body met het tools parameter. Het model reageert met function calls in plaats van platte tekst wanneer dit gepast is. Je moet de functie aan je kant uitvoeren en het resultaat in de volgende gesprekstuur terugsturen. Dit maakt complexe workflows mogelijk zoals databasequeries of API-integraties. Het model selecteert automatisch de juiste tool op basis van de prompt van de gebruiker en de beschikbare functiedefinities.

Model Lijst Endpoint

Voer GET /v1/models uit om beschikbare modellen te bekijken. Je ziet het uncensored model met de ID, de datum van aanmaken en de veld 'eigenaar'. Dit endpoint helpt bij het verifiëren van de verbinding en de beschikbaarheid van modellen. Het retourneert standaard JSON in OpenAI-formaat. Gebruik dit om authenticatieproblemen te debuggen voordat je chatverzoeken verstuurt. Het endpoint is lichtgewicht en retourneert direct.

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmhostingapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Vragen en antwoorden

Wat zijn de rate limits en fouten?

Je bent beperkt tot 300 verzoeken per minuut per sleutel. Een 401-fout betekent dat je API-sleutel ongeldig is. Een 402-fout geeft aan dat je prepaid tegoed onvoldoende is. Een 429-fout betekent dat je de rate limit hebt overschreden. Aanvraaglichamen zijn beperkt tot 8 MB.

Hoe werkt de prijsstelling?

Prijzen zijn pay-as-you-go met prepaid tegoed. Input tokens kosten $0,25 per 1M tokens, en output tokens kosten $1,00 per 1M tokens. Het tegoed verloopt nooit. Je kunt opwaarderen vanaf $10, met bonussen voor hogere stortingen. Er zijn geen maandelijkse kosten of abonnementen.

Is het model ongecensureerd?

Ja, het model antwoordt zonder weigeringen voor wettelijke volwassen, fictieve of controversiële onderwerpen. Het blokkeert geen inhoud op basis van standaard politieke of sociale normen. De enige harde limiet is geen seksuele inhoud met minderjarigen, wat altijd wordt geblokkeerd.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele installatie.

API-sleutel aanvragen

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
EndpointsPOST /v1/chat/completions · GET /v1/models
AuthenticatieAuthorization: Bearer YOUR_KEY
Model-IDuncensored
Base URLhttps://api.llmhostingapi.com/v1
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Contextvenster100.000 tokens (invoer + uitvoer)
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
JSON-modusresponse_format: {"type": "json_object"}
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Rate limit300 verzoeken per minuut per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Verzoekgroottetot 8 MB
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Geldigheidbetaald tegoed verloopt niet, geen abonnement
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Bonus+5% vanaf $50, +10% vanaf $100
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
InloggenGoogle of e-mail en wachtwoord
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw