DE ▾
API-Schlüssel erhalten

Unzensierte LLM-Hosting

LLM API ohne Cenzur für Entwickler

Erhalte eine sofort einsetzbare, OpenAI-kompatible API für ein einziges, hochwertiges unzensiertes Modell. Ändere deine Basis-URL und behalte deinen Code.

API-Schlüssel erhaltenDokumentation lesen

Probiere es mit einer einzigen Anfrage aus

curl https://api.llmhostingapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'
$0.25
pro 1M Input-Token
$1.00
Output-Token / 1M
100,000
Token-Kontext
$0.50
Testguthaben
300
Anfragen pro Minute

Was du bekommst

Drop-In-Kompatibilität

Nutze die offiziellen OpenAI-SDKs, indem du einfach die Basis-URL und den API-Schlüssel änderst. Keine Bibliotheksupdates oder Code-Neuschreibungen erforderlich.

Ein einziges Hochleistungsmodell

Wir konzentrieren uns auf ein unzensiertes Modell, das für erwachsene und kontroverse Themen optimiert ist, ohne das Rauschen von Multi-Modell-Aggregatoren.

Transparente Preise

Pay-as-you-go Prepaid-Guthaben ohne monatliche Gebühren. Guthaben verfällt nie, und du zahlst nur für das, was du nutzt.

Entwicklerfreundliche Limits

Unterstützung für Streaming über SSE und Tool-/Function Calling. 300 Anfragen pro Minute pro Schlüssel mit einer Begrenzung des Anfragekörpers auf 8 MB.

Einfache Anmeldung

Erstelle ein Konto nur mit E-Mail und Passwort. Erhalte deinen API-Schlüssel sofort ohne Kreditkarte für die Testversion.

Datenschutz im Fokus

Deine Prompts werden nicht für das Training verwendet. Wir bieten eine einfache Kontostruktur ohne Telefonnummer oder zusätzliche Verifikationsschritte.

So funktioniert es

  1. Konto erstellen

    Melde dich mit E-Mail und Passwort an, um deinen API-Schlüssel sofort zu erhalten.

  2. Konfiguration aktualisieren

    Richte deinen bestehenden OpenAI-kompatiblen Client auf https://api.llmhostingapi.com/v1 ein, indem du deinen Schlüssel einfügst.

  3. Inferenz starten

    Sende Anfragen an /v1/chat/completions und erhalte Textantworten ohne Inhaltsablehnungen.

Was Leute damit bauen

Inhaltsgenerierung

Generiere kreative Texte, Skripte oder Rollenspiele, ohne auf Standard-KI-Sicherheitsfilter zu stoßen, die erwachsene Themen blockieren.

Datenanalyse

Verarbeite große Dokumente in einem Kontextfenster mit 100.000 Token für Zusammenfassungs- oder Extraktionsaufgaben.

Entwicklertest

Teste die Logik deiner Anwendung mit einem unzensierten Modell, um sicherzustellen, dass deine Prompts ohne unerwartete Ablehnungen funktionieren.

Benutzerdefinierte Agenten

Integriere die API in deine KI-Agenten für Tool Calling und Funktionsausführung mit voller Antwortfreiheit.

Warum unser LLM Hosting API wählen?

Wenn du nach LLM-Hosting suchst, möchtest du wahrscheinlich Zuverlässigkeit ohne den Verwaltungsaufwand für GPU-Infrastruktur. Unsere API bietet einen einzigen, robusten Endpunkt für ein unzensiertes Modell, das genau das tut, was du willst. Im Gegensatz zu Aggregatoren, die über Dutzende von Anbietern routen, konzentrieren wir uns vollständig auf ein hochwertiges Modell, das für offene Verwendungen optimiert ist.

Wir eliminieren die Komplexität des Self-Hostings, indem wir eine direkte Verbindung zu unseren GPU-Servern bereitstellen. Du erhältst ein konsistentes Erlebnis mit transparenter, nutzungsbasierter Abrechnung. Es gibt keine versteckten Limits oder unerwarteten Preisänderungen. Wenn du eine unkomplizierte, leistungsstarke Text-API benötigst, ist dies die Infrastruktur, die du brauchst.

Drop-In OpenAI-Kompatibilität

Unsere API ist so konzipiert, dass sie sich nahtlos in deinen bestehenden Workflow integriert. Sie unterstützt den Standard-POST /v1/chat/completions-Endpunkt mit Streaming über Server-Sent Events (SSE) und Tool-/Function Calling. Du kannst die offiziellen OpenAI-SDKs für Python, Node.js und andere Sprachen verwenden.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmhostingapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Zum Wechseln musst du nur zwei Variablen aktualisieren: die Basis-URL und den API-Schlüssel. Die zu sendende Modell-ID ist einfach "uncensored". Dieser Ansatz hält deine Codebasis sauber und reduziert die Integrationszeit von Stunden auf Minuten.

Ein unzensiertes Modell, Null Filter

Wir betreiben ein Open-Weight-Modell auf unseren eigenen Servern, das darauf optimiert ist, ohne Inhaltsablehnungen für legale erwachsene Nutzung zu antworten. Das bedeutet, dass du kontroverse Themen, sexuelle Themen oder pointierten Humor erkunden kannst, ohne dass die KI plötzlich entscheidet, sie könne "nicht" antworten. Die einzige harte Grenze, die immer gilt, ist, dass sexuelle Inhalte mit Minderjährigen blockiert werden.

Dies ist kein Multi-Modell-Gateway. Du erhältst ein spezifisches, hochwertiges Modell. Dieser Fokus gewährleistet konsistente Leistung und vorhersehbare Preise. Du zahlst nicht für ungenutzte Modelle oder Routing-Overhead. Es ist eine reine Text-API ohne Bild-, Audio- oder Videogenerierung.

Für wen das NICHT geeignet ist

Unsere API ist nicht für dich, wenn du mehrere Modellauswahlmöglichkeiten, Embeddings oder Bildgenerierung benötigst. Wir bieten kein Fine-Tuning, OCR oder Suchfunktionen an. Wenn du eine SLA-Garantie oder SOC2-Zertifizierung benötigst, erfüllt dieser unabhängige Dienst möglicherweise nicht deine Unternehmens-Compliance-Anforderungen. Wir leiten auch nicht zwischen verschiedenen Anbietern wie GPT-4 oder Claude; wir bedienen ausschließlich unser eigenes unzensiertes Modell. Wenn du einen komplexen Router mit Lastverteilung über zehn verschiedene Anbieter benötigst, schau woanders.

Fragen und Antworten

Was kostet ein Preis pro Millionen Token?

Unsere Preise liegen bei 0,25 $ pro 1M Input-Token und 1,00 $ pro 1M Output-Token. Dies ist ein Pay-as-you-go-Modell mit Prepaid-Guthaben. Es gibt keine monatlichen Gebühren oder Abonnementkosten.

Ist dies ein OpenAI-Modell?

Nein, dies ist ein Open-Weight-Modell, das auf unseren eigenen GPU-Servern läuft. Es ist kein GPT, Claude, Gemini oder ein Modell eines anderen Anbieters. Es wurde darauf optimiert, unzensiert zu sein, und ist mit dem OpenAI-API-Format kompatibel.

Wie starte ich mit der Testversion?

Jedes neue Konto erhält 0,50 $ Testguthaben, das 7 Tage gültig ist. Du kannst dich nur mit E-Mail und Passwort registrieren. Es wird keine Kreditkarte benötigt, um mit dem Testen der API zu beginnen.

Wie hoch sind die Ratenlimits?

Du bist auf 300 Anfragen pro Minute pro API-Schlüssel begrenzt. Die maximale Größe des Anfragekörpers beträgt 8 MB. Jedes Konto erhält einen Schlüssel, den du jederzeit neu generieren kannst, um den Zugriff zu widerrufen.

Nutzt ihr meine Prompts für das Training?

Nein, deine Prompts werden nicht zum Training verwendet. Wir halten uns an eine einfache Datenschutzrichtlinie, die besagt, dass deine Daten nicht zur Verbesserung unserer Modelle genutzt werden. Du benötigst nur eine E-Mail und ein Passwort, um dein Konto zu erstellen.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten