FR ▾
Obtenir une clé API

Hébergement LLM sans censure

API LLM sans filtre pour les développeurs

Obtenez une API prêt à l’emploi et compatible OpenAI pour un seul modèle sans censure de haute qualité. Modifiez votre URL de base et conservez votre code.

Obtenir clé APILire la documentation

Essayez avec une seule requête

curl https://api.llmhostingapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'
$0.25
par 1M de tokens en entrée
$1.00
Tokens de sortie / 1M
100,000
fenêtre de contexte de tokens
$0.50
crédit d'essai
300
requêtes par minute

Ce que vous obtenez

Compatibilité intégrée

Utilisez les SDK OpenAI officiels en modifiant simplement l'URL de base et la clé API. Aucune mise à jour de bibliothèque ni réécriture de code requise.

Modèle unique de haute qualité

Nous nous concentrons sur un seul modèle sans censure ajusté pour les sujets adultes et controversés, sans le bruit des agrégateurs multi-modèles.

Tarification transparente

Crédits prépayés à l'usage sans frais mensuels. Les crédits n'expirent jamais, et vous ne payez que ce que vous utilisez.

Limites pensées pour les développeurs

Prise en charge du streaming via SSE et de l’appel de fonctions. 300 requêtes par minute par clé avec une limite de corps de requête de 8 Mo.

Inscription simple

Créez un compte avec simplement un e-mail et un mot de passe. Obtenez votre clé API immédiatement sans carte bancaire requise pour l'essai.

Axé sur la confidentialité

Vos prompts ne sont pas utilisés pour l'entraînement. Nous maintenons une structure de compte simple sans numéro de téléphone ni étapes de vérification supplémentaires.

Comment ça marche

  1. Créer un compte

    Inscrivez-vous avec un e-mail et un mot de passe pour recevoir votre clé API instantanément.

  2. Mettre à jour la configuration

    Pointez votre client OpenAI-compatible existant vers https://api.llmhostingapi.com/v1 et insérez votre clé.

  3. Démarrer l'inférence

    Envoyez des requêtes à /v1/chat/completions et recevez des réponses textuelles sans refus de contenu.

Ce que les gens créent avec

Génération de contenu

Générez des écrits créatifs, des scripts ou du jeu de rôle sans rencontrer les filtres de sécurité IA standard qui bloquent les thèmes matures.

Analyse de données

Traitez de grands documents dans une fenêtre de contexte de 100 000 tokens pour des tâches de résumé ou d'extraction.

Tests de développement

Testez la logique de votre application avec un modèle sans censure pour vous assurer que vos prompts fonctionnent sans refus inattendus.

Agents personnalisés

Intégrez l'API dans vos agents IA pour l'appel d'outils et l'exécution de fonctions avec une liberté totale de réponse.

Pourquoi choisir notre LLM Hosting API ?

Lorsque vous recherchez un hébergement LLM, vous souhaitez probablement de la fiabilité sans la surcharge de la gestion de l’infrastructure GPU. Notre API fournit un endpoint unique et robuste pour un modèle sans censure qui fait exactement ce que vous lui demandez. Contrairement aux agrégateurs qui acheminent le trafic via des dizaines de fournisseurs, nous nous concentrons entièrement sur un seul modèle de haute qualité, adapté à un usage ouvert.

Nous éliminons la complexité de l'auto-hébergement en fournissant une connexion directe à nos serveurs GPU. Vous bénéficiez d'une expérience cohérente avec une tarification transparente basée sur l'utilisation. Il n'y a pas de limites cachées ni de changements de taux surprises. Si vous avez besoin d'une API textuelle simple et puissante, c'est l'infrastructure dont vous avez besoin.

Compatibilité OpenAI intégrée

Notre API est conçue pour s'intégrer sans problème à votre flux de travail existant. Elle prend en charge l'endpoint standard POST /v1/chat/completions avec le streaming via Server-Sent Events (SSE) et l'appel d'outils/fonctions. Vous pouvez utiliser les SDK OpenAI officiels pour Python, Node.js et d'autres langages.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmhostingapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Pour changer, vous devez simplement mettre à jour deux variables : l'URL de base et la clé API. L'ID de modèle à envoyer est simplement "uncensored". Cette approche garde votre base de code propre et réduit le temps d'intégration de plusieurs heures à quelques minutes.

Un seul modèle sans censure, zéro filtre

Nous exécutons un modèle à poids ouverts sur nos propres serveurs, ajusté pour répondre sans refus de contenu pour une utilisation adulte légale. Cela signifie que vous pouvez explorer des sujets controversés, des thèmes sexuels ou de l'humour osé sans que l'IA décide soudainement qu'elle "ne peut pas" répondre. La seule limite stricte qui s'applique toujours est que le contenu sexuel impliquant des mineurs est bloqué.

Ce n'est pas une passerelle multi-modèles. Vous obtenez un modèle spécifique et de haute qualité. Cette concentration garantit des performances cohérentes et une tarification prévisible. Vous ne payez pas pour des modèles inutilisés ni pour la surcharge de routage. C'est une API textuelle pure sans génération d'images, d'audio ou de vidéo.

Ce à quoi cela ne convient PAS

Notre API n'est pas pour vous si vous avez besoin de plusieurs choix de modèles, d'embeddings ou de génération d'images. Nous n'offrons pas de fine-tuning, d'OCR ou de capacités de recherche. Si vous avez besoin d'une garantie SLA ou d'une certification SOC2, ce service indépendant peut ne pas répondre à vos besoins de conformité entreprise. Nous ne routons pas non plus entre différents fournisseurs comme GPT-4 ou Claude ; nous servons uniquement notre propre modèle sans censure. Si vous avez besoin d'un routeur complexe avec équilibrage de charge sur dix fournisseurs différents, regardez ailleurs.

Questions et réponses

Quel est le prix par million de tokens ?

Notre tarification est de 0,25 $ par 1M de tokens en entrée et 1,00 $ par 1M de tokens en sortie. Il s'agit d'un modèle de paiement à l'usage avec des crédits prépayés. Aucun frais mensuel ni coût d'abonnement.

S'agit-il d'un modèle OpenAI ?

Non, il s'agit d'un modèle à poids ouverts exécuté sur nos propres serveurs GPU. Ce n'est pas GPT, Claude, Gemini ou le modèle d'un autre fournisseur. Il est ajusté pour être sans censure et est compatible avec le format de l'API OpenAI.

Comment commencer avec un essai ?

Chaque nouveau compte reçoit 0,50 $ de crédit d'essai gratuit valable 7 jours. Vous pouvez vous inscrire avec une simple adresse e-mail et un mot de passe. Aucune carte bancaire n'est nécessaire pour commencer à tester l'API.

Quelles sont les limites de débit ?

Vous êtes limité à 300 requêtes par minute par clé API. La taille maximale du corps de la requête est de 8 MB. Chaque compte dispose d'une seule clé, que vous pouvez régénérer à tout moment pour révoquer l'accès.

Utilisez-vous mes prompts pour l'entraînement ?

Non, vos prompts ne sont pas utilisés pour l'entraînement. Nous maintenons une politique de confidentialité simple où vos données ne sont pas utilisées pour améliorer nos modèles. Vous n'avez besoin que d'une adresse e-mail et d'un mot de passe pour créer votre compte.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API