PT ▾
Obter chave de API

LLM Hosting APIHospedagem LLM: Guia de Início Rápido da API LLM

Hospedagem LLM: Guia de Início Rápido da API LLM

Integre nossa API LLM sem censura em minutos substituindo sua URL base e chave de API. Este guia cobre autenticação, conclusões de chat, streaming e chamada de funções com nosso endpoint compatível com OpenAI.

Autenticação e Chaves

Para usar a API de hospedagem de LLM llm hosting, você precisa de uma chave de API no painel da sua conta. A chave autentica todas as requisições. Mantenha-a segura; qualquer pessoa com a chave pode usar seu crédito pré-pago. Você pode regenerar a chave a qualquer momento, o que invalida imediatamente a anterior. Cada conta suporta apenas uma chave ativa. Não é necessário número de telefone ou cartão de crédito para começar, pois novas contas recebem crédito de teste grátis.

Configuração da URL Base

Nossa API é totalmente compatível com OpenAI. Para mudar, atualize a URL base do seu cliente para https://api.llmhostingapi.com/v1 e defina sua chave de API no cabeçalho de autorização. Isso funciona com os SDKs oficiais da OpenAI e qualquer biblioteca cliente compatível. Você não precisa alterar a lógica do seu código, apenas o endpoint e as credenciais. O identificador do modelo a ser usado é uncensored.

curl https://api.llmhostingapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Endpoint de Conclusões de Chat

Envie texto ao modelo via POST /v1/chat/completions. A API aceita mensagens e retorna respostas de texto. Suportamos uma janela de contexto de 100.000 tokens para entrada e saída. A chamada de funções é suportada para extração de dados estruturados. O modelo é ajustado para responder sem recusas de conteúdo para uso adulto legal, tornando-o ideal para geração de conteúdo criativo, de pesquisa ou adulto sem configuração extra.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmhostingapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Respostas em Streaming (SSE)

Para menor latência e experiências em tempo real para o usuário, ative o streaming definindo stream: true. A API retorna chunks de Server-Sent Events (SSE). Isso permite que você exiba respostas parciais conforme são geradas. O streaming não afeta o preço ou a contagem de tokens. É recomendado para interfaces de chat onde os usuários esperam feedback imediato. Certifique-se de que seu cliente processa a análise de SSE corretamente.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Suporte a Chamada de Funções

Defina funções no corpo da sua requisição usando o parâmetro tools. O modelo responderá com chamadas de função em vez de texto puro quando apropriado. Você deve executar a função no seu lado e enviar o resultado de volta na próxima rodada de conversa. Isso permite fluxos de trabalho complexos como consultas a banco de dados ou integrações de API. O modelo lida com a seleção de ferramentas automaticamente com base no prompt do usuário e nas definições de função disponíveis.

Endpoint de Listagem de Modelos

Consulte GET /v1/models para listar modelos disponíveis. Você verá o modelo uncensored com seu ID, data de criação e campo de propriedade. Este endpoint ajuda a verificar conectividade e disponibilidade do modelo. Ele retorna JSON no formato padrão da OpenAI. Use isso para depurar problemas de autenticação antes de enviar solicitações de chat. O endpoint é leve e retorna imediatamente.

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmhostingapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Perguntas e respostas

Quais são os limites de requisições e erros?

Você está limitado a 300 requisições por minuto por chave. Um erro 401 significa que sua chave de API é inválida. Um erro 402 indica crédito pré-pago insuficiente. Um erro 429 significa que você excedeu o limite de requisições. Os corpos das requisições são limitados a 8 MB.

Como funciona o preço?

O preço é pagamento por uso com crédito pré-pago. Tokens de entrada custam $0,25 por 1M tokens, e tokens de saída custam $1,00 por 1M tokens. O crédito nunca expira. Você pode recarregar a partir de $10, com bônus para depósitos maiores. Não há taxas mensais ou assinaturas.

O modelo é sem censura?

Sim, o modelo responde sem recusas para tópicos adultos legais, fictícios ou controversos. Ele não bloqueia conteúdo com base em normas políticas ou sociais padrão. O único limite rígido é a ausência de conteúdo sexual envolvendo menores, que é sempre bloqueado.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API

Ficha técnica da API

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
EndpointsPOST /v1/chat/completions · GET /v1/models
AutenticaçãoAuthorization: Bearer YOUR_KEY
ID do modelouncensored
Base URLhttps://api.llmhostingapi.com/v1
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Janela de contexto100.000 tokens (entrada + saída)
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Modo JSONresponse_format: {"type": "json_object"}
Concorrência8 requisições ao mesmo tempo por chave
Limite de taxa300 requisições por minuto por chave
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamanhoaté 8 MB por requisição
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Validadecrédito pago não expira, sem assinatura
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Bônus+5% a partir de $50, +10% a partir de $100
Chavesuma chave ativa por conta; uma nova substitui a anterior
LoginGoogle ou e-mail e senha
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado

Erros e o que fazer

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos