无审查 LLM 托管
为开发者提供的简单、无审查大模型API
获取即插即用、兼容 OpenAI 的 API,用于单一的高质量无审查模型。更改基础 URL 并保持代码不变。
- 兼容 OpenAI 的接口
- $0.25/$1.00 每百万 token
- 无隐藏内容过滤
一个请求即可试用
curl https://api.llmhostingapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.llmhostingapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmhostingapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);- $0.25
- 每 1M 个输入 token
- $1.00
- 输出 token / 1M
- 100,000
- token 上下文
- $0.50
- 免费试用额度
- 300
- 每分钟请求
你获得什么
即插即用兼容性
通过仅更改基础 URL 和 API 密钥,使用官方 OpenAI SDK。无需更新库或重写代码。
单一高质量模型
我们专注于一个针对成人和争议性话题进行优化的无审查模型,避免了多模型聚合器的噪音。
透明定价
按量付费的预付额度,无月费。额度永不失效,你只需为实际使用量付费。
开发者优先限制
支持通过 SSE 进行流式输出以及函数调用。每个密钥每分钟 300 个请求,请求体限制为 8 MB。
简单注册
仅使用电子邮件和密码创建账户。立即获取 API 密钥,试用期间无需信用卡。
注重隐私
你的提示词不用于训练。我们维护简单的账户结构,无需电话号码或额外验证步骤。
工作原理
创建账户
使用电子邮件和密码注册,立即获取 API 密钥。
更新配置
将现有的 OpenAI 兼容客户端指向 https://api.llmhostingapi.com/v1 并插入你的密钥。
开始推理
向 /v1/chat/completions 发送请求,并接收无内容拒绝的文本响应。
人们用它构建什么
内容生成
生成创意写作、剧本或角色扮演,无需遇到阻止成熟主题的标准 AI 安全过滤器。
数据分析
在 100,000 token 的上下文窗口内处理大型文档,用于摘要或提取任务。
开发测试
使用无审查模型测试你的应用逻辑,确保你的提示词在没有意外拒绝的情况下正常工作。
自定义智能体
将 API 集成到您的 AI 智能体中,用于工具调用和函数执行,拥有完全自由的响应。
为什么选择我们的 LLM Hosting API?
当您搜索 llm 托管时,您可能希望在不管理 GPU 基础设施开销的情况下获得可靠性。我们的 API 提供了一个单一、强大的接口,用于一个完全按您要求执行的无审查模型。与通过数十个供应商路由的聚合器不同,我们完全专注于一个针对开放式使用进行优化的高质量模型。
我们通过提供与 GPU 服务器的直接连接来消除自托管的复杂性。您获得一致的体验和透明的基于使用量的定价。没有隐藏的限制或意外的速率变化。如果您需要一个简单、强大的文本 API,这就是您需要的基础设施。
即插即用 OpenAI 兼容性
我们的 API 旨在与您的现有工作流程无缝集成。它支持标准的 POST /v1/chat/completions 接口,支持通过服务器发送事件 (SSE) 进行流式输出以及工具/函数调用。您可以使用 Python、Node.js 和其他语言的官方 OpenAI SDK。
from openai import OpenAI
client = OpenAI(base_url="https://api.llmhostingapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)要切换,您只需更新两个变量:基础 URL 和 API 密钥。要发送的模型 ID 只是 "uncensored"。这种方法保持代码库整洁,并将集成时间从数小时减少到几分钟。
一个无审查模型,零过滤
我们在自己的服务器上运行开放权重模型,经过调整,在合法成人用途下回答时不进行内容拒绝。这意味着你可以探索争议话题、性主题或尖锐幽默,而 AI 不会突然决定它“无法”回答。唯一始终适用的硬性限制是屏蔽涉及未成年人的性内容。
这不是多模型网关。您获得一个特定的高质量模型。这种专注确保了性能一致和定价可预测。您不为未使用的模型或路由开销付费。这是一个纯文本 API,没有图像、音频或视频生成。
不适合谁
如果你需要多种模型选择、嵌入或图像生成功能,我们的 API 不适合你。我们不提供微调、OCR 或搜索功能。如果你需要 SLA 保证或 SOC2 认证,这项独立服务可能无法满足你的企业合规需求。我们也不会像 GPT-4 或 Claude 等供应商那样进行路由切换;我们仅提供自己的无审查模型。如果你需要一个在十个不同供应商之间进行负载均衡的复杂路由器,请另寻他处。
问答
每百万 token 的价格是多少?
我们的定价为每 1M 输入 token $0.25,每 1M 输出 token $1.00。这是按量付费的预付额度模式。无月费或订阅费用。
这是 OpenAI 的模型吗?
不是,这是一个运行在我们自有 GPU 服务器上的开放权重模型。它不是 GPT、Claude、Gemini 或其他厂商的模型。该模型经过调整,无审查,且兼容 OpenAI API 格式。
如何开始试用?
每个新账户可获得 7 天有效的 $0.50 试用额度。你只需提供电子邮件和密码即可注册。开始测试 API 无需信用卡。
速率限制是多少?
每个 API 密钥的限制为每分钟 300 个请求。最大请求体大小为 8 MB。每个账户只有一个密钥,你可以随时重新生成该密钥以撤销访问权限。
你们会使用我的提示词进行训练吗?
不会,你的提示词不会用于训练。我们实行简单的隐私政策,你的数据不会用于改进我们的模型。创建账户只需电子邮件和密码。
只差一张表单,即可获得密钥
创建账户,复制密钥,更改基础 URL。这就是全部设置。
获取 API 密钥