TH ▾
รับคีย์ API

LLM Hosting APILLM Hosting: คู่มือเริ่มต้นใช้งาน API LLM

การโฮสต์ LLM: คู่มือเริ่มต้น API LLM

ผสาน API LLMแบบไม่เซ็นเซอร์ของเราในไม่กี่นาทีโดยการเปลี่ยน URL พื้นฐานและคีย์ API คู่มือนี้ครอบคลุมการตรวจสอบสิทธิ์ การตอบแชท สตรีมมิง และการเรียกใช้ฟังก์ชันกับเอนด์พอยต์ที่เข้ากันได้กับ OpenAI ของเรา

การตรวจสอบสิทธิ์และคีย์

เพื่อใช้ API LLM Hosting คุณต้องมีคีย์ API จากแดชบอร์ดบัญชีของคุณ คีย์นี้จะยืนยันตัวตนสำหรับคำขอทั้งหมด เก็บคีย์ให้ปลอดภัย ใครที่มีคีย์สามารถใช้เครดิตแบบเติมเงินล่วงหน้าของคุณได้ คุณสามารถสร้างคีย์ใหม่ได้ทุกเมื่อ ซึ่งจะทำให้คีย์ก่อนหน้าใช้ไม่ได้ทันที บัญชีแต่ละบัญชีรองรับคีย์ที่ใช้งานอยู่ได้เพียงหนึ่งคีย์ ไม่ต้องใช้หมายเลขโทรศัพท์หรือบัตรเครดิตเพื่อเริ่มต้น เนื่องจากบัญชีใหม่จะได้รับเครดิตทดลองใช้ฟรี

การกำหนดค่า URL พื้นฐาน

API ของเราเข้ากันได้กับ OpenAI อย่างสมบูรณ์ เพื่อเปลี่ยน ให้อัปเดต base URL ของไคลเอนต์ของคุณเป็น https://api.llmhostingapi.com/v1 และตั้งค่าคีย์ API ในส่วนหัวการตรวจสอบสิทธิ์ สิ่งนี้ใช้งานได้กับ SDK ทางการของ OpenAI และไลบรารีไคลเอนต์ที่เข้ากันได้ทุกชนิด คุณไม่จำเป็นต้องเปลี่ยนตรรกะของโค้ด เพียงแค่เปลี่ยนเอนด์พอยต์และข้อมูลรับรอง โมเดล identifier ที่ต้องใช้คือ uncensored

curl https://api.llmhostingapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

เอนด์พอยต์การตอบแชท

ส่งข้อความไปยังโมเดลผ่าน POST /v1/chat/completions API รับข้อความและส่งกลับข้อความตอบกลับ เราสนับสนุนหน้าต่างบริบท 100,000 โทเคนสำหรับทั้งอินพุตและเอาต์พุต รองรับ function calling สำหรับการแยกข้อมูลที่มีโครงสร้าง โมเดลถูกปรับแต่งให้ตอบคำถามโดยไม่ปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย ทำให้เหมาะสำหรับการสร้างสรรค์งานวิจัย หรือการสร้างเนื้อหาสำหรับผู้ใหญ่โดยไม่ต้องกำหนดค่าเพิ่มเติม

from openai import OpenAI

client = OpenAI(base_url="https://api.llmhostingapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

การตอบแบบสตรีมมิง (SSE)

เพื่อลด latency และประสบการณ์ผู้ใช้แบบเรียลไทม์ ให้เปิดใช้งานสตรีมมิงโดยตั้งค่า stream: true API ส่งคืนข้อมูลแบบ Server-Sent Events (SSE) แบบ chunking สิ่งนี้ช่วยให้คุณแสดงการตอบสนองบางส่วนเมื่อถูกสร้างขึ้นได้ การสตรีมมิงไม่ส่งผลต่อราคาหรือจำนวนโทเคน แนะนำสำหรับอินเทอร์เฟซแชทที่ผู้ใช้คาดหวังการตอบสนองทันที ตรวจสอบให้แน่ใจว่าไคลเอนต์ของคุณจัดการการแยกวิเคราะห์ SSE ได้ถูกต้อง

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

การรองรับการเรียกใช้ฟังก์ชัน

กำหนดฟังก์ชันใน body ของคำขอของคุณโดยใช้พารามิเตอร์ tools โมเดลจะตอบกลับด้วยการเรียกใช้ฟังก์ชันแทนข้อความธรรมดาเมื่อเหมาะสม คุณต้องเรียกใช้ฟังก์ชันฝั่งของคุณและส่งผลลัพธ์กลับในการสนทนาครั้งถัดไป สิ่งนี้เปิดใช้งานเวิร์กโฟลว์ที่ซับซ้อนเช่นการสอบถามฐานข้อมูลหรือการผสานรวม API โมเดลจัดการการเลือกเครื่องมือโดยอัตโนมัติตามพรอมต์ของผู้ใช้และคำจำกัดความของฟังก์ชันที่มีอยู่

เอนด์พอยต์แสดงรายการโมเดล

เรียกใช้ GET /v1/models เพื่อแสดงรายการโมเดลที่มีอยู่ คุณจะเห็นโมเดล uncensored พร้อม ID วันที่สร้าง และฟิลด์เจ้าของ เอนด์พอยต์นี้ช่วยตรวจสอบการเชื่อมต่อและความพร้อมของโมเดล ส่งคืน JSON รูปแบบมาตรฐานของ OpenAI ใช้เพื่อแก้ปัญหาการตรวจสอบสิทธิ์ก่อนส่งคำขอแชท เอนด์พอยต์นี้มีน้ำหนักเบาและส่งกลับทันที

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmhostingapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

ถาม-ตอบ

ขีดจำกัดอัตราและข้อผิดพลาดคืออะไร?

คุณมีจำกัดอยู่ที่ 300 คำขอต่อนาทีต่อคีย์ ข้อผิดพลาด 401 หมายถึงคีย์ API ของคุณไม่ถูกต้อง ข้อผิดพลาด 402 บ่งชี้ว่าเครดิตแบบเติมเงินล่วงหน้าไม่เพียงพอ ข้อผิดพลาด 429 หมายถึงคุณเกินขีดจำกัดอัตรา body ของคำขอจำกัดอยู่ที่ 8 MB

ระบบการคิดราคาทำงานอย่างไร?

ราคาเป็นแบบจ่ายตามการใช้งานพร้อมเครดิตแบบเติมเงินล่วงหน้า โทเคนอินพุตราคา $0.25 ต่อ 1M โทเคน และโทเคนเอาต์พุตราคา $1.00 ต่อ 1M โทเคน เครดิตไม่หมดอายุ คุณสามารถเติมเงินเริ่มต้นที่ $10 พร้อมโบนัสสำหรับการฝากเงินจำนวนมากขึ้น ไม่มีค่าธรรมเนียมรายเดือนหรือการสมัครสมาชิก

โมเดลไม่เซ็นเซอร์หรือไม่?

ใช่ โมเดลตอบคำถามโดยไม่ปฏิเสธสำหรับหัวข้อผู้ใหญ่ที่ถูกต้องตามกฎหมาย เรื่องแต่ง หรือหัวข้อที่ถกเถกันได้ มันไม่บล็อกเนื้อหาตามบรรทัดฐานทางการเมืองหรือสังคมทั่วไป ขีดจำกัดเดียวคือไม่มีเนื้อหาทางเพศที่เกี่ยวข้องกับเด็ก ซึ่งจะถูกบล็อกเสมอ

คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว

สร้างบัญชี คัดลอกคีย์ เปลี่ยน URL พื้นฐาน นั่นคือการตั้งค่าทั้งหมด

รับคีย์ API

ข้อมูลจำเพาะ API

ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน

รายการค่า
รูปแบบ APIรองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์
เอนด์พอยต์POST /v1/chat/completions · GET /v1/models
การยืนยันตัวตนAuthorization: Bearer YOUR_KEY
ID โมเดลuncensored
Base URLhttps://api.llmhostingapi.com/v1
สตรีมมิงรองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้
หน้าต่างบริบท100,000 โทเคน (อินพุตรวมเอาต์พุต)
พารามิเตอร์temperature, top_p, stop, seed, presence_penalty, frequency_penalty
การเรียกใช้ฟังก์ชันรองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool
เอาต์พุตสูงสุดได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก)
โหมด JSONresponse_format: {"type": "json_object"}
คำขอพร้อมกันสูงสุด 8 คำขอพร้อมกันต่อคีย์
ขีดจำกัดอัตรา300 คำขอต่อนาทีต่อคีย์
เฮดเดอร์ของคำตอบX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
ขนาดคำขอไม่เกิน 8 MB
เครดิตทดลองใช้ฟรี$0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก
อายุเครดิตเครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน
เติมเงินUSDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500
การคิดเงินเครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน
ราคา$0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต
โบนัส+5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100
คีย์หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม
เข้าสู่ระบบGoogle หรืออีเมลและรหัสผ่าน
เนื้อหาอนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์

รหัสข้อผิดพลาด

ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน

รหัสประเภทความหมาย
400bad_requestJSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท
401missing_key · invalid_key · key_revokedไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว
402no_creditเครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที
403content_blockedเนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน
404not_foundไม่รู้จักเอนด์พอยต์
413request_too_largeขนาดเกิน 8 MB
429rate_limited · concurrencyเกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่
503upstream_busyโมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที