Heretic LLMHeretic LLM: เอกสาร API
Heretic LLM: เอกสาร API
เริ่มต้นใช้งาน API ของ Heretic LLM ในไม่กี่นาที ใช้ SDK มาตรฐานของ OpenAI เพื่อส่งข้อความและรับคำตอบแบบไม่เซ็นเซอร์จากโมเดล 'uncensored' โดยไม่ต้องจัดการโครงสร้างพื้นฐาน GPU
URL ฐานและการตรวจสอบสิทธิ์
เพื่อเริ่มใช้งาน API ของ Heretic LLM ให้ชี้ไคลเอนต์ที่เข้ากันได้กับ OpenAI ไปยัง URL พื้นฐานของเรา: https://api.hereticllm.com/v1 API ใช้การตรวจสอบสิทธิ์ด้วยโทเคน Bearer มาตรฐาน คุณสามารถสร้างคีย์ API ได้โดยการสมัครสมาชิกด้วยเพียงอีเมลและรหัสผ่านในหน้า Get API Key คีย์จะแสดงทันทีหลังการสมัครสมาชิกและสามารถสร้างใหม่ได้ตลอดเวลา ซึ่งจะทำให้คีย์ก่อนหน้าหมดอายุ
ตั้งค่าตัวแปรสิ่งแวดล้อม OPENAI_API_KEY หรือส่งคีย์โดยตรงในการกำหนดค่าไคลเอนต์ของคุณ ตรวจสอบให้แน่ใจว่า URL ฐานของคุณอัปเดตเป็นเอนด์พอยต์ของ Heretic การตั้งค่านี้ช่วยให้คุณใช้ SDK อย่างเป็นทางการของ OpenAI ได้โดยไม่ต้องเปลี่ยนโค้ด เพียงแค่เปลี่ยน URL ฐานและคีย์
คำขอแรก
ส่งคำขอแรกไปยังเอนด์พอยต์ chat completions ตัวระบุโมเดลคือ uncensored โมเดลแบบเปิดน้ำหนักนี้ได้รับการปรับแต่งให้ตอบคำถามโดยไม่มีการปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย ทำให้เหมาะสำหรับการเขียนโค้ดแบบไม่เซ็นเซอร์ การเขียนเชิงสร้างสรรค์ หรือการวิจัย หน้าต่างบริบทรองรับโทเคนได้สูงสุด 100,000 โทเคนสำหรับทั้งพรอมต์และการสร้างข้อความรวมกัน
ด้านล่างคือตัวอย่าง cURL พื้นฐานเพื่อทดสอบเอนด์พอยต์ แทนที่ YOUR_API_KEY ด้วยคีย์จริงของคุณ
การตอบกลับจะเป็นวัตถุในรูปแบบมาตรฐานของ OpenAI ที่มีข้อความที่สร้างโดยโมเดล
curl https://api.hereticllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
การผสาน SDK Python
ผสาน API เข้ากับแอปพลิเคชัน Python ของคุณโดยใช้แพ็คเกจ openai ทางการ ไลบรารีจัดการการแปลงข้อมูล JSON และการสตรีมมิงอัตโนมัติ เริ่มต้นไคลเอนต์ด้วยคีย์ API และ URL ฐานที่ถูกต้อง จากนั้นเรียกใช้ chat.completions.create ด้วยรหัสโมเดล uncensored
วิธีนี้ทำงานได้อย่างราบรื่นทั้งสำหรับเวิร์กโฟลว์แบบซิงโครนัสและอะซิงโครนัส โมเดลตอบสนองต่อพรอมต์มาตรฐาน การเรียกใช้ฟังก์ชัน และพารามิเตอร์สตรีมมิง เหมือนกับเอนด์พอยต์ที่เข้ากันได้กับ OpenAI อื่นๆ คุณสามารถส่งพรอมต์ระบบเพื่อควบคุมพฤติกรรมของโมเดลหรือใช้ข้อความผู้ใช้สำหรับการโต้ตอบโดยตรง
from openai import OpenAI
client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
การผสาน SDK Node.js
สำหรับโปรเจกต์ JavaScript และ TypeScript ใช้แพ็คเกจ npm openai กำหนดค่าไคลเอนต์ด้วย URL ฐานของ Heretic และคีย์ API ของคุณ API รองรับโครงสร้างคำขอมาตรฐาน รวมถึงคำจำกัดความของเครื่องมือและการเรียกใช้ฟังก์ชัน
ตรวจสอบให้แน่ใจว่าคุณจัดการการตอบกลับได้อย่างถูกต้อง โดยเฉพาะเมื่อใช้รูปแบบ async/await โมเดลส่งคืนข้อความที่สามารถประมวลผลโดยตรงในตรรกะแอปพลิเคชันของคุณ การผสานนี้เหมาะสำหรับการสร้างอินเทอร์เฟซแชท ตัวแทนอัตโนมัติ หรือท่อประมวลผลข้อมูลที่ต้องการความสามารถ LLM แบบไม่เซ็นเซอร์
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
การตอบกลับแบบสตรีมมิง
เปิดใช้งานการตอบกลับแบบเรียลไทม์โดยการเปิดใช้งานสตรีมมิงในคำขอ API ของคุณ ตั้งค่าพารามิเตอร์ stream เป็น true API จะส่งคืนสตรีม Server-Sent Events (SSE) ที่มีชิ้นส่วนข้อความเมื่อสร้าง ลดความล่าช้าที่รับรู้และให้ประสบการณ์ผู้ใช้ที่ราบรื่นยิ่งขึ้นสำหรับแอปพลิเคชันแชท
แต่ละชิ้นในสตรีมมีส่วนของคำตอบ จัดการชิ้นส่วนเหล่านี้แบบเพิ่มทีละน้อยเพื่ออัปเดต UI ของคุณแบบเรียลไทม์ คุณสมบัติสตรีมมิงเข้ากันได้เต็มที่กับ SDK ของ OpenAI ดังนั้นคุณสามารถใช้ตัววนซ้ำ stream หรือตัวฟังเหตุการณ์มาตรฐานเพื่อประมวลผลข้อมูลได้อย่างมีประสิทธิภาพ
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
ขีดจำกัดอัตรา ข้อผิดพลาด และบริบท
API กำหนดขีดจำกัด 300 คำขอต่อนาทีต่อคีย์และขนาดร่างกายคำขอ 8 MB หากคุณเกินขีดจำกัดอัตรา คุณจะรับข้อผิดพลาด 429 ข้อผิดพลาดการตรวจสอบสิทธิ์จะส่งสถานะ 401 ซึ่งบ่งชี้ว่าคีย์ API ไม่ถูกต้องหรือหายไป หากเครดิตแบบเติมเงินล่วงหน้าของคุณหมด API จะส่งข้อผิดพลาด 402 ซึ่งต้องการการเติมเงิน
เครดิตไม่หมดอายุ และคุณสามารถเติมเงินเริ่มต้นที่ $10 โดยใช้คริปโต (USDT หรือ USDC) พร้อมเครดิตโบนัสสำหรับการฝากเงินจำนวนมากขึ้น โมเดลรองรับหน้าต่างบริบทขนาด 100,000 โทเคน ตรวจสอบให้แน่ใจว่าพรอมต์และการสร้างข้อความของคุณอยู่ในขีดจำกัดนี้ สำหรับรายละเอียดเพิ่มเติมเกี่ยวกับราคาและขีดจำกัด โปรดไปที่หน้า Pricing
ข้อมูลจำเพาะทางเทคนิค
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| Base URL | https://api.hereticllm.com/v1 |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| ID โมเดล | uncensored |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| โหมด JSON | response_format: {"type": "json_object"} |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
โมเดลไม่เซ็นเซอร์ใช้ฟรีไหม
โมเดลไม่ฟรี แต่ใช้ระบบเครดิตแบบเติมเงินล่วงหน้าตามการใช้งาน บัญชีใหม่ได้รับเครดิตทดลองใช้ $0.50 ใช้ได้ 7 วัน เครดิตที่จ่ายแล้วไม่หมดอายุ และคุณสามารถเติมเงินขั้นต่ำ $10
ขนาดหน้าต่างบริบทคือเท่าไร
โมเดลรองรับหน้าต่างบริบท 100,000 โทเคน ซึ่งรวมพรอมต์ขาเข้าและการสร้างคำตอบ ช่วยให้การสนทนาแบบยาวและการประมวลผลข้อมูลขนาดใหญ่เป็นไปได้
API รองรับ tool calling ไหม
ใช่ API รองรับ tool และ function calling คุณสามารถกำหนดเครื่องมือในคำขอ และโมเดลจะตอบกลับด้วยข้อมูลที่มีโครงสร้างซึ่งแอปพลิเคชันของคุณสามารถนำไปใช้ได้ เข้ากันได้กับรูปแบบมาตรฐานของ OpenAI SDK
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน URL ฐาน นั่นคือการตั้งค่าทั้งหมด