Heretic LLMHeretic LLM:API 文件
Heretic LLM:API 文件
幾分鐘內即可開始使用 Heretic LLM API。使用標準 OpenAI SDK 發送文字並接收來自「uncensored」模型的無審查回應,無需管理 GPU 基礎設施。
基礎 URL 與驗證
要開始使用 Heretic LLM API,請將你的 OpenAI 相容客戶端指向基礎 URL:https://api.hereticllm.com/v1。API 使用標準 Bearer token 驗證。你可以在「取得 API 金鑰」頁面僅使用電子郵件和密碼註冊來生成 API 金鑰。金鑰在註冊後立即顯示,且可隨時重新生成,這將使舊金鑰失效。
設定 OPENAI_API_KEY 環境變數,或在客戶端設定中直接傳遞金鑰。請將基礎 URL 更新為 Heretic 端點。此設定讓您可以零程式碼變更地使用官方 OpenAI SDK,只需更換基礎 URL 和金鑰即可。
首次請求
向聊天完成端點發送首次請求。模型識別碼為 uncensored。此開放權重模型經過調整,可針對合法成人用途無內容拒絕地回答,非常適合無審查的程式碼編寫、創意寫作或研究。上下文視窗支援最多 100,000 token,包含提示詞與生成結果的總和。
以下是測試端點的基礎 cURL 範例。請將 YOUR_API_KEY 替換為你的實際金鑰。
回應將是包含生成文字的標準 OpenAI 格式物件。
curl https://api.hereticllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK 整合
使用官方 openai 套件將 API 整合至你的 Python 應用程式。該函式庫自動處理 JSON 序列化和串流。使用你的 API 金鑰和正確的基礎 URL 初始化客戶端。然後,以模型 ID uncensored 呼叫 chat.completions.create。
此方法對同步和非同步工作流程均無縫運作。模型對標準提示詞、函式呼叫和串流參數的回應方式與其他 OpenAI 相容端點相同。你可以傳遞系統提示詞以引導模型行為,或使用使用者訊息進行直接互動。
from openai import OpenAI
client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js SDK 整合
對於 JavaScript 和 TypeScript 專案,請使用 openai npm 套件。使用 Heretic 基礎 URL 和你的 API 金鑰設定客戶端。API 支援標準請求結構,包括工具定義和函式呼叫。
請確保正確處理回應,特別是在使用 async/await 模式時。模型回傳的文字回應可直接在你的應用程式邏輯中處理。此整合非常適合建構需要無審查 LLM 能力的聊天介面、自動化代理程式或數據處理管線。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
串流回應
在 API 請求中啟用串流輸出以啟用即時回應。將 stream 參數設為 true。API 將回傳伺服器推送事件 (SSE) 串流,包含生成中的文字區塊。這可降低感知延遲,並為聊天應用程式提供更流暢的使用者體驗。
串流中的每個區塊包含回應的一部分。增量處理這些區塊以即時更新你的 UI。串流功能完全相容 OpenAI SDK,因此你可以使用標準 stream 迭代器或事件監聽器來高效處理資料。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
速率限制、錯誤與上下文
API 對每個金鑰實施每分鐘 300 次請求的限制,以及 8 MB 的請求主體大小。如果你超過速率限制,將收到 429 錯誤。驗證錯誤回傳 401 狀態,表示 API 金鑰無效或缺失。如果你的預付額度耗盡,API 回傳 402 錯誤,需要儲值。
額度永不過期,你可以使用加密貨幣 (USDT 或 USDC) 從 $10 開始儲值,較大存款享有額外額度。模型支援 100,000 token 上下文視窗。確保你的提示詞和生成結果在此限制內。更多定價和限制詳情,請造訪定價頁面。
技術規格
購買額度前,請先確認介面是否符合你的需求——以下是全部真實參數。
| 項目 | 說明 |
|---|---|
| 介面格式 | 相容 OpenAI:任何 OpenAI SDK 只需更換 base URL 和金鑰 |
| Base URL | https://api.hereticllm.com/v1 |
| 端點 | POST /v1/chat/completions · GET /v1/models |
| 驗證 | Authorization: Bearer YOUR_KEY |
| 模型 ID | uncensored |
| 函式呼叫 | 支援 tools、tool_choice;回覆包含 tool_calls(串流同樣支援),結果以 role: tool 訊息回傳 |
| JSON 模式 | response_format: {"type": "json_object"} |
| 取樣參數 | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 最大輸出 | 不另設輸出上限;提示+回覆共 100,000 個 token 視窗內,max_tokens 可選 |
| 上下文視窗 | 100,000 tokens(輸入與輸出合計) |
| 串流輸出 | 支援 SSE,最後一段包含 token 用量 |
| 請求大小 | 每次請求不超過 8 MB |
| 並行請求 | 每把金鑰同時最多 8 個請求 |
| 回應標頭 | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 速率限制 | 每把金鑰每分鐘 300 次請求 |
| 計費 | 預付額度,按實際 token 用量扣費;錯誤和拒絕不收費 |
| 免費試用 | $0.50,有效期 7 天,不需信用卡 · 試用金鑰:2 個並行請求,每分鐘 60 次;首次儲值後恢復完整限額(8 和 300) |
| 價格 | 輸入 $0.25 / 百萬 tokens · 輸出 $1.00 / 百萬 tokens |
| 額度效期 | 付費額度永不過期,無訂閱 |
| 贈送額度 | 滿 $50 送 5%,滿 $100 送 10% |
| 儲值 | USDT(TRC20)或 USDC(Base),$10–$500 任意整數金額 |
| 登入 | Google 或電子郵件 + 密碼 |
| 金鑰 | 每個帳戶一把有效金鑰;產生新金鑰後舊金鑰失效 |
| 內容政策 | 允許成人內容;涉及未成年人的性內容一律拒絕 |
錯誤代碼
錯誤以 JSON 回傳,type 欄位固定;失敗或被拒絕的請求不計費。
| 狀態碼 | 類型 | 含義 |
|---|---|---|
400 | bad_request | JSON 無效、訊息為空、參數錯誤或超出上下文視窗 |
401 | missing_key · invalid_key · key_revoked | 缺少金鑰、金鑰錯誤或已被新金鑰取代 |
402 | no_credit | 餘額不足——儲值後立即恢復 |
403 | content_blocked | 涉及未成年人的性內容——拒絕且不計費 |
404 | not_found | 未知端點 |
413 | request_too_large | 請求內容超過 8 MB |
429 | rate_limited · concurrency | 超過每分鐘 300 次或 8 個並行——稍後重試 |
503 | upstream_busy | 模型忙碌——幾秒後重試 |
問答
無審查模型免費嗎?
模型非免費,採預付額度計費。新帳號獲贈 $0.50 試用額度,有效期 7 天。付費額度永不過期,最低儲值 $10。
上下文視窗大小為何?
模型支援 100,000 token 上下文視窗,包含輸入提示詞與生成結果。適合長上下文互動與大數據處理。
API 是否支援工具呼叫?
是,API 支援工具與函式呼叫。你可以在請求中定義工具,模型將回傳結構化資料供應用程式執行。相容標準 OpenAI SDK 模式。