繁中 ▾
取得 API 金鑰

Heretic LLMHeretic LLM:API 文件

Heretic LLM:API 文件

幾分鐘內即可開始使用 Heretic LLM API。使用標準 OpenAI SDK 發送文字並接收來自「uncensored」模型的無審查回應,無需管理 GPU 基礎設施。

基礎 URL 與驗證

要開始使用 Heretic LLM API,請將你的 OpenAI 相容客戶端指向基礎 URL:https://api.hereticllm.com/v1。API 使用標準 Bearer token 驗證。你可以在「取得 API 金鑰」頁面僅使用電子郵件和密碼註冊來生成 API 金鑰。金鑰在註冊後立即顯示,且可隨時重新生成,這將使舊金鑰失效。

設定 OPENAI_API_KEY 環境變數,或在客戶端設定中直接傳遞金鑰。請將基礎 URL 更新為 Heretic 端點。此設定讓您可以零程式碼變更地使用官方 OpenAI SDK,只需更換基礎 URL 和金鑰即可。

首次請求

向聊天完成端點發送首次請求。模型識別碼為 uncensored。此開放權重模型經過調整,可針對合法成人用途無內容拒絕地回答,非常適合無審查的程式碼編寫、創意寫作或研究。上下文視窗支援最多 100,000 token,包含提示詞與生成結果的總和。

以下是測試端點的基礎 cURL 範例。請將 YOUR_API_KEY 替換為你的實際金鑰。

回應將是包含生成文字的標準 OpenAI 格式物件。

curl https://api.hereticllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK 整合

使用官方 openai 套件將 API 整合至你的 Python 應用程式。該函式庫自動處理 JSON 序列化和串流。使用你的 API 金鑰和正確的基礎 URL 初始化客戶端。然後,以模型 ID uncensored 呼叫 chat.completions.create。

此方法對同步和非同步工作流程均無縫運作。模型對標準提示詞、函式呼叫和串流參數的回應方式與其他 OpenAI 相容端點相同。你可以傳遞系統提示詞以引導模型行為,或使用使用者訊息進行直接互動。

from openai import OpenAI

client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js SDK 整合

對於 JavaScript 和 TypeScript 專案,請使用 openai npm 套件。使用 Heretic 基礎 URL 和你的 API 金鑰設定客戶端。API 支援標準請求結構,包括工具定義和函式呼叫。

請確保正確處理回應,特別是在使用 async/await 模式時。模型回傳的文字回應可直接在你的應用程式邏輯中處理。此整合非常適合建構需要無審查 LLM 能力的聊天介面、自動化代理程式或數據處理管線。

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

串流回應

在 API 請求中啟用串流輸出以啟用即時回應。將 stream 參數設為 true。API 將回傳伺服器推送事件 (SSE) 串流,包含生成中的文字區塊。這可降低感知延遲,並為聊天應用程式提供更流暢的使用者體驗。

串流中的每個區塊包含回應的一部分。增量處理這些區塊以即時更新你的 UI。串流功能完全相容 OpenAI SDK,因此你可以使用標準 stream 迭代器或事件監聽器來高效處理資料。

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

速率限制、錯誤與上下文

API 對每個金鑰實施每分鐘 300 次請求的限制,以及 8 MB 的請求主體大小。如果你超過速率限制,將收到 429 錯誤。驗證錯誤回傳 401 狀態,表示 API 金鑰無效或缺失。如果你的預付額度耗盡,API 回傳 402 錯誤,需要儲值。

額度永不過期,你可以使用加密貨幣 (USDT 或 USDC) 從 $10 開始儲值,較大存款享有額外額度。模型支援 100,000 token 上下文視窗。確保你的提示詞和生成結果在此限制內。更多定價和限制詳情,請造訪定價頁面。

技術規格

購買額度前,請先確認介面是否符合你的需求——以下是全部真實參數。

項目說明
介面格式相容 OpenAI:任何 OpenAI SDK 只需更換 base URL 和金鑰
Base URLhttps://api.hereticllm.com/v1
端點POST /v1/chat/completions · GET /v1/models
驗證Authorization: Bearer YOUR_KEY
模型 IDuncensored
函式呼叫支援 tools、tool_choice;回覆包含 tool_calls(串流同樣支援),結果以 role: tool 訊息回傳
JSON 模式response_format: {"type": "json_object"}
取樣參數temperature、top_p、stop、seed、presence_penalty、frequency_penalty
最大輸出不另設輸出上限;提示+回覆共 100,000 個 token 視窗內,max_tokens 可選
上下文視窗100,000 tokens(輸入與輸出合計)
串流輸出支援 SSE,最後一段包含 token 用量
請求大小每次請求不超過 8 MB
並行請求每把金鑰同時最多 8 個請求
回應標頭X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency
速率限制每把金鑰每分鐘 300 次請求
計費預付額度,按實際 token 用量扣費;錯誤和拒絕不收費
免費試用$0.50,有效期 7 天,不需信用卡 · 試用金鑰:2 個並行請求,每分鐘 60 次;首次儲值後恢復完整限額(8 和 300)
價格輸入 $0.25 / 百萬 tokens · 輸出 $1.00 / 百萬 tokens
額度效期付費額度永不過期,無訂閱
贈送額度滿 $50 送 5%,滿 $100 送 10%
儲值USDT(TRC20)或 USDC(Base),$10–$500 任意整數金額
登入Google 或電子郵件 + 密碼
金鑰每個帳戶一把有效金鑰;產生新金鑰後舊金鑰失效
內容政策允許成人內容;涉及未成年人的性內容一律拒絕

錯誤代碼

錯誤以 JSON 回傳,type 欄位固定;失敗或被拒絕的請求不計費。

狀態碼類型含義
400bad_requestJSON 無效、訊息為空、參數錯誤或超出上下文視窗
401missing_key · invalid_key · key_revoked缺少金鑰、金鑰錯誤或已被新金鑰取代
402no_credit餘額不足——儲值後立即恢復
403content_blocked涉及未成年人的性內容——拒絕且不計費
404not_found未知端點
413request_too_large請求內容超過 8 MB
429rate_limited · concurrency超過每分鐘 300 次或 8 個並行——稍後重試
503upstream_busy模型忙碌——幾秒後重試

問答

無審查模型免費嗎?

模型非免費,採預付額度計費。新帳號獲贈 $0.50 試用額度,有效期 7 天。付費額度永不過期,最低儲值 $10。

上下文視窗大小為何?

模型支援 100,000 token 上下文視窗,包含輸入提示詞與生成結果。適合長上下文互動與大數據處理。

API 是否支援工具呼叫?

是,API 支援工具與函式呼叫。你可以在請求中定義工具,模型將回傳結構化資料供應用程式執行。相容標準 OpenAI SDK 模式。

只差一張表單,即可取得金鑰

建立帳號、複製金鑰、更改基礎 URL。這就是全部設定。

取得 API 金鑰閱讀文件