Heretic LLMHeretic LLM: APIドキュメント
Heretic LLM: APIドキュメント
数分でHeretic LLM APIの導入を開始。GPUインフラの管理なしで、標準的なOpenAI SDKを使用してテキストを送信し、無検閲モデルから無検閲の応答を受け取ります。
ベースURLと認証
Heretic LLM APIを使用するには、OpenAI互換クライアントをベースURLのhttps://api.hereticllm.com/v1に設定します。APIは標準的なBearerトークン認証を使用します。APIキーは、Get API Keyページでメールアドレスとパスワードのみでサインアップすることで生成できます。キーはサインアップ直後に表示され、いつでも再生成可能ですが、再生成すると以前のキーは無効になります。
環境変数 OPENAI_API_KEY を設定するか、クライアント設定にキーを直接渡します。ベースURLをHereticエンドポイントに更新してください。この設定により、ベースURLとキーを置き換えるだけで、コード変更なしで公式のOpenAI SDKを使用できます。
最初のリクエスト
チャット補完エンドポイントに最初のリクエストを送信します。モデル識別子はuncensoredです。このオープンウェイトモデルは、法的な成人利用に対してコンテンツ拒否なしで回答するようにチューニングされており、無検閲のコーディング、クリエイティブライティング、または研究に最適です。コンテキストウィンドウは、プロンプトと補完を合わせて最大100,000トークンをサポートします。
以下はエンドポイントをテストするための基本的なcURL例です。YOUR_API_KEY を実際のキーに置き換えてください。
応答は、生成されたテキストを含む標準的なOpenAI形式のオブジェクトになります。
curl https://api.hereticllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK統合
公式の openai パッケージを使用して、APIをPythonアプリケーションに統合します。ライブラリはJSONシリアライズとストリーミングを自動的に処理します。API キーと正しいベースURLを使用してクライアントを初期化します。次に、モデルID uncensored で chat.completions.create を呼び出します。
このアプローチは同期および非同期のワークフローの両方でシームレスに動作します。モデルは標準的なプロンプト、関数呼び出し、ストリーミングパラメータに応答します。モデルの動作をガイドするシステムプロンプトを渡すか、直接対話にユーザーメッセージを使用できます。
from openai import OpenAI
client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js SDK統合
JavaScriptおよびTypeScriptプロジェクトでは、openai npmパッケージを使用します。HereticのベースURLとAPIキーを使用してクライアントを設定します。APIはツール定義や関数呼び出しを含む標準的なリクエスト構造をサポートしています。
特にasync/awaitパターンを使用する際は、応答を正しく処理してください。モデルはアプリケーションロジックで直接処理できるテキスト応答を返します。この統合は、無検閲LLM機能が必要なチャットインターフェース、自律型エージェント、またはデータ処理パイプラインの構築に最適です。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
ストリーミング応答
APIリクエストでストリーミングを有効にしてリアルタイム応答を有効にします。streamパラメータをtrueに設定します。APIは生成されるテキストのチャンクを含むServer-Sent Events (SSE)ストリームを返します。これにより体感レイテンシが削減され、チャットアプリケーションでよりスムーズなユーザーエクスペリエンスが提供されます。
ストリームの各チャンクには応答の一部が含まれています。これらのチャンクを逐次処理して、UIをリアルタイムで更新してください。ストリーミング機能はOpenAI SDKと完全に互換性があるため、データを効率的に処理するために標準の stream イテレータまたはイベントリスナーを使用できます。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
レート制限、エラー、コンテキスト
APIはキーごとに1分あたり300リクエスト、リクエストボディサイズ8 MBの制限を適用します。レート制限を超えると429エラーが発生します。認証エラーは401ステータスを返し、無効または欠落したAPIキーを示します。前払いクレジットが枯渇すると、チャージが必要であることを示す402エラーが返されます。
クレジットは期限切れにならず、より大きな入金にはボーナスクレジットが付与されます。モデルは100,000トークンのコンテキストウィンドウをサポートしています。プロンプトと補完がこの制限内に収まるようにしてください。価格と制限の詳細については、Pricingページをご覧ください。
技術仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| Base URL | https://api.hereticllm.com/v1 |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| 認証 | Authorization: Bearer YOUR_KEY |
| モデル ID | uncensored |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| JSON モード | response_format: {"type": "json_object"} |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 最大出力 | 100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| コンテキスト長 | 100,000 トークン(入力+出力) |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| リクエストサイズ | 最大 8 MB |
| 同時実行 | キーごとに同時 8 リクエストまで |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| レート制限 | キーごとに毎分 300 リクエスト |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| ログイン | Google またはメール+パスワード |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
無検閲モデルは無料ですか?
モデルは無料ではなく、従量課金制の前払いクレジット方式を採用しています。新規アカウントには7日間有効な$0.50の無料トライアルクレジットが付与されます。有料クレジットは期限切れにならず、$10からチャージ可能です。
コンテキストウィンドウのサイズは?
モデルは、入力プロンプトと生成された補完の両方を含む100,000トークンのコンテキストウィンドウをサポートしています。これにより、長文脈の対話や大規模なデータ処理タスクが可能になります。
APIはツール呼び出しをサポートしていますか?
はい、APIはツールおよび関数呼び出しをサポートしています。リクエストでツールを定義すると、モデルはアプリケーションで実行可能な構造化データを返します。これは標準的なOpenAI SDKパターンと互換性があります。