JA ▾
API キーを取得

Heretic LLMHeretic LLM: APIドキュメント

Heretic LLM: APIドキュメント

数分でHeretic LLM APIの導入を開始。GPUインフラの管理なしで、標準的なOpenAI SDKを使用してテキストを送信し、無検閲モデルから無検閲の応答を受け取ります。

ベースURLと認証

Heretic LLM APIを使用するには、OpenAI互換クライアントをベースURLのhttps://api.hereticllm.com/v1に設定します。APIは標準的なBearerトークン認証を使用します。APIキーは、Get API Keyページでメールアドレスとパスワードのみでサインアップすることで生成できます。キーはサインアップ直後に表示され、いつでも再生成可能ですが、再生成すると以前のキーは無効になります。

環境変数 OPENAI_API_KEY を設定するか、クライアント設定にキーを直接渡します。ベースURLをHereticエンドポイントに更新してください。この設定により、ベースURLとキーを置き換えるだけで、コード変更なしで公式のOpenAI SDKを使用できます。

最初のリクエスト

チャット補完エンドポイントに最初のリクエストを送信します。モデル識別子はuncensoredです。このオープンウェイトモデルは、法的な成人利用に対してコンテンツ拒否なしで回答するようにチューニングされており、無検閲のコーディング、クリエイティブライティング、または研究に最適です。コンテキストウィンドウは、プロンプトと補完を合わせて最大100,000トークンをサポートします。

以下はエンドポイントをテストするための基本的なcURL例です。YOUR_API_KEY を実際のキーに置き換えてください。

応答は、生成されたテキストを含む標準的なOpenAI形式のオブジェクトになります。

curl https://api.hereticllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK統合

公式の openai パッケージを使用して、APIをPythonアプリケーションに統合します。ライブラリはJSONシリアライズとストリーミングを自動的に処理します。API キーと正しいベースURLを使用してクライアントを初期化します。次に、モデルID uncensored で chat.completions.create を呼び出します。

このアプローチは同期および非同期のワークフローの両方でシームレスに動作します。モデルは標準的なプロンプト、関数呼び出し、ストリーミングパラメータに応答します。モデルの動作をガイドするシステムプロンプトを渡すか、直接対話にユーザーメッセージを使用できます。

from openai import OpenAI

client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js SDK統合

JavaScriptおよびTypeScriptプロジェクトでは、openai npmパッケージを使用します。HereticのベースURLとAPIキーを使用してクライアントを設定します。APIはツール定義や関数呼び出しを含む標準的なリクエスト構造をサポートしています。

特にasync/awaitパターンを使用する際は、応答を正しく処理してください。モデルはアプリケーションロジックで直接処理できるテキスト応答を返します。この統合は、無検閲LLM機能が必要なチャットインターフェース、自律型エージェント、またはデータ処理パイプラインの構築に最適です。

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

ストリーミング応答

APIリクエストでストリーミングを有効にしてリアルタイム応答を有効にします。streamパラメータをtrueに設定します。APIは生成されるテキストのチャンクを含むServer-Sent Events (SSE)ストリームを返します。これにより体感レイテンシが削減され、チャットアプリケーションでよりスムーズなユーザーエクスペリエンスが提供されます。

ストリームの各チャンクには応答の一部が含まれています。これらのチャンクを逐次処理して、UIをリアルタイムで更新してください。ストリーミング機能はOpenAI SDKと完全に互換性があるため、データを効率的に処理するために標準の stream イテレータまたはイベントリスナーを使用できます。

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

レート制限、エラー、コンテキスト

APIはキーごとに1分あたり300リクエスト、リクエストボディサイズ8 MBの制限を適用します。レート制限を超えると429エラーが発生します。認証エラーは401ステータスを返し、無効または欠落したAPIキーを示します。前払いクレジットが枯渇すると、チャージが必要であることを示す402エラーが返されます。

クレジットは期限切れにならず、より大きな入金にはボーナスクレジットが付与されます。モデルは100,000トークンのコンテキストウィンドウをサポートしています。プロンプトと補完がこの制限内に収まるようにしてください。価格と制限の詳細については、Pricingページをご覧ください。

技術仕様

購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。

項目内容
形式OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作
Base URLhttps://api.hereticllm.com/v1
エンドポイントPOST /v1/chat/completions · GET /v1/models
認証Authorization: Bearer YOUR_KEY
モデル IDuncensored
関数呼び出し対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送
JSON モードresponse_format: {"type": "json_object"}
パラメータtemperature、top_p、stop、seed、presence_penalty、frequency_penalty
最大出力100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし)
コンテキスト長100,000 トークン(入力+出力)
ストリーミング対応 — SSE、最後のチャンクにトークン使用量
リクエストサイズ最大 8 MB
同時実行キーごとに同時 8 リクエストまで
レスポンスヘッダーX-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency
レート制限キーごとに毎分 300 リクエスト
課金前払いクレジットから実使用量で課金。エラーと拒否は無料
無料トライアル$0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大
料金入力 100 万トークン $0.25 · 出力 100 万トークン $1.00
有効期限購入クレジットは失効なし、サブスクなし
ボーナス$50 以上で +5%、$100 以上で +10%
チャージUSDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額
ログインGoogle またはメール+パスワード
キーアカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効
コンテンツ成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否

エラーコード

エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。

コードタイプ意味
400bad_requestJSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過
401missing_key · invalid_key · key_revokedキーなし・誤り・新しいキーに置換済み
402no_credit残高ゼロ — チャージすれば即再開
403content_blocked未成年者を含む性的コンテンツ — 拒否、課金なし
404not_found不明なエンドポイント
413request_too_large本文が 8 MB 超
429rate_limited · concurrency毎分 300 回または同時 8 件を超過 — 待って再試行
503upstream_busyモデル混雑 — 数秒後に再試行

質問と回答

無検閲モデルは無料ですか?

モデルは無料ではなく、従量課金制の前払いクレジット方式を採用しています。新規アカウントには7日間有効な$0.50の無料トライアルクレジットが付与されます。有料クレジットは期限切れにならず、$10からチャージ可能です。

コンテキストウィンドウのサイズは?

モデルは、入力プロンプトと生成された補完の両方を含む100,000トークンのコンテキストウィンドウをサポートしています。これにより、長文脈の対話や大規模なデータ処理タスクが可能になります。

APIはツール呼び出しをサポートしていますか?

はい、APIはツールおよび関数呼び出しをサポートしています。リクエストでツールを定義すると、モデルはアプリケーションで実行可能な構造化データを返します。これは標準的なOpenAI SDKパターンと互換性があります。

キーはフォーム 1 つで手に入ります

アカウントを作成し、キーをコピーし、ベースURLを変更します。これがセットアップのすべてです。

APIキーを取得ドキュメントを読む