VI ▾
Lấy khóa API

Heretic LLMHeretic LLM: Tài liệu API

Heretic LLM: Tài liệu API

Bắt đầu với API Heretic LLM trong vài phút. Sử dụng các SDK OpenAI tiêu chuẩn để gửi văn bản và nhận phản hồi không kiểm duyệt từ mô hình 'uncensored' mà không cần quản lý cơ sở hạ tầng GPU.

URL cơ bản và Xác thực

Để bắt đầu sử dụng API Heretic LLM, hãy trỏ máy khách tương thích OpenAI của bạn đến URL cơ sở của chúng tôi: https://api.hereticllm.com/v1. API sử dụng xác thực token Bearer tiêu chuẩn. Bạn có thể tạo khóa API bằng cách đăng ký chỉ với email và mật khẩu trên trang Tạo khóa API. Khóa được hiển thị ngay sau khi đăng ký và có thể được tạo lại bất cứ lúc nào, điều này sẽ vô hiệu hóa khóa trước đó.

Đặt biến môi trường OPENAI_API_KEY hoặc truyền khóa trực tiếp trong cấu hình máy khách của bạn. Đảm bảo URL cơ bản của bạn đã được cập nhật sang endpoint của Heretic. Cấu hình này cho phép bạn sử dụng các SDK OpenAI chính thức mà không cần thay đổi mã, chỉ bằng cách thay đổi URL cơ bản và khóa.

Yêu cầu đầu tiên

Thực hiện yêu cầu đầu tiên của bạn đến endpoint chat completions. Định danh mô hình là uncensored. Mô hình trọng số mở này được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người trưởng thành hợp pháp, khiến nó lý tưởng cho việc lập trình không kiểm duyệt, viết sáng tạo hoặc nghiên cứu. Cửa sổ ngữ cảnh hỗ trợ lên đến 100.000 token cho cả prompt và phần hoàn thành kết hợp.

Dưới đây là một ví dụ cURL cơ bản để kiểm tra endpoint. Thay thế YOUR_API_KEY bằng khóa thực tế của bạn.

Phản hồi sẽ là một đối tượng định dạng OpenAI tiêu chuẩn chứa văn bản được tạo ra.

curl https://api.hereticllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Tích hợp SDK Python

Tích hợp API vào các ứng dụng Python của bạn bằng cách sử dụng gói openai chính thức. Thư viện xử lý tự động việc tuần tự hóa JSON và truyền phát. Khởi tạo máy khách với khóa API và URL cơ bản chính xác của bạn. Sau đó, gọi chat.completions.create với định danh mô hình uncensored.

Cách tiếp cận này hoạt động liền mạch cho cả quy trình đồng bộ và bất đồng bộ. Mô hình phản hồi với các prompt tiêu chuẩn, gọi hàm và các tham số truyền phát giống như các endpoint tương thích OpenAI khác. Bạn có thể truyền các prompt hệ thống để hướng dẫn hành vi của mô hình hoặc sử dụng các thông điệp người dùng để tương tác trực tiếp.

from openai import OpenAI

client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Tích hợp SDK Node.js

Đối với các dự án JavaScript và TypeScript, hãy sử dụng gói npm openai. Cấu hình máy khách với URL cơ bản của Heretic và khóa API của bạn. API hỗ trợ các cấu trúc yêu cầu tiêu chuẩn, bao gồm định nghĩa công cụ và gọi hàm.

Hãy đảm bảo xử lý phản hồi đúng cách, đặc biệt khi sử dụng các mẫu async/await. Mô hình trả về các phản hồi văn bản có thể được xử lý trực tiếp trong logic ứng dụng của bạn. Tích hợp này lý tưởng để xây dựng giao diện trò chuyện, tác nhân tự động hoặc các đường ống xử lý dữ liệu yêu cầu khả năng LLM không kiểm duyệt.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Phản hồi truyền phát (Streaming)

Bật phản hồi thời gian thực bằng cách bật truyền phát trong yêu cầu API của bạn. Đặt tham số stream thành true. API sẽ trả về luồng Sự kiện được máy chủ gửi đi (SSE) chứa các đoạn văn bản khi chúng được tạo ra. Điều này giảm độ trễ cảm nhận và cung cấp trải nghiệm người dùng mượt mà hơn cho các ứng dụng trò chuyện.

Mỗi đoạn trong luồng chứa một phần của phản hồi. Xử lý các đoạn này theo cách tăng dần để cập nhật giao diện người dùng của bạn theo thời gian thực. Tính năng truyền phát hoàn toàn tương thích với các SDK OpenAI, vì vậy bạn có thể sử dụng các bộ lặp stream hoặc trình lắng nghe sự kiện tiêu chuẩn để xử lý dữ liệu hiệu quả.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Giới hạn tốc độ, Lỗi và Ngữ cảnh

API áp dụng giới hạn 300 yêu cầu mỗi phút trên mỗi khóa và kích thước thân yêu cầu 8 MB. Nếu bạn vượt quá giới hạn tốc độ, bạn sẽ nhận được lỗi 429. Lỗi xác thực trả về trạng thái 401, cho biết khóa API không hợp lệ hoặc bị thiếu. Nếu tín dụng trả trước của bạn đã cạn kiệt, API trả về lỗi 402, yêu cầu bạn nạp tiền.

Tín dụng không bao giờ hết hạn và bạn có thể nạp tiền từ $10 bằng tiền điện tử (USDT hoặc USDC), với tín dụng bổ sung cho các khoản gửi lớn hơn. Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token. Đảm bảo các prompt và phần hoàn thành của bạn nằm trong giới hạn này. Để biết thêm chi tiết về giá cả và giới hạn, hãy truy cập trang Bảng giá.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Base URLhttps://api.hereticllm.com/v1
EndpointPOST /v1/chat/completions · GET /v1/models
Xác thựcAuthorization: Bearer YOUR_KEY
ID mô hìnhuncensored
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Chế độ JSONresponse_format: {"type": "json_object"}
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Kích thước yêu cầutối đa 8 MB
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Thưởng+5% từ $50, +10% từ $100
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Mô hình không kiểm duyệt có miễn phí không?

Mô hình không miễn phí mà sử dụng hệ thống tín dụng trả trước trả theo nhu cầu. Tài khoản mới nhận $0.50 tín dụng dùng thử miễn phí có hiệu lực trong 7 ngày. Tín dụng trả trước không bao giờ hết hạn và bạn có thể nạp tiền từ $10.

Kích thước cửa sổ ngữ cảnh là bao nhiêu?

Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token, bao gồm cả prompt đầu vào và phần hoàn thành được tạo ra. Điều này cho phép tương tác ngữ cảnh dài và xử lý các tác vụ dữ liệu lớn.

API có hỗ trợ gọi công cụ không?

Có, API hỗ trợ gọi công cụ và gọi hàm. Bạn có thể định nghĩa các công cụ trong yêu cầu của mình và mô hình sẽ phản hồi bằng dữ liệu có cấu trúc mà ứng dụng của bạn có thể thực thi. Điều này tương thích với các mẫu SDK OpenAI tiêu chuẩn.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ bản. Đó là toàn bộ quá trình thiết lập.

Lấy khóa APIĐọc tài liệu