Heretic LLMHeretic LLM: Tài liệu API
Heretic LLM: Tài liệu API
Bắt đầu với API Heretic LLM trong vài phút. Sử dụng các SDK OpenAI tiêu chuẩn để gửi văn bản và nhận phản hồi không kiểm duyệt từ mô hình 'uncensored' mà không cần quản lý cơ sở hạ tầng GPU.
URL cơ bản và Xác thực
Để bắt đầu sử dụng API Heretic LLM, hãy trỏ máy khách tương thích OpenAI của bạn đến URL cơ sở của chúng tôi: https://api.hereticllm.com/v1. API sử dụng xác thực token Bearer tiêu chuẩn. Bạn có thể tạo khóa API bằng cách đăng ký chỉ với email và mật khẩu trên trang Tạo khóa API. Khóa được hiển thị ngay sau khi đăng ký và có thể được tạo lại bất cứ lúc nào, điều này sẽ vô hiệu hóa khóa trước đó.
Đặt biến môi trường OPENAI_API_KEY hoặc truyền khóa trực tiếp trong cấu hình máy khách của bạn. Đảm bảo URL cơ bản của bạn đã được cập nhật sang endpoint của Heretic. Cấu hình này cho phép bạn sử dụng các SDK OpenAI chính thức mà không cần thay đổi mã, chỉ bằng cách thay đổi URL cơ bản và khóa.
Yêu cầu đầu tiên
Thực hiện yêu cầu đầu tiên của bạn đến endpoint chat completions. Định danh mô hình là uncensored. Mô hình trọng số mở này được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người trưởng thành hợp pháp, khiến nó lý tưởng cho việc lập trình không kiểm duyệt, viết sáng tạo hoặc nghiên cứu. Cửa sổ ngữ cảnh hỗ trợ lên đến 100.000 token cho cả prompt và phần hoàn thành kết hợp.
Dưới đây là một ví dụ cURL cơ bản để kiểm tra endpoint. Thay thế YOUR_API_KEY bằng khóa thực tế của bạn.
Phản hồi sẽ là một đối tượng định dạng OpenAI tiêu chuẩn chứa văn bản được tạo ra.
curl https://api.hereticllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Tích hợp SDK Python
Tích hợp API vào các ứng dụng Python của bạn bằng cách sử dụng gói openai chính thức. Thư viện xử lý tự động việc tuần tự hóa JSON và truyền phát. Khởi tạo máy khách với khóa API và URL cơ bản chính xác của bạn. Sau đó, gọi chat.completions.create với định danh mô hình uncensored.
Cách tiếp cận này hoạt động liền mạch cho cả quy trình đồng bộ và bất đồng bộ. Mô hình phản hồi với các prompt tiêu chuẩn, gọi hàm và các tham số truyền phát giống như các endpoint tương thích OpenAI khác. Bạn có thể truyền các prompt hệ thống để hướng dẫn hành vi của mô hình hoặc sử dụng các thông điệp người dùng để tương tác trực tiếp.
from openai import OpenAI
client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Tích hợp SDK Node.js
Đối với các dự án JavaScript và TypeScript, hãy sử dụng gói npm openai. Cấu hình máy khách với URL cơ bản của Heretic và khóa API của bạn. API hỗ trợ các cấu trúc yêu cầu tiêu chuẩn, bao gồm định nghĩa công cụ và gọi hàm.
Hãy đảm bảo xử lý phản hồi đúng cách, đặc biệt khi sử dụng các mẫu async/await. Mô hình trả về các phản hồi văn bản có thể được xử lý trực tiếp trong logic ứng dụng của bạn. Tích hợp này lý tưởng để xây dựng giao diện trò chuyện, tác nhân tự động hoặc các đường ống xử lý dữ liệu yêu cầu khả năng LLM không kiểm duyệt.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Phản hồi truyền phát (Streaming)
Bật phản hồi thời gian thực bằng cách bật truyền phát trong yêu cầu API của bạn. Đặt tham số stream thành true. API sẽ trả về luồng Sự kiện được máy chủ gửi đi (SSE) chứa các đoạn văn bản khi chúng được tạo ra. Điều này giảm độ trễ cảm nhận và cung cấp trải nghiệm người dùng mượt mà hơn cho các ứng dụng trò chuyện.
Mỗi đoạn trong luồng chứa một phần của phản hồi. Xử lý các đoạn này theo cách tăng dần để cập nhật giao diện người dùng của bạn theo thời gian thực. Tính năng truyền phát hoàn toàn tương thích với các SDK OpenAI, vì vậy bạn có thể sử dụng các bộ lặp stream hoặc trình lắng nghe sự kiện tiêu chuẩn để xử lý dữ liệu hiệu quả.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Giới hạn tốc độ, Lỗi và Ngữ cảnh
API áp dụng giới hạn 300 yêu cầu mỗi phút trên mỗi khóa và kích thước thân yêu cầu 8 MB. Nếu bạn vượt quá giới hạn tốc độ, bạn sẽ nhận được lỗi 429. Lỗi xác thực trả về trạng thái 401, cho biết khóa API không hợp lệ hoặc bị thiếu. Nếu tín dụng trả trước của bạn đã cạn kiệt, API trả về lỗi 402, yêu cầu bạn nạp tiền.
Tín dụng không bao giờ hết hạn và bạn có thể nạp tiền từ $10 bằng tiền điện tử (USDT hoặc USDC), với tín dụng bổ sung cho các khoản gửi lớn hơn. Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token. Đảm bảo các prompt và phần hoàn thành của bạn nằm trong giới hạn này. Để biết thêm chi tiết về giá cả và giới hạn, hãy truy cập trang Bảng giá.
Thông số kỹ thuật
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Base URL | https://api.hereticllm.com/v1 |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Xác thực | Authorization: Bearer YOUR_KEY |
| ID mô hình | uncensored |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Kích thước yêu cầu | tối đa 8 MB |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Thưởng | +5% từ $50, +10% từ $100 |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Đăng nhập | Google hoặc email và mật khẩu |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
Mô hình không kiểm duyệt có miễn phí không?
Mô hình không miễn phí mà sử dụng hệ thống tín dụng trả trước trả theo nhu cầu. Tài khoản mới nhận $0.50 tín dụng dùng thử miễn phí có hiệu lực trong 7 ngày. Tín dụng trả trước không bao giờ hết hạn và bạn có thể nạp tiền từ $10.
Kích thước cửa sổ ngữ cảnh là bao nhiêu?
Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token, bao gồm cả prompt đầu vào và phần hoàn thành được tạo ra. Điều này cho phép tương tác ngữ cảnh dài và xử lý các tác vụ dữ liệu lớn.
API có hỗ trợ gọi công cụ không?
Có, API hỗ trợ gọi công cụ và gọi hàm. Bạn có thể định nghĩa các công cụ trong yêu cầu của mình và mô hình sẽ phản hồi bằng dữ liệu có cấu trúc mà ứng dụng của bạn có thể thực thi. Điều này tương thích với các mẫu SDK OpenAI tiêu chuẩn.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ bản. Đó là toàn bộ quá trình thiết lập.