Heretic LLMHeretic LLM: Документация API
Heretic LLM: Документация API
Начните работу с API Heretic LLM за несколько минут. Используйте стандартные SDK OpenAI для отправки текста и получения ответов от модели 'uncensored' без управления GPU-инфраструктурой.
Базовый URL и аутентификация
Чтобы начать работу с API Heretic LLM, укажите базовый URL для вашего OpenAI-совместимого клиента: https://api.hereticllm.com/v1. API использует стандартную аутентификацию Bearer. Вы можете сгенерировать API-ключ, зарегистрировавшись по электронной почте и паролю на странице получения ключа. Ключ отображается сразу после регистрации и может быть regenerated в любое время, что аннулирует предыдущий.
Установите переменную окружения OPENAI_API_KEY или передайте ключ напрямую в конфигурации клиента. Убедитесь, что базовый URL обновлен до эндпоинта Heretic. Эта настройка позволяет использовать официальные SDK OpenAI без изменений в коде, просто заменив базовый URL и ключ.
Первый запрос
Выполните первый запрос к эндпоинту чат-завершений. Идентификатор модели — uncensored. Эта модель с открытыми весами настроена на ответы без отказов по контенту для законного использования взрослыми, что идеально подходит для нецензурного программирования, творчества или исследований. Контекстное окно поддерживает до 100 000 токенов для промпта и ответа вместе.
Ниже приведен базовый пример cURL для тестирования эндпоинта. Замените YOUR_API_KEY на ваш реальный ключ.
Ответ будет содержать стандартный объект формата OpenAI с сгенерированным текстом.
curl https://api.hereticllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Интеграция Python SDK
Интегрируйте API в свои Python-приложения с помощью официального пакета openai. Библиотека автоматически обрабатывает сериализацию JSON и потоковую передачу. Инициализируйте клиент, передав API-ключ и правильный базовый URL. Затем вызовите chat.completions.create с идентификатором модели uncensored.
Этот подход работает беспроблемно как для синхронных, так и для асинхронных рабочих процессов. Модель отвечает на стандартные промпты, поддерживает вызов функций и потоковую передачу параметров так же, как и другие эндпоинты, совместимые с OpenAI. Вы можете передавать системные промпты для управления поведением модели или использовать сообщения пользователя для прямого взаимодействия.
from openai import OpenAI
client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Интеграция Node.js SDK
Для проектов на JavaScript и TypeScript используйте пакет npm openai. Настройте клиент с базовым URL Heretic и вашим API-ключом. API поддерживает стандартные структуры запросов, включая определения инструментов и вызов функций.
Убедитесь, что правильно обрабатываете ответ, особенно при использовании паттернов async/await. Модель возвращает текстовые ответы, которые можно напрямую обрабатывать в логике вашего приложения. Эта интеграция идеальна для создания чат-интерфейсов, автоматизированных агентов или конвейеров обработки данных, требующих возможностей LLM без цензуры.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Потоковые ответы
Включите ответы в реальном времени, активировав потоковую передачу в запросе к API. Установите параметр stream в значение true. API будет возвращать поток Server-Sent Events (SSE), содержащий фрагменты текста по мере их генерации. Это снижает воспринимаемую задержку и обеспечивает более плавный пользовательский опыт для чат-приложений.
Каждый фрагмент в потоке содержит часть ответа. Обрабатывайте эти фрагменты инкрементально, чтобы обновлять интерфейс в реальном времени. Функция потоковой передачи полностью совместима с SDK OpenAI, поэтому вы можете использовать стандартные итераторы stream или слушатели событий для эффективной обработки данных.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Лимиты, ошибки и контекст
API устанавливает лимит 300 запросов в минуту на ключ и размер тела запроса до 8 МБ. При превышении лимита запросов вы получите ошибку 429. Ошибки аутентификации возвращают статус 401, указывая на недействительный или отсутствующий API-ключ. Если ваш предоплаченный баланс исчерпан, API возвращает ошибку 402, требующую пополнения.
Баланс не сгорает, пополнить можно от $10 с помощью криптовалюты (USDT или USDC), при крупных депозитах начисляются бонусные средства. Модель поддерживает контекстное окно на 100 000 токенов. Убедитесь, что ваши промпты и ответы укладываются в этот лимит. Подробнее о тарифах и лимитах см. на странице Тарифы.
Технические характеристики
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| Base URL | https://api.hereticllm.com/v1 |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| Авторизация | Authorization: Bearer YOUR_KEY |
| ID модели | uncensored |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| JSON-режим | response_format: {"type": "json_object"} |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Максимум ответа | до остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| Контекстное окно | 100 000 токенов (вход и ответ вместе) |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| Размер запроса | до 8 МБ |
| Параллельные запросы | до 8 одновременно на ключ |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Лимит запросов | 300 запросов в минуту на ключ |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Бонус | +5% от $50, +10% от $100 |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Вход | Google или e-mail и пароль |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |
Вопросы и ответы
Модель без цензуры бесплатна?
Модель не бесплатна, используется система предоплаченного баланса с оплатой по факту. Новые аккаунты получают $0,50 пробного баланса на 7 дней. Платный баланс не сгорает, пополнение от $10.
Какой размер контекстного окна?
Модель поддерживает контекстное окно на 100 000 токенов, включая входной промпт и сгенерированный ответ. Это позволяет обрабатывать длинные диалоги и большие объемы данных.
Поддерживает ли API вызов функций?
Да, API поддерживает вызов функций. Вы можете определить инструменты в запросе, и модель вернет структурированные данные для выполнения вашим приложением. Это совместимо со стандартными шаблонами SDK OpenAI.
Ваш ключ — в одной форме от вас
Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.