Heretic LLMHeretic LLM: API-documentatie
Heretic LLM: API-documentatie
Kom in enkele minuten aan de slag met de Heretic LLM API. Gebruik de standaard OpenAI SDK's om tekst te versturen en ongecensureerde antwoorden van het 'uncensored'-model te ontvangen zonder GPU-infrastructuur te beheren.
Basis-URL en authenticatie
Om de Heretic LLM-API te gebruiken, wijst je OpenAI-compatibele client naar onze basis-URL: https://api.hereticllm.com/v1. De API gebruikt standaard Bearer-token-authenticatie. Je kunt een API-sleutel genereren door je aan te melden met alleen een e-mailadres en wachtwoord op de pagina API-sleutel ophalen. De sleutel wordt direct na het aanmelden weergegeven en kan op elk moment opnieuw gegenereerd worden, waardoor de vorige sleutel ongeldig wordt.
Stel de omgevingsvariabele OPENAI_API_KEY in of voer de sleutel direct door in je clientconfiguratie. Zorg dat je basis-URL is bijgewerkt naar de Heretic-endpoint. Deze setup stelt je in staat de officiële OpenAI SDK's te gebruiken zonder code-aanpassingen, door simpelweg de basis-URL en sleutel te wijzigen.
Eerste verzoek
Doe je eerste verzoek naar het chat-completions endpoint. De modelidentifier is uncensored. Dit open-weight model is afgestemd op het geven van antwoorden zonder inhoudelijke weigeringen voor wettelijk volwassen gebruik, en is ideaal voor ongecensureerd programmeren, creatief schrijven of onderzoek. Het contextvenster ondersteunt tot 100.000 tokens voor zowel prompt als voltooiing samen.
Hieronder vind je een basis cURL-voorbeeld om het endpoint te testen. Vervang YOUR_API_KEY door je daadwerkelijke sleutel.
Het antwoord is een standaard OpenAI-formaat object met de gegenereerde tekst.
curl https://api.hereticllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK-integratie
Integreer de API in je Python-toepassingen met het officiële openai pakket. De bibliotheek verwerkt JSON-serialisatie en streaming automatisch. Initialiseer de client met je API-sleutel en de juiste basis-URL. Roep vervolgens chat.completions.create aan met de model-ID uncensored.
Deze aanpak werkt naadloos voor zowel synchrone als asynchrone workflows. Het model reageert op standaard prompts, function calling en streaming-parameters net als andere OpenAI-compatibele endpoints. Je kunt system prompts doorgeven om het gedrag van het model te sturen of user messages gebruiken voor directe interactie.
from openai import OpenAI
client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js SDK-integratie
Voor JavaScript- en TypeScript-projecten gebruik je het openai npm-pakket. Configureer de client met de Heretic-basis-URL en je API-sleutel. De API ondersteunt standaard verzoekstructuren, inclusief tool-definities en function calling.
Zorg dat je het antwoord correct verwerkt, vooral bij het gebruik van async/await patronen. Het model retourneert tekstantwoorden die direct in je applicatielogica kunnen worden verwerkt. Deze integratie is ideaal voor het bouwen van chatinterfaces, geautomatiseerde agents of dataprocessing-pipelines die ongecensureerde LLM-mogelijkheden vereisen.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming-antwoorden
Schakel realtime-antwoorden in door streaming in je API-verzoek in te schakelen. Stel de parameter stream in op true. De API retourneert een Server-Sent Events (SSE)-stream met tekstchunks naarmate ze worden gegenereerd. Dit vermindert de waargenomen latentie en biedt een soepelere gebruikerservaring voor chattoepassingen.
Elk fragment in de stream bevat een deel van het antwoord. Verwerk deze fragmenten incrementeel om je UI in realtime bij te werken. De streamingfunctie is volledig compatibel met de OpenAI SDK's, dus je kunt de standaard stream-iterators of event listeners gebruiken om de gegevens efficiënt te verwerken.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Rate limits, fouten en context
De API hanteert een limiet van 300 verzoeken per minuut per sleutel en een verzoeklichaam van maximaal 8 MB. Als je de rate limit overschrijdt, ontvang je een 429-fout. Authenticatiefouten retourneren een 401-status, wat wijst op een ongeldige of ontbrekende API-sleutel. Als je prepaid tegoed op is, retourneert de API een 402-fout, wat een opwaardering vereist.
Tegoed vervalt nooit, en je kunt opwaarderen vanaf $10 met crypto (USDT of USDC), met bonus tegoed voor grotere stortingen. Het model ondersteunt een contextvenster van 100.000 tokens. Zorg dat je prompts en voltooiingen binnen deze limiet passen. Bezoek de pagina 'Prijzen' voor meer details over prijzen en limieten.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Base URL | https://api.hereticllm.com/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Model-ID | uncensored |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| JSON-modus | response_format: {"type": "json_object"} |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Verzoekgrootte | tot 8 MB |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Inloggen | Google of e-mail en wachtwoord |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Is het ongecensureerde model gratis?
Het model is niet gratis maar maakt gebruik van een prepaid tegoedsysteem op basis van gebruik. Nieuwe accounts ontvangen $0,50 aan proeftegoed dat 7 dagen geldig is. Betaald tegoed vervalt niet, en je kunt opwaarderen vanaf $10.
Wat is de grootte van het contextvenster?
Het model ondersteunt een contextvenster van 100.000 tokens, inclusief zowel de input-prompt als de gegenereerde voltooiing. Dit maakt interacties met lange context en taakverwerking van grote datasets mogelijk.
Ondersteunt de API tool calling?
Ja, de API ondersteunt tool en function calling. Je kunt tools definiëren in je verzoek en het model reageert met gestructureerde data die door je applicatie kan worden uitgevoerd. Dit is compatibel met standaard OpenAI SDK patronen.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, wijzig de basis-URL. Dat is de hele setup.