NL ▾
API-sleutel aanvragen

Heretic LLMHeretic LLM: API-documentatie

Heretic LLM: API-documentatie

Kom in enkele minuten aan de slag met de Heretic LLM API. Gebruik de standaard OpenAI SDK's om tekst te versturen en ongecensureerde antwoorden van het 'uncensored'-model te ontvangen zonder GPU-infrastructuur te beheren.

Basis-URL en authenticatie

Om de Heretic LLM-API te gebruiken, wijst je OpenAI-compatibele client naar onze basis-URL: https://api.hereticllm.com/v1. De API gebruikt standaard Bearer-token-authenticatie. Je kunt een API-sleutel genereren door je aan te melden met alleen een e-mailadres en wachtwoord op de pagina API-sleutel ophalen. De sleutel wordt direct na het aanmelden weergegeven en kan op elk moment opnieuw gegenereerd worden, waardoor de vorige sleutel ongeldig wordt.

Stel de omgevingsvariabele OPENAI_API_KEY in of voer de sleutel direct door in je clientconfiguratie. Zorg dat je basis-URL is bijgewerkt naar de Heretic-endpoint. Deze setup stelt je in staat de officiële OpenAI SDK's te gebruiken zonder code-aanpassingen, door simpelweg de basis-URL en sleutel te wijzigen.

Eerste verzoek

Doe je eerste verzoek naar het chat-completions endpoint. De modelidentifier is uncensored. Dit open-weight model is afgestemd op het geven van antwoorden zonder inhoudelijke weigeringen voor wettelijk volwassen gebruik, en is ideaal voor ongecensureerd programmeren, creatief schrijven of onderzoek. Het contextvenster ondersteunt tot 100.000 tokens voor zowel prompt als voltooiing samen.

Hieronder vind je een basis cURL-voorbeeld om het endpoint te testen. Vervang YOUR_API_KEY door je daadwerkelijke sleutel.

Het antwoord is een standaard OpenAI-formaat object met de gegenereerde tekst.

curl https://api.hereticllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK-integratie

Integreer de API in je Python-toepassingen met het officiële openai pakket. De bibliotheek verwerkt JSON-serialisatie en streaming automatisch. Initialiseer de client met je API-sleutel en de juiste basis-URL. Roep vervolgens chat.completions.create aan met de model-ID uncensored.

Deze aanpak werkt naadloos voor zowel synchrone als asynchrone workflows. Het model reageert op standaard prompts, function calling en streaming-parameters net als andere OpenAI-compatibele endpoints. Je kunt system prompts doorgeven om het gedrag van het model te sturen of user messages gebruiken voor directe interactie.

from openai import OpenAI

client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js SDK-integratie

Voor JavaScript- en TypeScript-projecten gebruik je het openai npm-pakket. Configureer de client met de Heretic-basis-URL en je API-sleutel. De API ondersteunt standaard verzoekstructuren, inclusief tool-definities en function calling.

Zorg dat je het antwoord correct verwerkt, vooral bij het gebruik van async/await patronen. Het model retourneert tekstantwoorden die direct in je applicatielogica kunnen worden verwerkt. Deze integratie is ideaal voor het bouwen van chatinterfaces, geautomatiseerde agents of dataprocessing-pipelines die ongecensureerde LLM-mogelijkheden vereisen.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming-antwoorden

Schakel realtime-antwoorden in door streaming in je API-verzoek in te schakelen. Stel de parameter stream in op true. De API retourneert een Server-Sent Events (SSE)-stream met tekstchunks naarmate ze worden gegenereerd. Dit vermindert de waargenomen latentie en biedt een soepelere gebruikerservaring voor chattoepassingen.

Elk fragment in de stream bevat een deel van het antwoord. Verwerk deze fragmenten incrementeel om je UI in realtime bij te werken. De streamingfunctie is volledig compatibel met de OpenAI SDK's, dus je kunt de standaard stream-iterators of event listeners gebruiken om de gegevens efficiënt te verwerken.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Rate limits, fouten en context

De API hanteert een limiet van 300 verzoeken per minuut per sleutel en een verzoeklichaam van maximaal 8 MB. Als je de rate limit overschrijdt, ontvang je een 429-fout. Authenticatiefouten retourneren een 401-status, wat wijst op een ongeldige of ontbrekende API-sleutel. Als je prepaid tegoed op is, retourneert de API een 402-fout, wat een opwaardering vereist.

Tegoed vervalt nooit, en je kunt opwaarderen vanaf $10 met crypto (USDT of USDC), met bonus tegoed voor grotere stortingen. Het model ondersteunt een contextvenster van 100.000 tokens. Zorg dat je prompts en voltooiingen binnen deze limiet passen. Bezoek de pagina 'Prijzen' voor meer details over prijzen en limieten.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Base URLhttps://api.hereticllm.com/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
AuthenticatieAuthorization: Bearer YOUR_KEY
Model-IDuncensored
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
JSON-modusresponse_format: {"type": "json_object"}
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Contextvenster100.000 tokens (invoer + uitvoer)
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Verzoekgroottetot 8 MB
Gelijktijdige verzoekentot 8 tegelijk per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rate limit300 verzoeken per minuut per sleutel
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Bonus+5% vanaf $50, +10% vanaf $100
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
InloggenGoogle of e-mail en wachtwoord
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Is het ongecensureerde model gratis?

Het model is niet gratis maar maakt gebruik van een prepaid tegoedsysteem op basis van gebruik. Nieuwe accounts ontvangen $0,50 aan proeftegoed dat 7 dagen geldig is. Betaald tegoed vervalt niet, en je kunt opwaarderen vanaf $10.

Wat is de grootte van het contextvenster?

Het model ondersteunt een contextvenster van 100.000 tokens, inclusief zowel de input-prompt als de gegenereerde voltooiing. Dit maakt interacties met lange context en taakverwerking van grote datasets mogelijk.

Ondersteunt de API tool calling?

Ja, de API ondersteunt tool en function calling. Je kunt tools definiëren in je verzoek en het model reageert met gestructureerde data die door je applicatie kan worden uitgevoerd. Dit is compatibel met standaard OpenAI SDK patronen.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, wijzig de basis-URL. Dat is de hele setup.

API-sleutel ophalenLees de docs