NL ▾
API-sleutel aanvragen

Ongecensureerd APIhttps://api.hereticllm.com/v1

LLM zonder censuur API

Toegang tot een abliterated LLM via een standaard OpenAI-compatible endpoint. Krijg directe, weigeringvrije tekstgeneratie zonder het beheer van lokale GPU-infrastructuur.

API-sleutel ophalenDocs lezen

  • Compatibel met OpenAI SDK
  • $0,25 per 1M input tokens
  • Geen abonnementskosten

Probeer het met één verzoek

curl https://api.hereticllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'
per 1M invoer-tokens
$0,25
Uitvoer-tokens / 1M
$1,00
contextvenster van tokens
100.000
proeftegoed
$0,50
verzoeken per minuut
300

Wat je krijgt

Directe API-toegang

Stuur verzoeken naar POST /v1/chat/completions. De service behandelt streaming via SSE en ondersteunt function calling zonder extra configuratie.

Standaard compatibiliteit

Werkt met officiële OpenAI SDK's en elke OpenAI-compatible client. Stel je base_url in op https://api.hereticllm.com/v1 en gebruik je API-sleutel.

Geen lokale setup

Toegang tot het ongecensureerde model direct. Geen gewicht downloaden, CUDA-stuurprogramma's beheren of dure GPU-tijd reserveren op je lokale machine.

Eenvoudige prijzen

Pay-as-you-go prepaid credit. Geen maandelijkse abonnementen of verborgen kosten. Credit verloopt niet, dus je betaalt alleen voor wat je gebruikt.

Privacy voorop

Prompts worden niet gebruikt voor training. Meld je aan met alleen e-mail en wachtwoord. Geen telefoonnummer of creditcard nodig voor de proefversie.

Groot contextvenster

Ondersteunt een contextvenster van 100.000 tokens voor zowel prompt als completion. Ideaal voor het verwerken van lange documenten of uitgebreide gesprekken.

Hoe het werkt

  1. Account aanmaken

    Meld je aan met e-mail en wachtwoord om direct je API-sleutel te ontvangen.

  2. Credit laden

    Voeg prepaid credit toe vanaf $10, of begin met $0,50 proeftegoed.

  3. Verzoeken versturen

    Gebruik je favoriete SDK om het chat-completions endpoint aan te roepen met model id 'uncensored'.

Wat mensen ermee bouwen

Inhoudsgeneratie

Genereer creatief schrijven, roleplay of fictieve verhalen zonder inhoudsfilters die volwassen of controversiële thema's blokkeren. Krijg ruwe output voor wettelijk volwassen gebruik.

Gegevensextractie

Parse complexe documenten of logs zonder dat het model weigert gevoelige of ongebruikelijke gegevensstructuren te verwerken. Ideaal voor technische analyse en onderzoek.

Coderingsassistentie

Gebruik een ongecensureerde coderings-LLM voor directe antwoorden op technische vragen zonder onnodige moralisering of weigering bij standaard programmeertaken.

Onderzoeksanalyse

Analyseer beveiligingsonderzoeksrapporten of politieke teksten zonder dat het model zijn toon verzacht of weigert controversiële onderwerpen te bespreken. Krijg onbevooroordeelde samenvattingen.

Het ongecensureerde voordeel

De meeste gehoste LLM's zijn afgestemd op brede aansluiting, wat betekent dat ze weigeren vragen over volwassen onderwerpen, controversiële politiek of niche beveiligingsonderzoek te beantwoorden. Heretic LLM gebruikt een model zonder filters dat deze specifieke refusals verwijdert. Je krijgt de volledige output die het model genereert voor wettelijk volwassen gebruik, zonder de beleefde "Ik kan je daar niet mee helpen" onderbrekingen. Dit is niet zomaar een model waarbij de veiligheidsbeperkingen zijn uitgeschakeld; het is een specifiek afgestemd open-weight model dat ontworpen is om direct te antwoorden. Je kunt het gebruiken voor creatief schrijven, roleplay of het analyseren van gevoelige data zonder je zorgen te maken over inhoudsfilters die je verzoeken blokkeren. De model id is eenvoudigweg "uncensored". Het gedraagt zich als elke andere LLM, maar zonder de extra laag van corporatieve moderatie die de output vaak verstoort.

Hoe het werkt

Onze service is een eenvoudige tekst-API. Je stuurt tekst in en krijgt tekst terug. Er zijn geen embeddings, geen beeldgeneratie en geen audio-verwerking. Het endpoint is POST /v1/chat/completions. Je kunt streaming inschakelen met Server-Sent Events (SSE) of tool/function calling gebruiken. De base URL is https://api.hereticllm.com/v1. Als je al de OpenAI SDK gebruikt in Python of Node.js, hoef je alleen de base_url aan te passen en je API-sleutel op te geven. Het model ondersteunt een contextvenster van 100.000 tokens. Hiermee kun je grote documenten verwerken of lange gesprekken voeren. Er is geen complexe routing of modelschakeling. Je krijgt één specifiek ongecensureerd model, geoptimaliseerd voor directe antwoorden. Verzoeken zijn beperkt tot 8 MB in body size en 300 verzoeken per minuut per sleutel.

Prijzen en credit

We gebruiken een eenvoudig pay-as-you-go model. Er zijn geen abonnementen en geen maandelijkse kosten. Je koopt prepaid credit, en het verloopt niet. De prijs is $0,25 per 1 miljoen input tokens en $1,00 per 1 miljoen output tokens. Je kunt opwaarderen met crypto (USDT of USDC) vanaf $10. We bieden ook bonussen: +5% credit bij $50 top-ups en +10% bij $100 top-ups. Nieuwe accounts krijgen $0,50 aan proeftegoed dat 7 dagen geldig is. Er is geen creditcard nodig voor de proefversie. Je kunt op elk moment een nieuwe API-sleutel genereren, waardoor de oude ongeldig wordt. Dit is ideaal voor ontwikkelaars die de API willen testen voordat ze een groter saldo kopen. Je betaalt alleen voor de tokens die je daadwerkelijk verbruikt.

Ontwikkelaarservaring

We hebben dit gebouwd voor ontwikkelaars die resultaten willen zonder overhead. Je hoeft geen Docker-containers, GPU-stuurprogramma's of VRAM-limieten te beheren. De API is compatibel met standaard OpenAI-clients. Dit betekent dat je tools zoals LangChain of LlamaIndex kunt gebruiken met minimale code-aanpassingen. Werk gewoon de base_url bij. We bieden geen SLA-garanties, SOC2-certificeringen of on-premises deployment. Dit is een gehoste service voor individuele ontwikkelaars en kleine teams. Als je enterprise-grade ondersteuning of specifieke compliance-certificeringen nodig hebt, is dit misschien niet de juiste keuze. We focussen op het bieden van een betrouwbaar, ongecensureerd tekstendpoint. Aanmelden duurt enkele seconden. Voer je e-mail in, stel een wachtwoord in en krijg je sleutel. Geen telefoonverificatie, geen creditcardcontroles. Je prompts worden niet gebruikt voor het trainen van het model.

Vragen en antwoorden

Is dit hetzelfde als een lokaal Ollama-model draaien?

Nee. Lokale Ollama-modellen vereisen dat je GPU-hardware, stuurprogramma's en geheugen beheert. Onze API biedt toegang tot een vergelijkbaar ongecensureerd model via een gehost endpoint. Je krijgt hetzelfde gedrag zonder refusals zonder de lokale setup. Je betaalt per token in plaats van hardware te kopen.

Wat is de grootte van het contextvenster?

Het model ondersteunt een contextvenster van 100.000 tokens. Dit omvat zowel de prompt als de completion. Hierdoor kun je grote documenten verwerken of lange gesprekken voeren zonder contextverlies.

Reken je aan voor het proeftegoed?

Nee. Elk nieuw account krijgt $0,50 aan proeftegoed dat 7 dagen geldig is. Er is geen creditcard of telefoonnummer nodig om het op te eisen. Het is een eenmalig voordeel per persoon om de API te testen.

Wordt het model gebruikt om mijn data te trainen?

Nee. We gebruiken je prompts niet voor training. Je data blijft privé voor je account. We slaan alleen op wat nodig is om je verzoeken te verwerken en je account te factureren.

Kan ik dit gebruiken voor NSFW-content?

Ja. Het model is ongecensureerd en weigert wettelijke volwassen content niet. We blokkeren wel verzoeken die seksuele content met minderjarigen bevatten. Dit is een harde limiet die altijd geldt, ongeacht je accounttype.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.

API-sleutel ophalenLees de documentatie