DE ▾
API-Schlüssel erhalten

Unzensierte APIhttps://api.hereticllm.com/v1

KI API ohne Filter für Entwickler

Greife über einen standardmäßigen OpenAI-kompatiblen Endpunkt auf ein abgeleitetes LLM zu. Erhalte sofortige, ablehnungsfreie Textgenerierung, ohne lokale GPU-Infrastruktur verwalten zu müssen.

API-Schlüssel erhaltenDokumentation lesen

  • Kompatibel mit OpenAI SDK
  • $0,25 pro 1M Input-Token
  • Keine Abonnementgebühren

Probiere es mit einer einzigen Anfrage aus

curl https://api.hereticllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'
pro 1M Input-Token
$0,25
Output-Token / 1M
$1,00
Token-Kontext
100.000
Testguthaben
$0,50
Anfragen pro Minute
300

Was du erhältst

Direkter API-Zugriff

Sende Anfragen an POST /v1/chat/completions. Der Dienst verarbeitet Streaming über SSE und unterstützt Function Calling ohne zusätzliche Konfiguration.

Standardkompatibilität

Funktioniert mit offiziellen OpenAI SDKs und jedem OpenAI-kompatiblen Client. Lege deine base_url auf https://api.hereticllm.com/v1 und verwende deinen API-Schlüssel.

Keine lokale Einrichtung

Greife sofort auf das unzensierte Modell zu. Du musst keine Gewichte herunterladen, CUDA-Treiber verwalten oder teure GPU-Zeit auf deinem lokalen Rechner reservieren.

Einfache Preisgestaltung

Pay-as-you-go Prepaid-Guthaben. Keine monatlichen Abonnements oder versteckten Gebühren. Guthaben verfällt nie, also zahlst du nur für das, was du nutzt.

Datenschutz zuerst

Prompts werden nicht zum Training verwendet. Melde dich nur mit E-Mail und Passwort an. Keine Telefonnummer oder Kreditkarte für das Testguthaben erforderlich.

Großer Kontext

Unterstützt ein Kontextfenster mit 100.000 Token für Prompt und Completion. Ideal zur Verarbeitung langer Dokumente oder erweiterter Gesprächsverläufe.

So funktioniert es

  1. Konto erstellen

    Melde dich mit E-Mail und Passwort an, um deinen API-Schlüssel sofort zu erhalten.

  2. Guthaben aufladen

    Füge Prepaid-Guthaben ab $10 hinzu oder starte mit $0,50 Testguthaben.

  3. Anfragen senden

    Verwende dein bevorzugtes SDK, um den Chat-Completions-Endpunkt mit der Modell-ID 'uncensored' aufzurufen.

Was Leute damit bauen

Inhaltsgenerierung

Generiere kreative Texte, Roleplay oder fiktive Erzählungen ohne Inhaltsfilter, die erwachsene oder kontroverse Themen blockieren. Erhalte Rohtexte für legale erwachsene Anwendungsfälle.

Datenextraktion

Analysiere komplexe Dokumente oder Logs, ohne dass das Modell die Verarbeitung sensibler oder ungewöhnlicher Datenstrukturen verweigert. Ideal für technische Analysen und Forschung.

Coding-Assistenz

Verwende ein unzensiertes Coding-LLM, um direkte Antworten auf technische Fragen zu erhalten, ohne unnötige Moral oder Ablehnung bei Standard-Programmieraufgaben.

Forschungsanalyse

Analysiere Sicherheitsforschungsarbeiten oder politische Texte, ohne dass das Modell seinen Tonfall abschwächt oder kontroverse Themen verweigert. Erhalte unvoreingenommene Zusammenfassungen.

Der unzensierte Vorteil

Die meisten gehosteten LLMs sind auf breite Akzeptanz abgestimmt, was bedeutet, dass sie Fragen zu erwachsenen Themen, kontroverser Politik oder Nischen-Sicherheitsforschung nicht beantworten. Heretic LLM verwendet ein ablibriertes Modell, das genau diese spezifischen Ablehnungen entfernt. Du erhältst die volle Ausgabe, die das Modell für legale erwachsene Nutzung generiert, ohne die höflichen „Das kann ich nicht für dich tun“-Unterbrechungen. Dies ist nicht nur ein Modell, bei dem die Sicherheitszäune ausgeschaltet sind; es ist ein speziell abgestimmtes Open-Weight-Modell, das darauf ausgelegt ist, direkt zu antworten. Du kannst es für kreatives Schreiben, Rollenspiele oder die Analyse sensibler Daten nutzen, ohne dir Sorgen zu machen, dass Inhaltsfilter deine Anfragen blockieren. Die Modell-ID ist einfach „uncensored“. Es verhält sich wie jedes andere LLM, aber ohne die zusätzliche Schicht der Unternehmensmoderation, die die Ausgabe oft überlädt.

So funktioniert es

Unser Service ist eine einfache Text-API. Du gibst Text ein und erhältst Text zurück. Es gibt keine Embeddings, keine Bildgenerierung und keine Audioverarbeitung. Der Endpunkt ist POST /v1/chat/completions. Du kannst Streaming mit Server-Sent Events (SSE) aktivieren oder Function Calling nutzen. Die Basis-URL ist https://api.hereticllm.com/v1. Wenn du bereits das OpenAI SDK in Python oder Node.js nutzt, musst du nur die base_url ändern und deinen API-Schlüssel angeben. Das Modell unterstützt ein Kontextfenster mit 100.000 Token. So kannst du große Dokumente verarbeiten oder lange Gesprächsverläufe pflegen. Es gibt kein komplexes Routing oder Modellauswahl. Du erhältst ein einzelnes spezifisches unzensiertes Modell, optimiert für direkte Antworten. Anfragen sind auf 8 MB Körpergröße und 300 Anfragen pro Minute pro Schlüssel begrenzt.

Preisgestaltung & Guthaben

Wir verwenden ein einfaches Pay-as-you-go-Modell. Es gibt keine Abonnements und keine monatlichen Gebühren. Du kaufst Prepaid-Guthaben, und es verfällt nie. Der Preis beträgt $0,25 pro 1 Million Input-Token und $1,00 pro 1 Million Output-Token. Du kannst mit Krypto (USDT oder USDC) ab $10 aufladen. Wir bieten auch Boni: +5% Guthaben bei $50-Aufladungen und +10% bei $100-Aufladungen. Neue Konten erhalten $0,50 an Testguthaben, das 7 Tage gültig ist. Für das Testguthaben wird keine Kreditkarte benötigt. Du kannst jederzeit einen neuen API-Schlüssel generieren, wodurch der alte widerrufen wird. Dies ist ideal für Entwickler, die die API testen möchten, bevor sie sich für ein größeres Guthaben entscheiden. Du zahlst nur für die Token, die du tatsächlich verbrauchst.

Entwicklererlebnis

Wir haben dies für Entwickler gebaut, die Ergebnisse ohne Overhead wollen. Du musst keine Docker-Container, GPU-Treiber oder VRAM-Grenzen verwalten. Die API ist mit standardmäßigen OpenAI-Clients kompatibel. Das bedeutet, dass du Tools wie LangChain oder LlamaIndex mit minimalen Codeänderungen verwenden kannst. Aktualisiere einfach die base_url. Wir bieten keine SLA-Garantien, SOC2-Zertifizierungen oder On-Premise-Bereitstellung. Dies ist ein gehosteter Dienst für einzelne Entwickler und kleine Teams. Wenn du Enterprise-Support oder spezifische Compliance-Zertifizierungen benötigst, ist dies möglicherweise nicht das richtige Produkt. Wir konzentrieren uns darauf, dir einen zuverlässigen, unzensierten Text-Endpunkt zu bieten. Die Anmeldung dauert Sekunden. Gib deine E-Mail ein, setze ein Passwort und erhalte deinen Schlüssel. Keine Telefonüberprüfung, keine Kreditkartenprüfungen. Deine Prompts werden nicht zum Training des Modells verwendet.

Fragen und Antworten

Ist das dasselbe wie das Ausführen eines unzensierten Ollama-Modells lokal?

Nein. Lokale Ollama-Modelle erfordern, dass du die GPU-Hardware, Treiber und den Speicher selbst verwaltest. Unsere API bietet Zugriff auf ein ähnliches unzensiertes Modell über einen gehosteten Endpunkt. Du erhältst das gleiche, ablehnungsfreie Verhalten ohne den lokalen Einrichtungsaufwand. Du zahlst pro Token statt Hardware zu kaufen.

Wie groß ist das Kontextfenster?

Das Modell unterstützt ein Kontextfenster mit 100.000 Token. Dies umfasst sowohl den Prompt als auch die Completion. Dies ermöglicht die Verarbeitung großer Dokumente oder lange Gespräche, ohne den Kontext zu verlieren.

Wird für das Testguthaben berechnet?

Nein. Jedes neue Konto erhält $0,50 an Testguthaben, das 7 Tage gültig ist. Es wird keine Kreditkarte oder Telefonnummer benötigt, um es zu beanspruchen. Es ist ein einmaliger Vorteil pro Person, um die API zu testen.

Wird das Modell verwendet, um meine Daten zu trainieren?

Nein. Wir verwenden deine Prompts nicht zum Training. Deine Daten bleiben privat und sind nur für dein Konto sichtbar. Wir speichern nur das Nötigste, um deine Anfragen zu verarbeiten und dein Konto abzurechnen.

Kann ich das für NSFW-Inhalte verwenden?

Ja. Das Modell ist unzensiert und lehnt legale erwachsene Inhalte nicht ab. Allerdings blockieren wir Anfragen, die sexuelle Inhalte mit Minderjährigen beinhalten. Dies ist eine harte Grenze, die immer gilt, unabhängig von deinem Kontotyp.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhaltenLies die Dokumentation