FR ▾
Obtenir une clé API

API sans censurehttps://api.hereticllm.com/v1

API IA sans filtre pour les développeurs

Accédez à un LLM abstrait via un endpoint standard compatible OpenAI. Obtenez une génération de texte instantanée et sans refus sans gérer l'infrastructure GPU locale.

Obtenir la clé APILire la documentation

  • Compatible SDK OpenAI
  • 0,25 $ par 1M de tokens d'entrée
  • Pas de frais d'abonnement

Essayez avec une seule requête

curl https://api.hereticllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'
par 1M de tokens d'entrée
$0,25
Tokens de sortie / 1M
$1,00
contexte de tokens
100 000
crédit d'essai
$0,50
requêtes par minute
300

Ce que vous obtenez

Accès API direct

Envoyez des requêtes à POST /v1/chat/completions. Le service gère le streaming via SSE et prend en charge l'appel de fonctions sans configuration supplémentaire.

Compatibilité standard

Fonctionne avec les SDK officiels OpenAI et tout client compatible OpenAI. Pointez votre base_url vers https://api.hereticllm.com/v1 et utilisez votre clé API.

Pas d'installation locale

Accédez instantanément au modèle sans censure. Pas besoin de télécharger les poids, de gérer les pilotes CUDA ou de réserver du temps GPU coûteux sur votre machine locale.

Tarification simple

Crédit prépayé avec paiement à l'usage. Pas d'abonnements mensuels ni de frais cachés. Le crédit n'expire jamais, vous ne payez que ce que vous utilisez.

Confidentialité d'abord

Les prompts ne sont pas utilisés pour l'entraînement. Inscrivez-vous avec juste un email et un mot de passe. Aucun numéro de téléphone ou carte bancaire requis pour l'essai.

Grand contexte

Prend en charge une fenêtre de contexte de 100 000 tokens pour le prompt et la complétion. Idéal pour traiter de longs documents ou des historiques de conversation étendus.

Comment ça marche

  1. Créer un compte

    Inscrivez-vous avec email et mot de passe pour recevoir votre clé API instantanément.

  2. Recharger

    Ajoutez du crédit prépayé à partir de 10 $, ou commencez avec 0,50 $ de crédit d'essai.

  3. Envoyer des requêtes

    Utilisez votre SDK préféré pour appeler l'endpoint chat-completions avec l'identifiant de modèle 'uncensored'.

Ce que les gens créent avec cela

Génération de contenu

Générez de l'écriture créative, du jeu de rôle ou des récits fictifs sans filtres de contenu bloquant les thèmes adultes ou controversés. Obtenez une sortie brute pour des cas d'utilisation adultes légaux.

Extraction de données

Analysez des documents ou des logs complexes sans que le modèle refuse de traiter des structures de données sensibles ou inhabituelles. Idéal pour l'analyse technique et la recherche.

Assistance au codage

Utilisez un LLM de codage sans censure pour obtenir des réponses directes aux questions techniques sans moralisation inutile ou refus sur les tâches de programmation standard.

Analyse de recherche

Analysez des articles de recherche en sécurité ou des textes politiques sans que le modèle adoucisse son ton ou refuse de discuter de sujets controversés. Obtenez des résumés impartiaux.

L'avantage sans censure

La plupart des LLM hébergés sont ajustés pour un large public, ce qui signifie qu’ils refusent de répondre aux questions sur les sujets pour adultes, la politique controversée ou la recherche en sécurité de niche. Heretic LLM utilise un modèle abliteré qui supprime ces refus spécifiques. Vous obtenez la sortie complète que le modèle génère pour un usage adulte légal, sans les interruptions polies du type « Je ne peux pas vous aider avec ça ». Il ne s’agit pas simplement d’un modèle dont les garde-fous de sécurité sont désactivés ; c’est un modèle à poids ouverts spécifiquement ajusté pour répondre directement. Vous pouvez l’utiliser pour l’écriture créative, le jeu de rôle ou l’analyse de données sensibles sans vous soucier que des filtres de contenu bloquent vos requêtes. L’identifiant du modèle est simplement « uncensored ». Il se comporte comme n’importe quel autre LLM, mais sans la couche supplémentaire de modération d’entreprise qui encombre souvent la sortie.

Comment ça marche

Notre service est une simple API de texte. Vous envoyez du texte en entrée et recevez du texte en sortie. Il n'y a pas d'embeddings, pas de génération d'images et pas de traitement audio. L'endpoint est POST /v1/chat/completions. Vous pouvez activer le streaming avec Server-Sent Events (SSE) ou utiliser l'appel de fonctions. L'URL de base est https://api.hereticllm.com/v1. Si vous utilisez déjà le SDK OpenAI en Python ou Node.js, vous devez uniquement modifier le base_url et fournir votre clé API. Le modèle prend en charge une fenêtre de contexte de 100 000 tokens. Cela vous permet de traiter de grands documents ou de maintenir de longs historiques de conversation. Il n'y a pas de routage complexe ni de changement de modèle. Vous bénéficiez d'un modèle sans censure spécifique, optimisé pour des réponses directes. Les requêtes sont limitées à 8 Mo en taille de corps et à 300 requêtes par minute par clé.

Tarification et Crédits

Nous utilisons un modèle de paiement à l'usage simple. Pas d'abonnements ni de frais mensuels. Vous achetez du crédit prépayé, et il n'expire jamais. Le prix est de 0,25 $ par 1 million de tokens d'entrée et de 1,00 $ par 1 million de tokens de sortie. Vous pouvez recharger avec de la crypto (USDT ou USDC) à partir de 10 $. Nous offrons également des bonus : +5 % de crédit sur les recharges de 50 $ et +10 % sur les recharges de 100 $. Les nouveaux comptes reçoivent 0,50 $ de crédit d'essai valable 7 jours. Aucune carte bancaire n'est nécessaire pour l'essai. Vous pouvez générer une nouvelle clé API à tout moment, ce qui révoque l'ancienne. C'est idéal pour les développeurs qui souhaitent tester l'API avant de s'engager pour un solde plus important. Vous ne payez que les tokens que vous consommez réellement.

Expérience développeur

Nous avons créé cela pour les développeurs qui veulent des résultats sans la surcharge. Vous n'avez pas besoin de gérer des conteneurs Docker, les pilotes GPU ou les limites de VRAM. L'API est compatible avec les clients OpenAI standards. Cela signifie que vous pouvez utiliser des outils comme LangChain ou LlamaIndex avec des modifications de code minimales. Mettez simplement à jour le base_url. Nous n'offrons pas de garanties SLA, de certifications SOC2 ou de déploiement on-premise. Il s'agit d'un service hébergé pour les développeurs individuels et les petites équipes. Si vous avez besoin d'un support de niveau entreprise ou de certifications de conformité spécifiques, cela pourrait ne pas convenir. Nous nous concentrons sur la fourniture d'un endpoint textuel sans censure fiable. L'inscription prend quelques secondes. Entrez votre email, définissez un mot de passe et obtenez votre clé. Aucune vérification par téléphone, aucun contrôle de carte bancaire. Vos prompts ne sont pas utilisés pour l'entraînement du modèle.

Questions et réponses

Est-ce la même chose qu'un modèle Ollama sans censure en local ?

Non. Les modèles Ollama locaux vous obligent à gérer le matériel GPU, les pilotes et la mémoire. Notre API donne accès à un modèle sans censure similaire via un endpoint hébergé. Vous bénéficiez du même comportement sans refus sans la complexité de l'installation locale. Vous payez par token au lieu d'acheter du matériel.

Quelle est la taille de la fenêtre de contexte ?

Le modèle prend en charge une fenêtre de contexte de 100 000 tokens. Cela inclut à la fois le prompt et la complétion. Cela permet de traiter de grands documents ou de maintenir de longues conversations sans perdre le contexte.

Les crédits d'essai sont-ils facturés ?

Non. Chaque nouveau compte reçoit 0,50 $ de crédit d'essai valable 7 jours. Aucune carte bancaire ni numéro de téléphone n'est requis pour le réclamer. Il s'agit d'un avantage unique par personne pour tester l'API.

Le modèle est-il entraîné avec mes données ?

Non. Nous n’utilisons pas vos prompts pour l’entraînement. Vos données restent privées et liées à votre compte. Nous ne stockons que ce qui est nécessaire pour traiter vos requêtes et facturer votre compte.

Puis-je l’utiliser pour du contenu NSFW ?

Oui. Le modèle est sans censure et n’bloque pas le contenu adulte légal. Cependant, nous bloquons les requêtes impliquant du contenu sexuel avec des mineurs. Il s’agit d’une limite stricte qui s’applique toujours, quel que soit votre type de compte.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l’URL de base. C’est toute la configuration.

Obtenir la clé APILire la documentation