ES ▾
Obtener clave de API

API sin censurahttps://api.hereticllm.com/v1

API LLM sin censura para desarrolladores

Accede a un LLM ablitrado a través de un endpoint estándar compatible con OpenAI. Obtén generación de texto instantánea y sin rechazos sin gestionar infraestructura GPU local.

Obtener clave de APILeer la documentación

  • Compatible con SDK de OpenAI
  • $0,25 por cada 1M de tokens de entrada
  • Sin tarifas de suscripción

Pruébalo con una sola petición

curl https://api.hereticllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'
por 1M de tokens de entrada
$0,25
Tokens de salida / 1M
$1,00
contexto de tokens
100.000
crédito de prueba
$0,50
peticiones por minuto
300

Lo que obtienes

Acceso directo a la API

Envía peticiones a POST /v1/chat/completions. El servicio maneja streaming vía SSE y admite llamadas a funciones y herramientas sin configuración adicional.

Compatibilidad estándar

Funciona con los SDK oficiales de OpenAI y cualquier cliente compatible con OpenAI. Apunta tu base_url a https://api.hereticllm.com/v1 y usa tu clave de API.

Sin configuración local

Accede al modelo sin censura al instante. No necesitas descargar pesos, gestionar controladores CUDA ni reservar tiempo costoso de GPU en tu máquina local.

Precios simples

Crédito prepago de pago por uso. Sin suscripciones mensuales ni tarifas ocultas. El crédito no caduca, así que solo pagas por lo que usas.

Privacidad primero

Los prompts no se usan para entrenamiento. Regístrate solo con correo electrónico y contraseña. No se requiere número de teléfono ni tarjeta de crédito para la prueba.

Contexto grande

Admite una ventana de contexto de 100.000 tokens para prompt y completación. Ideal para procesar documentos largos o historiales de conversaciones extensas.

Cómo funciona

  1. Crear cuenta

    Regístrate con correo electrónico y contraseña para recibir tu clave de API al instante.

  2. Recargar créditos

    Añade crédito prepago a partir de $10, o comienza con $0,50 de crédito de prueba.

  3. Enviar peticiones

    Usa tu SDK favorito para llamar al endpoint de chat-completions con el id de modelo 'uncensored'.

Lo que la gente construye con esto

Generación de contenido

Genera escritura creativa, roleplay o narraciones ficticias sin filtros de contenido que bloqueen temas adultos o controvertidos. Obtén salida sin procesar para casos de uso adultos legales.

Extracción de datos

Analiza documentos complejos o registros sin que el modelo rechace procesar estructuras de datos sensibles o inusuales. Ideal para análisis técnico e investigación.

Asistencia de codificación

Usa un LLM de codificación sin censura para obtener respuestas directas a preguntas técnicas sin moralización innecesaria ni rechazos en tareas de programación estándar.

Análisis de investigación

Analiza artículos de investigación de seguridad o textos políticos sin que el modelo suavice su tono o rechace discutir temas controvertidos. Obtén resúmenes imparciales.

La ventaja sin censura

La mayoría de los LLM alojados están ajustados para un atractivo amplio, lo que significa que se niegan a responder preguntas sobre temas para adultos, política controvertida o investigación de seguridad de nicho. Heretic LLM utiliza un modelo abliterado que elimina estos rechazos específicos. Obtienes toda la salida que genera el modelo para uso adulto lícito, sin las interrupciones educadas de «No puedo ayudarte con eso». Esto no es solo un modelo con las barreras de seguridad desactivadas; es un modelo de pesos abiertos específicamente ajustado diseñado para responder directamente. Puedes usarlo para escritura creativa, roleplay o análisis de datos sensibles sin preocuparte por los filtros de contenido que bloqueen tus peticiones. El id del modelo es simplemente «uncensored». Se comporta como cualquier otro LLM, pero sin la capa extra de moderación corporativa que a menudo satura la salida.

Cómo funciona

Nuestro servicio es una API de texto simple. Envías texto y recibes texto. No hay embeddings, ni generación de imágenes, ni procesamiento de audio. El endpoint es POST /v1/chat/completions. Puedes habilitar streaming con Eventos enviados por el servidor (SSE) o usar llamadas a funciones y herramientas. La URL base es https://api.hereticllm.com/v1. Si ya usas el SDK de OpenAI en Python o Node.js, solo necesitas cambiar la base_url y proporcionar tu clave de API. El modelo admite una ventana de contexto de 100.000 tokens. Esto te permite procesar documentos grandes o mantener historiales de conversación largos. No hay enrutamiento complejo ni cambio de modelos. Obtienes un modelo sin censura específico, optimizado para respuestas directas. Las peticiones están limitadas a 8 MB de tamaño de cuerpo y 300 peticiones por minuto por clave.

Precios y créditos

Usamos un modelo de pago por uso sencillo. No hay suscripciones ni tarifas mensuales. Compras crédito prepago y no caduca. El precio es $0,25 por 1 millón de tokens de entrada y $1,00 por 1 millón de tokens de salida. Puedes recargar con criptomonedas (USDT o USDC) a partir de $10. También ofrecemos bonificaciones: +5% de crédito en recargas de $50 y +10% en recargas de $100. Las cuentas nuevas reciben $0,50 en crédito de prueba válido por 7 días. No se necesita tarjeta de crédito para la prueba. Puedes generar una nueva clave de API en cualquier momento, lo que revoca la anterior. Esto es ideal para desarrolladores que quieren probar la API antes de comprometerse con un saldo mayor. Solo pagas por los tokens que realmente consumes.

Experiencia del desarrollador

Construimos esto para desarrolladores que quieren resultados sin la sobrecarga. No necesitas gestionar contenedores Docker, controladores de GPU ni límites de VRAM. La API es compatible con clientes estándar de OpenAI. Esto significa que puedes usar herramientas como LangChain o LlamaIndex con cambios mínimos de código. Simplemente actualiza la base_url. No ofrecemos garantías de SLA, certificaciones SOC2 ni despliegue on-prem. Este es un servicio alojado para desarrolladores individuales y equipos pequeños. Si necesitas soporte de grado empresarial o certificaciones de cumplimiento específicas, esto podría no ser la opción adecuada. Nos centramos en darte un endpoint de texto sin censura fiable. Registrarse toma segundos. Ingresa tu correo electrónico, establece una contraseña y obtén tu clave. Sin verificación por teléfono, sin comprobaciones de tarjeta de crédito. Tus prompts no se utilizan para entrenar el modelo.

Preguntas y respuestas

¿Es lo mismo que ejecutar un modelo Ollama sin censura localmente?

No. Los modelos Ollama locales requieren que gestiones el hardware GPU, los controladores y la memoria. Nuestra API proporciona acceso a un modelo sin censura similar a través de un endpoint alojado. Obtienes el mismo comportamiento sin rechazos sin la molestia de la configuración local. Pagas por token en lugar de comprar hardware.

¿Cuál es el tamaño de la ventana de contexto?

El modelo admite una ventana de contexto de 100.000 tokens. Esto incluye tanto el prompt como el completion. Esto permite procesar documentos grandes o mantener conversaciones largas sin perder el contexto.

¿Cobran por los créditos de prueba?

No. Cada cuenta nueva recibe $0,50 de crédito de prueba válido por 7 días. No se requiere tarjeta de crédito ni número de teléfono para reclamarlo. Es un beneficio único por persona para probar la API.

¿Se utiliza el modelo para entrenar mis datos?

No. No utilizamos tus prompts para el entrenamiento. Tus datos permanecen privados para tu cuenta. Solo almacenamos lo necesario para procesar tus peticiones y facturar tu cuenta.

¿Puedo usarlo para contenido NSFW?

Sí. El modelo es sin censura y no rechaza contenido adulto lícito. Sin embargo, bloqueamos las peticiones que involucren contenido sexual con menores. Este es un límite estricto que siempre se aplica, independientemente de tu tipo de cuenta.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave y cambia la URL base. Eso es toda la configuración.

Obtener clave de APILeer la documentación