API Sem Censurahttps://api.hereticllm.com/v1
API IA sem censura para desenvolvedores
Acesse um LLM abliterado via endpoint padrão compatível com OpenAI. Obtenha geração de texto instantânea e sem recusas sem gerenciar infraestrutura de GPU local.
Obter chave de APILer a documentação
- Compatível com SDK OpenAI
- $0,25 por 1M de tokens de entrada
- Sem taxas de assinatura
Teste com uma única requisição
curl https://api.hereticllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);- por 1M de tokens de entrada
- $0.25
- Tokens de saída / 1M
- $1.00
- janela de contexto de tokens
- 100,000
- crédito de teste
- $0.50
- requisições por minuto
- 300
O que você recebe
Acesso direto à API
Envie requisições para POST /v1/chat/completions. O serviço lida com streaming via SSE e suporta chamada de funções/ferramentas sem configuração extra.
Compatibilidade padrão
Funciona com SDKs oficiais da OpenAI e qualquer cliente compatível com OpenAI. Aponte seu base_url para https://api.hereticllm.com/v1 e use sua chave de API.
Sem configuração local
Acesse o modelo sem censura instantaneamente. Não precisa baixar pesos, gerenciar drivers CUDA ou reservar tempo caro de GPU na sua máquina local.
Preços simples
Crédito pré-pago pagamento por uso. Sem assinaturas mensais ou taxas ocultas. O crédito nunca expira, então você paga apenas pelo que usa.
Privacidade em primeiro lugar
Prompts não são usados para treinamento. Cadastre-se apenas com e-mail e senha. Não é necessário número de telefone ou cartão de crédito para o teste.
Grande contexto
Suporta uma janela de contexto de 100.000 tokens para prompt e conclusão. Ideal para processar documentos longos ou históricos de conversas estendidos.
Como funciona
Criar conta
Cadastre-se com e-mail e senha para receber sua chave de API instantaneamente.
Carregar créditos
Adicione crédito pré-pago a partir de $10, ou comece com $0,50 de crédito de teste.
Enviar requisições
Use seu SDK favorito para chamar o endpoint chat-completions com o id do modelo 'uncensored'.
O que as pessoas constroem com isso
Geração de conteúdo
Gere escrita criativa, roleplay ou narrativas fictícias sem filtros de conteúdo bloqueando temas adultos ou controversos. Obtenha saída bruta para casos de uso adultos legais.
Extração de dados
Analise documentos ou logs complexos sem o modelo recusar processar estruturas de dados sensíveis ou incomuns. Ideal para análise técnica e pesquisa.
Assistência de codificação
Use um LLM de codificação sem censura para obter respostas diretas a perguntas técnicas sem moralização desnecessária ou recusa em tarefas de programação padrão.
Análise de pesquisa
Analise artigos de pesquisa de segurança ou textos políticos sem o modelo suavizar seu tom ou recusar discutir tópicos controversos. Obtenha resumos imparciais.
A Vantagem Sem Censura
A maioria dos LLMs hospedados é ajustada para apelo amplo, o que significa que eles recusam responder perguntas sobre tópicos adultos, política controversa ou pesquisa de segurança de nicho. Heretic LLM usa um modelo abliterado que remove essas recusas específicas. Você obtém toda a saída que o modelo gera para uso adulto legal, sem as interrupções educadas de "Não posso ajudar com isso". Isso não é apenas um modelo com as barreiras de segurança desligadas; é um modelo de pesos abertos especificamente ajustado projetado para responder diretamente. Você pode usá-lo para escrita criativa, roleplay ou análise de dados sensíveis sem se preocupar com filtros de conteúdo bloqueando suas requisições. O id do modelo é simplesmente "uncensored". Ele se comporta como qualquer outro LLM, mas sem a camada extra de moderação corporativa que muitas vezes polui a saída.Como funciona
Nosso serviço é uma API de texto simples. Você envia texto e recebe texto. Não há embeddings, geração de imagem ou processamento de áudio. O endpoint é POST /v1/chat/completions. Você pode habilitar streaming com Server-Sent Events (SSE) ou usar chamada de ferramentas/funções. O base_url é https://api.hereticllm.com/v1. Se você já está usando o SDK OpenAI em Python ou Node.js, você só precisa alterar o base_url e fornecer sua chave de API. O modelo suporta uma janela de contexto de 100.000 tokens. Isso permite processar documentos grandes ou manter históricos de conversas longos. Não há roteamento complexo ou troca de modelos. Você obtém um modelo sem censura específico, otimizado para respostas diretas. As requisições são limitadas a 8 MB de tamanho de corpo e 300 requisições por minuto por chave.
Preços e Créditos
Usamos um modelo de pagamento por uso direto. Não há assinaturas nem taxas mensais. Você compra crédito pré-pago e ele nunca expira. O preço é $0,25 por 1 milhão de tokens de entrada e $1,00 por 1 milhão de tokens de saída. Você pode recarregar com cripto (USDT ou USDC) a partir de $10. Também oferecemos bônus: +5% de crédito em recargas de $50 e +10% em recargas de $100. Novas contas recebem $0,50 em crédito de teste válido por 7 dias. Não é necessário cartão de crédito para o teste. Você pode gerar uma nova chave de API a qualquer momento, o que revoga a antiga. Isso é ideal para desenvolvedores que querem testar a API antes de comprometer-se com um saldo maior. Você paga apenas pelos tokens que realmente consome.
Experiência do Desenvolvedor
Construímos isso para desenvolvedores que querem resultados sem a sobrecarga. Você não precisa gerenciar contêineres Docker, drivers de GPU ou limites de VRAM. A API é compatível com clientes OpenAI padrão. Isso significa que você pode usar ferramentas como LangChain ou LlamaIndex com alterações mínimas de código. Basta atualizar o base_url. Não oferecemos garantias de SLA, certificações SOC2 ou implantação on-prem. Este é um serviço hospedado para desenvolvedores individuais e pequenas equipes. Se você precisa de suporte de nível empresarial ou certificações de conformidade específicas, este pode não ser o ajuste certo. Focamos em fornecer um endpoint de texto sem censura confiável. O cadastro leva segundos. Insira seu e-mail, defina uma senha e obtenha sua chave. Sem verificação por telefone, sem verificações de cartão de crédito. Seus prompts não são usados para treinar o modelo.
Perguntas e respostas
Isso é igual a rodar um modelo Ollama sem censura localmente?
Não. Modelos Ollama locais exigem que você gerencie hardware de GPU, drivers e memória. Nossa API oferece acesso a um modelo sem censura similar via endpoint hospedado. Você obtém o mesmo comportamento sem recusas sem o incômodo da configuração local. Você paga por token em vez de comprar hardware.
Qual é o tamanho da janela de contexto?
O modelo suporta uma janela de contexto de 100.000 tokens. Isso inclui tanto o prompt quanto a conclusão. Isso permite processar documentos grandes ou manter conversas longas sem perder o contexto.
Você paga pelos créditos de teste?
Não. Toda nova conta recebe $0,50 de crédito de teste válido por 7 dias. Não é necessário cartão de crédito ou número de telefone para resgatá-lo. É um benefício único por pessoa para testar a API.
O modelo é usado para treinar meus dados?
Não. Não usamos seus prompts para treinamento. Seus dados permanecem privados na sua conta. Armazenamos apenas o necessário para processar suas requisições e faturar sua conta.
Posso usar para conteúdo NSFW?
Sim. O modelo é sem censura e não recusa conteúdo adulto lícito. No entanto, bloqueamos requisições envolvendo conteúdo sexual com menores. Este é um limite rígido que sempre se aplica, independentemente do tipo da sua conta.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave e altere a URL base. Essa é toda a configuração.