一个请求即可试用
curl https://api.hereticllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);- 每 1M 输入 token
- $0.25
- 输出 token / 1M
- $1.00
- token 上下文
- 100,000
- 试用额度
- $0.50
- 每分钟请求数
- 300
你获得什么
直接 API 访问
向 POST /v1/chat/completions 发送请求。服务通过 SSE 处理流式输出,并支持无需额外配置的函数调用。
标准兼容性
适用于官方 OpenAI SDK 和任何 OpenAI 兼容客户端。将 base_url 指向 https://api.hereticllm.com/v1 并使用你的 API 密钥。
无需本地设置
即时访问无审查模型。无需下载权重、管理 CUDA 驱动程序或预留本地机器上昂贵的 GPU 时间。
简单定价
按量付费预付额度。无月度订阅或隐藏费用。额度永不过期,所以你只为使用的部分付费。
隐私优先
提示词不用于训练。只需电子邮件和密码即可注册。试用无需电话号码或信用卡。
大上下文
支持 100,000 token 上下文窗口,用于提示词和补全。非常适合处理长文档或扩展的对话历史。
工作原理
创建账户
使用电子邮件和密码注册,即时获取 API 密钥。
充值
添加预付额度,起充 $10,或开始使用 $0.50 试用额度。
发送请求
使用你喜欢的 SDK 调用 chat-completions 接口,模型 id 为 'uncensored'。
人们用它构建什么
内容生成
生成创意写作、角色扮演或虚构叙事,没有内容过滤器阻挡成人或争议主题。为合法的成人用例获取原始输出。
数据提取
解析复杂文档或日志,模型不会拒绝处理敏感或异常的数据结构。非常适合技术分析和研究。
编码辅助
使用无审查编码 LLM 直接回答技术问题,无需不必要的道德说教或对标准编程任务的拒绝。
研究分析
分析安全研究论文或政治文本,模型不会软化语气或拒绝讨论争议话题。获取无偏见的摘要。
无审查优势
大多数托管 LLM 都经过调整以迎合广泛受众,这意味着它们会拒绝回答关于成人话题、争议性政治或小众安全研究的问题。Heretic LLM 使用经过消融处理的模型,去除了这些特定的拒绝机制。你可以获得模型为合法成人用途生成的完整输出,没有那些礼貌的“我无法帮你”的打断。这不仅仅是关闭了安全护栏的模型;它是一个经过专门调整的开放权重模型,旨在直接回答问题。你可以将其用于创意写作、角色扮演或分析敏感数据,而无需担心内容过滤器会阻止你的请求。模型 ID 仅为 "uncensored"。它的行为与其他任何 LLM 一样,但没有通常会干扰输出的额外企业级审核层。工作原理
我们的服务是一个简单的文本 API。你输入文本,获得文本输出。没有嵌入、没有图像生成,也没有音频处理。接口是 POST /v1/chat/completions。你可以启用 Server-Sent Events (SSE) 流式输出或使用函数调用。基础 URL 是 https://api.hereticllm.com/v1. 如果你已经在 Python 或 Node.js 中使用 OpenAI SDK,你只需要更改 base_url 并提供 API 密钥。模型支持 100,000 token 上下文窗口。这允许你处理大型文档或保持长对话历史。没有复杂的路由或模型切换。你获得一个特定的无审查模型,针对直接回答进行了优化。请求限制为正文大小 8 MB 和每个密钥每分钟 300 个请求。
定价与额度
我们使用简单的按量付费模式。没有订阅和月度费用。你购买预付额度,且永不过期。价格为每 100 万输入 token $0.25,每 100 万输出 token $1.00。你可以使用加密货币(USDT 或 USDC)充值,起充 $10。我们还提供奖励:充值 $50 获得 +5% 额度,充值 $100 获得 +10% 额度。新账户获得 $0.50 试用额度,有效期 7 天。试用无需信用卡。你可以随时生成新的 API 密钥,这将使旧密钥失效。这对于希望在承诺更大余额之前测试 API 的开发者非常理想。你只为实际消耗的 token 付费。
开发者体验
我们为希望获得结果而无需开销的开发者构建。你不需要管理 Docker 容器、GPU 驱动程序或 VRAM 限制。API 兼容标准 OpenAI 客户端。这意味着你可以使用 LangChain 或 LlamaIndex 等工具,只需最少的代码更改。只需更新 base_url。我们不提供 SLA 保证、SOC2 认证或本地部署。这是一个面向个人开发者和小型团队的托管服务。如果你需要企业级支持或特定的合规认证,这可能不适合你。我们专注于为你提供可靠的无审查文本接口。注册只需几秒钟。输入电子邮件,设置密码,获取密钥。无需电话验证,无需信用卡检查。你的提示词不用于模型训练。
问答
这与在本地运行无审查 Ollama 模型相同吗?
不同。本地 Ollama 模型需要你管理 GPU 硬件、驱动程序和内存。我们的 API 通过托管接口提供类似无审查模型的访问权限。你获得相同的无拒绝行为,无需本地设置的麻烦。你按 token 付费,而不是购买硬件。
上下文窗口大小是多少?
模型支持 100,000 token 上下文窗口。这包括提示词和补全。这允许处理大型文档或保持长对话而不丢失上下文。
试用额度收费吗?
不。每个新账户获得 $0.50 试用额度,有效期 7 天。无需信用卡或电话号码即可领取。这是每人一次性的福利,用于测试 API。
模型是否用于训练我的数据?
不会。我们不会使用你的提示词进行训练。你的数据对你的账户保持私有。我们仅存储处理请求和计费账户所必需的内容。
我可以用于 NSFW 内容吗?
是的。该模型无审查,不会拒绝合法的成人内容。但我们会屏蔽涉及未成年人性内容的请求。这是一项硬性限制,无论你的账户类型如何均适用。