Heretic LLMHeretic LLM: Dokumentasi API
Heretic LLM: Dokumentasi API
Mulai dengan API Heretic LLM dalam hitungan menit. Gunakan SDK OpenAI standar untuk mengirim teks dan menerima respons tanpa sensor dari model 'uncensored' tanpa mengelola infrastruktur GPU.
URL Dasar dan Autentikasi
Untuk mulai menggunakan API Heretic LLM, arahkan klien kompatibel OpenAI Anda ke URL dasar kami: https://api.hereticllm.com/v1. API menggunakan autentikasi token Bearer standar. Anda dapat menghasilkan kunci API dengan mendaftar hanya dengan email dan kata sandi di halaman Dapatkan Kunci API. Kunci ditampilkan segera setelah pendaftaran dan dapat dibuat ulang kapan saja, yang akan membuat kunci sebelumnya tidak valid.
Atur variabel lingkungan OPENAI_API_KEY atau teruskan kunci secara langsung dalam konfigurasi klien Anda. Pastikan URL dasar Anda diperbarui ke endpoint Heretic. Pengaturan ini memungkinkan Anda menggunakan SDK OpenAI resmi tanpa perubahan kode, hanya dengan mengganti URL dasar dan kunci.
Permintaan Pertama
Buat permintaan pertama Anda ke endpoint penyelesaian obrolan. Pengenal model adalah uncensored. Model bobot terbuka ini disesuaikan untuk menjawab tanpa penolakan konten untuk penggunaan dewasa yang sah, menjadikannya ideal untuk pemrograman tanpa sensor, penulisan kreatif, atau penelitian. Jendela konteks mendukung hingga 100.000 token untuk prompt dan completion gabungan.
Di bawah ini adalah contoh cURL dasar untuk menguji endpoint. Ganti YOUR_API_KEY dengan kunci aktual Anda.
Responsnya akan berupa objek format OpenAI standar yang berisi teks yang dihasilkan.
curl https://api.hereticllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integrasi SDK Python
Integrasikan API ke aplikasi Python Anda menggunakan paket openai resmi. Perpustakaan menangani serialisasi JSON dan streaming secara otomatis. Inisialisasi klien dengan kunci API Anda dan URL dasar yang benar. Kemudian, panggil chat.completions.create dengan ID model uncensored.
Pendekatan ini bekerja mulus untuk alur kerja sinkron dan asinkron. Model merespons prompt standar, pemanggilan fungsi, dan parameter streaming seperti endpoint kompatibel OpenAI lainnya. Anda dapat meneruskan prompt sistem untuk membimbing perilaku model atau menggunakan pesan pengguna untuk interaksi langsung.
from openai import OpenAI
client = OpenAI(base_url="https://api.hereticllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integrasi SDK Node.js
Untuk proyek JavaScript dan TypeScript, gunakan paket npm openai. Konfigurasikan klien dengan URL dasar Heretic dan kunci API Anda. API mendukung struktur permintaan standar, termasuk definisi alat dan pemanggilan fungsi.
Pastikan untuk menangani respons dengan benar, terutama saat menggunakan pola async/await. Model mengembalikan respons teks yang dapat diproses langsung dalam logika aplikasi Anda. Integrasi ini ideal untuk membangun antarmuka obrolan, agen otomatis, atau pipa pemrosesan data yang memerlukan kemampuan LLM tanpa sensor.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hereticllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respons Streaming
Aktifkan respons waktu nyata dengan mengaktifkan streaming dalam permintaan API Anda. Atur parameter stream menjadi true. API akan mengembalikan aliran Acara yang Dikirim Server (SSE) yang berisi potongan teks saat dihasilkan. Ini mengurangi latensi yang dirasakan dan memberikan pengalaman pengguna yang lebih mulus untuk aplikasi obrolan.
Setiap potongan dalam aliran berisi sebagian respons. Tangani potongan-potongan ini secara inkremental untuk memperbarui UI Anda secara waktu nyata. Fitur streaming sepenuhnya kompatibel dengan SDK OpenAI, sehingga Anda dapat menggunakan iterator stream standar atau pendengar acara untuk memproses data secara efisien.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Batas Laju, Error, dan Konteks
API menerapkan batas 300 permintaan per menit per kunci dan ukuran tubuh permintaan 8 MB. Jika Anda melebihi batas laju, Anda akan menerima error 429. Error autentikasi mengembalikan status 401, yang menunjukkan kunci API tidak valid atau hilang. Jika saldo prabayar Anda habis, API mengembalikan error 402, yang memerlukan pengisian ulang.
Saldo tidak pernah kedaluwarsa, dan Anda dapat mengisi saldo mulai dari $10 menggunakan kripto (USDT atau USDC), dengan kredit bonus untuk deposit yang lebih besar. Model mendukung jendela konteks 100.000 token. Pastikan prompt dan completion Anda sesuai dengan batas ini. Untuk detail lebih lanjut tentang harga dan batas, kunjungi halaman Harga.
Spesifikasi teknis
Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.
| Item | Nilai |
|---|---|
| Format | kompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci |
| Base URL | https://api.hereticllm.com/v1 |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autentikasi | Authorization: Bearer YOUR_KEY |
| ID model | uncensored |
| Function calling | ya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool |
| Mode JSON | response_format: {"type": "json_object"} |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Output maksimal | hingga sisa jendela 100.000 token; max_tokens opsional (tanpa batas terpisah) |
| Jendela konteks | 100.000 token (input + output) |
| Streaming | ya — server-sent events; potongan terakhir berisi penggunaan token |
| Ukuran permintaan | hingga 8 MB |
| Konkurensi | 8 permintaan bersamaan per kunci |
| Header respons | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Batas laju | 300 permintaan per menit per kunci |
| Penagihan | saldo prabayar sesuai pemakaian nyata; error dan penolakan gratis |
| Uji coba gratis | $0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama |
| Harga | $0,25 per 1 juta token input · $1,00 per 1 juta token output |
| Masa berlaku | saldo berbayar tidak kedaluwarsa, tanpa langganan |
| Bonus | +5% mulai $50, +10% mulai $100 |
| Isi saldo | USDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500 |
| Masuk | Google atau email dan kata sandi |
| Kunci | satu kunci aktif per akun; kunci baru menggantikan yang lama |
| Konten | konten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak |
Kode error
Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.
| Kode | Tipe | Arti |
|---|---|---|
400 | bad_request | JSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang |
401 | missing_key · invalid_key · key_revoked | kunci tidak ada, salah, atau sudah diganti |
402 | no_credit | saldo habis — isi ulang dan lanjut seketika |
403 | content_blocked | konten seksual dengan anak di bawah umur — ditolak, tidak ditagih |
404 | not_found | endpoint tidak dikenal |
413 | request_too_large | body lebih dari 8 MB |
429 | rate_limited · concurrency | lebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi |
503 | upstream_busy | model sibuk — coba lagi beberapa detik lagi |
Tanya jawab
Apakah model tanpa sensor gratis?
Model ini tidak gratis tetapi menggunakan sistem saldo prabayar bayar sesuai pemakaian. Akun baru menerima kredit uji coba senilai $0,50 yang berlaku selama 7 hari. Saldo prabayar tidak pernah kedaluwarsa, dan Anda dapat mengisi saldo mulai dari $10.
Berapa ukuran jendela konteks?
Model ini mendukung jendela konteks 100.000 token, yang mencakup prompt input dan completion yang dihasilkan. Ini memungkinkan interaksi konteks panjang dan tugas pemrosesan data besar.
Apakah API mendukung pemanggilan alat?
Ya, API mendukung pemanggilan alat dan fungsi. Anda dapat mendefinisikan alat dalam permintaan Anda, dan model akan merespons dengan data terstruktur yang dapat dieksekusi oleh aplikasi Anda. Ini kompatibel dengan pola SDK OpenAI standar.
Kunci Anda hanya selangkah lagi dari satu formulir
Buat akun, salin kunci, ubah URL dasar. Itu saja seluruh pengaturannya.