API Hermes: Ganti klien Anda dalam tiga baris
Mulai dengan API hermes dalam hitungan menit menggunakan SDK OpenAI standar. Panduan cepat ini mencakup konfigurasi, permintaan dasar, streaming, dan penanganan error untuk integrasi LLM tanpa sensor Anda.
- per 1M token input
- $0.25
- Token output / 1M
- $1.00
- jendela konteks token
- 100,000
- kredit uji coba
- $0.50
- permintaan per menit
- 300
Instal SDK OpenAI
Karena endpoint kami kompatibel dengan OpenAI, Anda dapat menggunakan SDK resmi yang sudah Anda kenal. Pendekatan ini memungkinkan Anda beralih dari vendor lain tanpa menulis ulang logika aplikasi Anda. Kami mendukung paket openai standar untuk lingkungan Python dan Node.js.
Pastikan Anda menggunakan versi SDK terbaru untuk menjamin kompatibilitas dengan fitur streaming dan pemanggilan fungsi. Perpustakaan klien menangani serialisasi JSON dan transportasi HTTP secara otomatis, sehingga Anda dapat fokus pada parameter model daripada detail jaringan.
Konfigurasi URL Dasar & Kunci
Autentikasi ditangani melalui token Bearer di header Authorization. Anda mendapatkan kunci Anda dengan mendaftar dengan email dan kata sandi di dasbor kami. Tidak diperlukan kartu kredit untuk uji coba, dan Anda dapat membuat ulang kunci Anda kapan saja untuk mencabut akses.
Atur URL dasar ke endpoint khusus kami. Ini memastikan semua permintaan dikirim ke infrastruktur model tanpa sensor kami, bukan ke cloud OpenAI default. Anda dapat menemukan kunci API Anda di halaman 'Dapatkan kunci API' segera setelah pendaftaran.
Kirim Permintaan Pertama Anda
Kirim permintaan penyelesaian obrolan standar untuk menguji konektivitas. ID model selalu uncensored. Model ini disesuaikan untuk menjawab tanpa penolakan konten untuk penggunaan dewasa yang sah, menjadikannya ideal untuk penulisan kreatif, roleplay, atau penelitian tanpa batasan.
- Gunakan
POST /v1/chat/completionsuntuk pembuatan teks. - Jendela konteks mendukung hingga 100.000 token untuk prompt plus penyelesaian.
- Permintaan dibebankan berdasarkan jumlah token input dan output.
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Aktifkan Streaming (SSE)
Untuk pengalaman pengguna yang lebih baik, aktifkan streaming untuk menerima token saat dihasilkan. Ini mengurangi latensi yang dirasakan, terutama untuk respons yang lebih panjang. Server mengembalikan Server-Sent Events (SSE) yang dapat diparsing klien Anda secara real-time.
Atur parameter stream menjadi true di body permintaan Anda. SDK akan menghasilkan chunk saat tiba. Ini sangat berguna untuk antarmuka obrolan di mana Anda ingin menampilkan teks secara bertahap daripada menunggu seluruh respons selesai.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Gunakan Pemanggilan Alat/Fungsi
API kami mendukung pemanggilan fungsi, memungkinkan model menghasilkan JSON terstruktur untuk eksekusi alat eksternal. Tentukan fungsi Anda di parameter tools, dan model akan mengembalikan tool_calls di respons jika sesuai.
Fitur ini bekerja persis seperti yang didokumentasikan dalam spesifikasi OpenAI. Anda dapat mem-parsing nama fungsi dan argumen, menjalankan logika backend Anda, dan memberikan kembali hasilnya ke percakapan. Ini sepenuhnya kompatibel dengan alur kerja pemanggilan alat SDK OpenAI standar.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Periksa Model yang Tersedia
Query endpoint model untuk memverifikasi konektivitas dan melihat opsi yang tersedia. Saat ini, kami menawarkan satu model khusus: uncensored. Kesederhanaan ini menghindari kompleksitas routing model atau infrastruktur generik, memastikan perilaku yang dapat diprediksi.
Anda juga dapat menggunakan endpoint ini untuk debug masalah autentikasi. Jika permintaan gagal, periksa validitas kunci API Anda dan konektivitas jaringan. Respons akan mencantumkan detail model, termasuk ukuran jendela konteks dan batas token.
from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Kelola Batas Laju & Error
API kami memberlakukan batas 300 permintaan per menit per kunci. Jika Anda melebihi ini, Anda akan menerima error 429. Kami juga mendukung batas body permintaan 8 MB untuk prompt kompleks atau jendela konteks besar.
Error umum termasuk 401 (kunci tidak valid) dan 402 (kredit tidak cukup). Saldo prabayar tidak pernah kedaluwarsa, sehingga Anda dapat mengisi saldo sesuai kenyamanan Anda. Bonus kredit diterapkan secara otomatis untuk pembelian yang lebih besar: +5% dari $50 dan +10% dari $100.
Spesifikasi teknis
Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.
| Item | Nilai |
|---|---|
| Format | kompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci |
| ID model | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autentikasi | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.hermesllmapi.com/v1 |
| Output maksimal | hingga sisa jendela 100.000 token; max_tokens opsional (tanpa batas terpisah) |
| Mode JSON | response_format: {"type": "json_object"} |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | ya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool |
| Jendela konteks | 100.000 token (input + output) |
| Streaming | ya — server-sent events; potongan terakhir berisi penggunaan token |
| Konkurensi | 8 permintaan bersamaan per kunci |
| Header respons | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Batas laju | 300 permintaan per menit per kunci |
| Ukuran permintaan | hingga 8 MB |
| Harga | $0,25 per 1 juta token input · $1,00 per 1 juta token output |
| Bonus | +5% mulai $50, +10% mulai $100 |
| Isi saldo | USDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500 |
| Uji coba gratis | $0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama |
| Penagihan | saldo prabayar sesuai pemakaian nyata; error dan penolakan gratis |
| Masa berlaku | saldo berbayar tidak kedaluwarsa, tanpa langganan |
| Kunci | satu kunci aktif per akun; kunci baru menggantikan yang lama |
| Masuk | Google atau email dan kata sandi |
| Konten | konten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak |
Kode error
Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.
| Kode | Tipe | Arti |
|---|---|---|
400 | bad_request | JSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang |
401 | missing_key · invalid_key · key_revoked | kunci tidak ada, salah, atau sudah diganti |
402 | no_credit | saldo habis — isi ulang dan lanjut seketika |
403 | content_blocked | konten seksual dengan anak di bawah umur — ditolak, tidak ditagih |
404 | not_found | endpoint tidak dikenal |
413 | request_too_large | body lebih dari 8 MB |
429 | rate_limited · concurrency | lebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi |
503 | upstream_busy | model sibuk — coba lagi beberapa detik lagi |
Tanya jawab
Apakah API hermes mendukung pembuatan gambar atau audio?
Tidak, saat ini kami menawarkan API chat-completions teks saja. Kami tidak mendukung embedding, pembuatan gambar, audio, atau video, dan juga tidak menawarkan fine-tuning. Fokus kami adalah menyediakan model teks tanpa sensor yang sederhana untuk klien yang kompatibel dengan OpenAI.
Bagaimana model tanpa sensor menangani konten dewasa?
Model ini tidak menolak topik dewasa yang sah, fiksi, atau kontroversial. Namun, ada batas konten yang ketat: permintaan yang melibatkan konten seksual dengan anak di bawah umur selalu diblokir. Ini adalah satu-satunya pembatasan ketat yang diterapkan pada prompt Anda.
Apa yang terjadi jika saldo kredit saya habis?
Kunci API Anda tetap aktif, tetapi permintaan akan mengembalikan error 402 yang menunjukkan dana tidak cukup. Anda dapat mengisi saldo akun Anda dengan kripto (USDT atau USDC) kapan saja. Saldo prabayar Anda tidak pernah kedaluwarsa, sehingga Anda dapat menambahkan dana kapan saja Anda siap untuk melanjutkan.
Kunci Anda hanya selangkah lagi dari satu formulir
Buat akun, salin kunci, ubah URL dasar. Itu saja seluruh pengaturannya.