ID ▾
Dapatkan kunci API

API Hermes: Ganti klien Anda dalam tiga baris

Mulai dengan API hermes dalam hitungan menit menggunakan SDK OpenAI standar. Panduan cepat ini mencakup konfigurasi, permintaan dasar, streaming, dan penanganan error untuk integrasi LLM tanpa sensor Anda.

per 1M token input
$0.25
Token output / 1M
$1.00
jendela konteks token
100,000
kredit uji coba
$0.50
permintaan per menit
300

Instal SDK OpenAI

Karena endpoint kami kompatibel dengan OpenAI, Anda dapat menggunakan SDK resmi yang sudah Anda kenal. Pendekatan ini memungkinkan Anda beralih dari vendor lain tanpa menulis ulang logika aplikasi Anda. Kami mendukung paket openai standar untuk lingkungan Python dan Node.js.

Pastikan Anda menggunakan versi SDK terbaru untuk menjamin kompatibilitas dengan fitur streaming dan pemanggilan fungsi. Perpustakaan klien menangani serialisasi JSON dan transportasi HTTP secara otomatis, sehingga Anda dapat fokus pada parameter model daripada detail jaringan.

Konfigurasi URL Dasar & Kunci

Autentikasi ditangani melalui token Bearer di header Authorization. Anda mendapatkan kunci Anda dengan mendaftar dengan email dan kata sandi di dasbor kami. Tidak diperlukan kartu kredit untuk uji coba, dan Anda dapat membuat ulang kunci Anda kapan saja untuk mencabut akses.

Atur URL dasar ke endpoint khusus kami. Ini memastikan semua permintaan dikirim ke infrastruktur model tanpa sensor kami, bukan ke cloud OpenAI default. Anda dapat menemukan kunci API Anda di halaman 'Dapatkan kunci API' segera setelah pendaftaran.

Kirim Permintaan Pertama Anda

Kirim permintaan penyelesaian obrolan standar untuk menguji konektivitas. ID model selalu uncensored. Model ini disesuaikan untuk menjawab tanpa penolakan konten untuk penggunaan dewasa yang sah, menjadikannya ideal untuk penulisan kreatif, roleplay, atau penelitian tanpa batasan.

  • Gunakan POST /v1/chat/completions untuk pembuatan teks.
  • Jendela konteks mendukung hingga 100.000 token untuk prompt plus penyelesaian.
  • Permintaan dibebankan berdasarkan jumlah token input dan output.
curl https://api.hermesllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Aktifkan Streaming (SSE)

Untuk pengalaman pengguna yang lebih baik, aktifkan streaming untuk menerima token saat dihasilkan. Ini mengurangi latensi yang dirasakan, terutama untuk respons yang lebih panjang. Server mengembalikan Server-Sent Events (SSE) yang dapat diparsing klien Anda secara real-time.

Atur parameter stream menjadi true di body permintaan Anda. SDK akan menghasilkan chunk saat tiba. Ini sangat berguna untuk antarmuka obrolan di mana Anda ingin menampilkan teks secara bertahap daripada menunggu seluruh respons selesai.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Gunakan Pemanggilan Alat/Fungsi

API kami mendukung pemanggilan fungsi, memungkinkan model menghasilkan JSON terstruktur untuk eksekusi alat eksternal. Tentukan fungsi Anda di parameter tools, dan model akan mengembalikan tool_calls di respons jika sesuai.

Fitur ini bekerja persis seperti yang didokumentasikan dalam spesifikasi OpenAI. Anda dapat mem-parsing nama fungsi dan argumen, menjalankan logika backend Anda, dan memberikan kembali hasilnya ke percakapan. Ini sepenuhnya kompatibel dengan alur kerja pemanggilan alat SDK OpenAI standar.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Periksa Model yang Tersedia

Query endpoint model untuk memverifikasi konektivitas dan melihat opsi yang tersedia. Saat ini, kami menawarkan satu model khusus: uncensored. Kesederhanaan ini menghindari kompleksitas routing model atau infrastruktur generik, memastikan perilaku yang dapat diprediksi.

Anda juga dapat menggunakan endpoint ini untuk debug masalah autentikasi. Jika permintaan gagal, periksa validitas kunci API Anda dan konektivitas jaringan. Respons akan mencantumkan detail model, termasuk ukuran jendela konteks dan batas token.

from openai import OpenAI

client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Kelola Batas Laju & Error

API kami memberlakukan batas 300 permintaan per menit per kunci. Jika Anda melebihi ini, Anda akan menerima error 429. Kami juga mendukung batas body permintaan 8 MB untuk prompt kompleks atau jendela konteks besar.

Error umum termasuk 401 (kunci tidak valid) dan 402 (kredit tidak cukup). Saldo prabayar tidak pernah kedaluwarsa, sehingga Anda dapat mengisi saldo sesuai kenyamanan Anda. Bonus kredit diterapkan secara otomatis untuk pembelian yang lebih besar: +5% dari $50 dan +10% dari $100.

Spesifikasi teknis

Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.

ItemNilai
Formatkompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci
ID modeluncensored
EndpointPOST /v1/chat/completions · GET /v1/models
AutentikasiAuthorization: Bearer YOUR_KEY
Base URLhttps://api.hermesllmapi.com/v1
Output maksimalhingga sisa jendela 100.000 token; max_tokens opsional (tanpa batas terpisah)
Mode JSONresponse_format: {"type": "json_object"}
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool
Jendela konteks100.000 token (input + output)
Streamingya — server-sent events; potongan terakhir berisi penggunaan token
Konkurensi8 permintaan bersamaan per kunci
Header responsX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Batas laju300 permintaan per menit per kunci
Ukuran permintaanhingga 8 MB
Harga$0,25 per 1 juta token input · $1,00 per 1 juta token output
Bonus+5% mulai $50, +10% mulai $100
Isi saldoUSDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500
Uji coba gratis$0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama
Penagihansaldo prabayar sesuai pemakaian nyata; error dan penolakan gratis
Masa berlakusaldo berbayar tidak kedaluwarsa, tanpa langganan
Kuncisatu kunci aktif per akun; kunci baru menggantikan yang lama
MasukGoogle atau email dan kata sandi
Kontenkonten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak

Kode error

Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.

KodeTipeArti
400bad_requestJSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang
401missing_key · invalid_key · key_revokedkunci tidak ada, salah, atau sudah diganti
402no_creditsaldo habis — isi ulang dan lanjut seketika
403content_blockedkonten seksual dengan anak di bawah umur — ditolak, tidak ditagih
404not_foundendpoint tidak dikenal
413request_too_largebody lebih dari 8 MB
429rate_limited · concurrencylebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi
503upstream_busymodel sibuk — coba lagi beberapa detik lagi
01

Tanya jawab

Apakah API hermes mendukung pembuatan gambar atau audio?

Tidak, saat ini kami menawarkan API chat-completions teks saja. Kami tidak mendukung embedding, pembuatan gambar, audio, atau video, dan juga tidak menawarkan fine-tuning. Fokus kami adalah menyediakan model teks tanpa sensor yang sederhana untuk klien yang kompatibel dengan OpenAI.

Bagaimana model tanpa sensor menangani konten dewasa?

Model ini tidak menolak topik dewasa yang sah, fiksi, atau kontroversial. Namun, ada batas konten yang ketat: permintaan yang melibatkan konten seksual dengan anak di bawah umur selalu diblokir. Ini adalah satu-satunya pembatasan ketat yang diterapkan pada prompt Anda.

Apa yang terjadi jika saldo kredit saya habis?

Kunci API Anda tetap aktif, tetapi permintaan akan mengembalikan error 402 yang menunjukkan dana tidak cukup. Anda dapat mengisi saldo akun Anda dengan kripto (USDT atau USDC) kapan saja. Saldo prabayar Anda tidak pernah kedaluwarsa, sehingga Anda dapat menambahkan dana kapan saja Anda siap untuk melanjutkan.

Kunci Anda hanya selangkah lagi dari satu formulir

Buat akun, salin kunci, ubah URL dasar. Itu saja seluruh pengaturannya.

Dapatkan kunci APIBaca dokumentasi