NL ▾
API-sleutel aanvragen

Hermes API: wissel je client in drie regels

Begin in minuten met de Hermes API met standaard OpenAI SDK's. Deze quickstart-gids behandelt configuratie, basisverzoeken, streaming en foutafhandeling voor je ongecensureerde LLM-integratie.

per 1M input tokens
$0.25
Uitvoer tokens / 1M
$1.00
contextvenster
100,000
gratis proeftegoed
$0.50
verzoeken per minuut
300

Installeer de OpenAI SDK

Omdat onze endpoint OpenAI-compatibel is, kun je de officiële SDK's gebruiken die je al kent. Zo kun je overschakelen van andere leveranciers zonder je applicatielogica te herschrijven. We ondersteunen het standaard openai-pakket voor Python- en Node.js-omgevingen.

Zorg ervoor dat je een recente versie van de SDK gebruikt om compatibiliteit met streaming en function calling te garanderen. De clientbibliotheek verwerkt de JSON-serialisatie en HTTP-transport automatisch, zodat je je kunt concentreren op modelparameters in plaats van netwerkdetails.

Configureer Base URL & Sleutel

Authenticatie verloopt via een Bearer-token in de Authorization-header. Je verkrijgt je sleutel door je te registreren met een e-mailadres en wachtwoord op ons dashboard. Voor de proefversie is geen creditcard nodig en je kunt je sleutel op elk moment opnieuw genereren om de toegang te intrekken.

Stel de base URL in op onze speciale endpoint. Dit zorgt ervoor dat alle verzoeken naar onze infrastructuur voor het ongecensureerde model gaan in plaats van de standaard OpenAI-cloud. Je kunt je API-sleutel vinden op de pagina 'API-sleutel ophalen' direct na het aanmaken van je account.

Stuur je eerste verzoek

Stuur een standaard chat-completieverzoek om de verbinding te testen. De model-ID is altijd uncensored. Dit model is afgestemd op het geven van antwoorden zonder inhoudelijke weigeringen voor volwassen gebruik, wat het ideaal maakt voor creatief schrijven, roleplay of onderzoek zonder beperkingen.

  • Gebruik POST /v1/chat/completions voor tekstgeneratie.
  • Het contextvenster ondersteunt tot 100.000 tokens voor prompt plus completion.
  • Verzoeken worden gefactureerd op basis van het aantal input- en outputtokens.
curl https://api.hermesllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Schakel streaming (SSE) in

Voor een betere gebruikerservaring kun je streaming inschakelen om tokens te ontvangen zodra ze gegenereerd zijn. Dit vermindert de waargenomen latentie, vooral bij langere antwoorden. De server retourneert Server-Sent Events (SSE) die je client in realtime kan verwerken.

Stel de parameter stream in op true in je request body. De SDK levert chunks op zodra ze aankomen. Dit is vooral nuttig voor chatinterfaces waar je tekst incrementeel wilt weergeven in plaats van te wachten tot het hele antwoord klaar is.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Gebruik tool/function calling

Onze API ondersteunt function calling, waardoor het model gestructureerde JSON kan uitvoeren voor de uitvoering van externe tools. Definieer je functies in de parameter tools, en het model retourneert tool_calls in het antwoord indien passend.

Deze functie werkt precies zoals gedocumenteerd in de OpenAI-specificatie. Je kunt de functienaam en argumenten parseren, je backend-logica uitvoeren en de resultaten terugvoeren in het gesprek. Het is volledig compatibel met standaard OpenAI SDK tool-calling workflows.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Controleer beschikbare modellen

Stel een verzoek in bij het models-endpoint om de verbinding te controleren en beschikbare opties te bekijken. Op dit moment bieden we één enkel dedicated model aan: uncensored. Deze eenvoud voorkomt de complexiteit van modelrouting of generieke infrastructuur, wat zorgt voor voorspelbaar gedrag.

Je kunt dit endpoint ook gebruiken om authenticatieproblemen te debuggen. Als het verzoek mislukt, controleer dan de geldigheid van je API-sleutel en de netwerkconnectiviteit. Het antwoord geeft de modeldetails weer, inclusief de grootte van het contextvenster en tokenlimieten.

from openai import OpenAI

client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Verwerk rate limits en fouten

Onze API handhaaft een limiet van 300 verzoeken per minuut per sleutel. Als je deze overschrijdt, ontvang je een 429-fout. We ondersteunen ook een limiet van 8 MB voor de request body bij complexe prompts of grote contextvensters.

Veelvoorkomende fouten zijn 401 (ongeldige sleutel) en 402 (onvoldoende tegoed). Prepaid tegoed vervalt nooit, dus je kunt opwaarderen wanneer het jou uitkomt. Korting op tegoed wordt automatisch toegepast bij grotere aankopen: +5% vanaf $50 en +10% vanaf $100.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Model-IDuncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
AuthenticatieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.hermesllmapi.com/v1
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
JSON-modusresponse_format: {"type": "json_object"}
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Contextvenster100.000 tokens (invoer + uitvoer)
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Gelijktijdige verzoekentot 8 tegelijk per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rate limit300 verzoeken per minuut per sleutel
Verzoekgroottetot 8 MB
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Bonus+5% vanaf $50, +10% vanaf $100
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
InloggenGoogle of e-mail en wachtwoord
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw
01

Vragen en antwoorden

Ondersteunt de Hermes API afbeeldings- of audiogeneratie?

Nee, we bieden momenteel alleen een chat-completies API voor tekst. We ondersteunen geen embeddings, afbeeldings-, audio- of videogeneratie, noch fine-tuning. We richten ons op het leveren van een eenvoudig, ongecensureerd tekstmodel voor standaard OpenAI-compatibele clients.

Hoe gaat het ongecensureerde model om met volwassen inhoud?

Het model weigert wettelijke volwassen, fictieve of controversiële onderwerpen niet. Er is echter een harde inhoudsgrens: verzoeken met seksuele inhoud met minderjarigen worden altijd geblokkeerd. Dit is de enige strikte beperking die op je prompts wordt toegepast.

Wat gebeurt er als ik mijn tegoed op heb?

Je API-sleutel blijft actief, maar verzoeken retourneren een 402-fout die onvoldoende saldo aangeeft. Je kunt je account op elk moment opwaarderen met crypto (USDT of USDC). Je prepaid tegoed vervalt nooit, dus je kunt geld toevoegen wanneer je klaar bent om door te gaan.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.

API-sleutel ophalenLees de docs