DE ▾
API-Schlüssel erhalten

Hermes API: Wechsle deinen Client in drei Zeilen

Starte in Minuten mit der Hermes API über Standard-OpenAI-SDKs. Dieser Schnellstart behandelt Konfiguration, Basisanfragen, Streaming und Fehlerbehandlung für deine unzensierte LLM-Integration.

pro 1M Input-Token
$0.25
Output-Token / 1M
$1.00
Kontextfenster
100,000
kostenloses Testguthaben
$0.50
Anfragen pro Minute
300

Installiere das OpenAI SDK

Da unser Endpunkt OpenAI-kompatibel ist, kannst du die offiziellen SDKs verwenden, die du bereits kennst. Dieser Ansatz ermöglicht es dir, den Anbieter zu wechseln, ohne deine Anwendungslogik neu schreiben zu müssen. Wir unterstützen das Standardpaket openai für Python- und Node.js-Umgebungen.

Stelle sicher, dass du eine aktuelle Version des SDK verwendest, um die Kompatibilität mit Streaming- und Function-Calling-Funktionen zu gewährleisten. Die Client-Bibliothek übernimmt die JSON-Serialisierung und den HTTP-Transport automatisch, sodass du dich auf die Modellparameter konzentrieren kannst, anstatt auf Netzwerkdetails.

Konfiguriere Base URL & Schlüssel

Die Authentifizierung erfolgt über einen Bearer-Token im Authorization-Header. Du erhältst deinen Schlüssel, indem du dich mit E-Mail und Passwort in unserem Dashboard anmeldest. Für die Testphase ist keine Kreditkarte erforderlich, und du kannst deinen Schlüssel jederzeit neu generieren, um den Zugriff zu widerrufen.

Setze die Base URL auf unseren dedizierten Endpunkt. Dies stellt sicher, dass alle Anfragen an unsere Infrastruktur für das unzensierte Modell gesendet werden, anstatt an die Standard-OpenAI-Cloud. Du findest deinen API-Schlüssel auf der Seite „API-Schlüssel erhalten“ direkt nach der Anmeldung.

Sende deine erste Anfrage

Sende eine Standard-Chat-Vervollständigungsanfrage, um die Konnektivität zu testen. Die Modell-ID ist immer uncensored. Dieses Modell ist darauf ausgelegt, ohne Inhaltsablehnungen für legale erwachsene Nutzung zu antworten, was es ideal für kreatives Schreiben, Roleplay oder uneingeschränkte Forschung macht.

  • Verwende POST /v1/chat/completions für die Textgenerierung.
  • Das Kontextfenster unterstützt bis zu 100.000 Token für Prompt plus Vervollständigung.
  • Anfragen werden basierend auf der Anzahl der Input- und Output-Token berechnet.
curl https://api.hermesllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Aktiviere Streaming (SSE)

Für ein besseres Benutzererlebnis aktiviere Streaming, um Token zu erhalten, sobald sie generiert werden. Dies reduziert die wahrgenommene Latenz, insbesondere bei längeren Antworten. Der Server sendet Server-Sent Events (SSE), die dein Client in Echtzeit parsen kann.

Setze den Parameter stream in deinem Anfragekörper auf true. Das SDK liefert Chunks, sobald sie eintreffen. Dies ist besonders nützlich für Chat-Schnittstellen, bei denen du Text inkrementell anzeigen möchtest, anstatt auf das Ende der gesamten Antwort zu warten.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Nutze Tool/Function Calling

Unsere API unterstützt Function Calling, wodurch das Modell strukturiertes JSON für die Ausführung externer Tools ausgeben kann. Definiere deine Funktionen im Parameter tools, und das Modell gibt bei Bedarf tool_calls in der Antwort zurück.

Diese Funktion funktioniert genau wie in der OpenAI-Spezifikation dokumentiert. Du kannst den Funktionsnamen und die Argumente parsen, deine Backend-Logik ausführen und die Ergebnisse zurück in die Konversation einspeisen. Sie ist vollständig kompatibel mit Standard-OpenAI-SDK-Workflows für Function Calling.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Prüfe verfügbare Modelle

Frag den Endpunkt /models ab, um die Konnektivität zu überprüfen und verfügbare Optionen zu sehen. Derzeit bieten wir ein einzelnes dediziertes Modell an: uncensored. Diese Einfachheit vermeidet die Komplexität des Model-Routings oder generischer Infrastruktur und gewährleistet vorhersehbares Verhalten.

Du kannst diesen Endpunkt auch zur Debugging von Authentifizierungsproblemen verwenden. Wenn die Anfrage fehlschlägt, überprüfe die Gültigkeit deines API-Schlüssels und die Netzwerkverbindung. Die Antwort listet die Modell-Details auf, einschließlich der Größe des Kontextfensters und der Token-Limits.

from openai import OpenAI

client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Behandle Ratenlimits & Fehler

Unsere API begrenzt die Anzahl auf 300 Anfragen pro Minute und Schlüssel. Wenn du dieses Limit überschreitest, erhältst du einen 429-Fehler. Wir unterstützen zudem eine Anfragekörper-Grenze von 8 MB für komplexe Prompts oder große Kontextfenster.

Häufige Fehler sind 401 (ungültiger Schlüssel) und 402 (unzureichendes Guthaben). Prepaid-Guthaben verfällt nie, sodass du jederzeit aufladen kannst. Guthaben-Boni werden automatisch für größere Käufe angewendet: +5 % ab 50 $ und +10 % ab 100 $.

Technische Daten

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Modell-IDuncensored
EndpunktePOST /v1/chat/completions · GET /v1/models
AuthentifizierungAuthorization: Bearer YOUR_KEY
Base-URLhttps://api.hermesllmapi.com/v1
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
JSON-Modusresponse_format: {"type": "json_object"}
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Ratenlimit300 Anfragen pro Minute und Schlüssel
Anfragegrößebis 8 MB
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Bonus+5 % ab $50, +10 % ab $100
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
AnmeldungGoogle oder E-Mail und Passwort
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen
01

Fragen und Antworten

Unterstützt die Hermes API die Bild- oder Audioerstellung?

Nein, wir bieten derzeit eine Nur-Text-Chat-Vervollständigungs-API an. Wir unterstützen keine Embeddings, Bild-, Audio- oder Videoerstellung und bieten auch kein Fine-Tuning. Unser Fokus liegt auf der Bereitstellung eines geradlinigen, unzensierten Textmodells für Standard-OpenAI-kompatible Clients.

Wie geht das unzensierte Modell mit erwachsenen Inhalten um?

Das Modell lehnt legale erwachsene, fiktive oder kontroverse Themen nicht ab. Es gibt jedoch eine harte Inhaltsgrenze: Anfragen mit sexuellen Inhalten mit Minderjährigen werden immer blockiert. Dies ist die einzige strenge Einschränkung, die auf deine Prompts angewendet wird.

Was passiert, wenn mein Guthaben aufgebraucht ist?

Dein API-Schlüssel bleibt aktiv, aber Anfragen geben einen 402-Fehler zurück, der unzureichende Mittel anzeigt. Du kannst dein Konto jederzeit mit Krypto (USDT oder USDC) aufladen. Dein Prepaid-Guthaben verfällt nie, sodass du Geld hinzufügen kannst, wann immer du fortfahren möchtest.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhaltenDokumentation lesen