Drop-In-Kompatibilität
Verwende das offizielle OpenAI SDK, indem du einfach die base_url und den API-Schlüssel änderst. Unterstützt Streaming über SSE und Tool/Function Calling out of the box.
Unzensierte Open-Weight-Modell-API
Ein dedizierter, unzensierter LLM-Endpunkt, kompatibel mit Standard-OpenAI-SDKs. Keine Inhaltsfilter für die legale Nutzung durch Erwachsene, keine Komplexität beim Model-Routing, einfach Text rein und Text raus.
Probiere es mit einer einzigen Anfrage aus
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Verwende das offizielle OpenAI SDK, indem du einfach die base_url und den API-Schlüssel änderst. Unterstützt Streaming über SSE und Tool/Function Calling out of the box.
Wir bieten ein Open-Weight-Modell an, das darauf abgestimmt ist, ohne Verweigerung auf legale erwachsene, fiktive oder kontroverse Themen zu antworten. Es ist kein GPT, Claude oder DeepSeek.
Pay as you go Prepaid-Guthaben ohne monatliche Gebühren. Token werden mit $0,25/1M Input und $1,00/1M Output berechnet. Das Guthaben verfällt nie.
Verarbeite bis zu 100.000 Token pro Anfrage (Prompt + Vervollständigung). Ideal für lange Dokumente, Codebasen oder längere Gespräche ohne Kürzung.
Minimale Anmeldung nur mit E-Mail und Passwort. Deine Prompts werden nicht verwendet, um deine Modelldaten zu trainieren.
300 Anfragen pro Minute pro Schlüssel mit einer Anfragekörpergrenze von 8 MB. Ein Schlüssel pro Konto, sofort widerrufbar.
Melde dich mit E-Mail und Passwort an, um deinen API-Schlüssel sofort zu erhalten; keine Kreditkarte für die Testphase erforderlich.
Richte deinen OpenAI-kompatiblen Client auf https://api.hermesllmapi.com/v1 ein und setze das Modell auf 'uncensored'.
Sende Standard-Chat-Vervollständigungsanfragen und erhalte unzensierte Textantworten mit voller Streaming-Unterstützung.
Generiere unzensierte Erzählungen, Charakterdialoge und Geschichten für Erwachsene ohne Verweigerung des Modells aufgrund von Inhaltsfiltern. Ideal für Romanautoren, die Grenzen austesten.
Analysiere große Codebasen oder Dokumente auf Schwachstellen, ohne dass die API technische oder kontroverse Ergebnisse blockiert. Erhalte rohe, ungefilterte Modellausgaben.
Verarbeite lange Dokumente mit bis zu 100k Token, um strukturierte Daten zu extrahieren. Das Open-Weight-Modell verarbeitet komplexe Anweisungen ohne vorzeitige Verweigerungen.
Generiere große Mengen synthetischer Daten zum Trainieren deiner eigenen Modelle. Nutze die API, um vielfältige, unzensierte Beispiele für spezifische Domänen zu erstellen.
Viele Entwickler brauchen eine unzensierte DeepSeek-Alternative oder ein Open-Source-Modell, das legale Inhalte für Erwachsene nicht filtert. Während große Anbieter wie OpenAI oder Anthropic strenge Sicherheitsfilter anwenden, bedient die Hermes API ein einzelnes Open-Weight-Modell, das darauf optimiert ist, Fragen direkt zu beantworten. Dieser Ansatz vermeidet die Komplexität des Model-Routings oder generischer Infrastruktur. Du erhältst eine vorhersehbare, unkomplizierte API-Erfahrung. Das Modell ist kein GPT, Claude, Gemini, Grok oder DeepSeek; es ist ein eigenständiges Open-Weight-Modell, das auf unseren Servern läuft. Das gewährleistet ein konsistentes Verhalten ohne unerwartete Policy-Updates großer Tech-Unternehmen. Du zahlst für Token, nicht für ein Abonnement eines größeren Ökosystems. Die Preise sind einfach: $0,25 pro Million Input-Token und $1,00 pro Million Output-Token. Prepaid-Guthaben verfällt nie, sodass du die Nutzung pausieren kannst, ohne Geld zu verlieren. Das macht es ideal für Projekte, bei denen Kostenkalkulierbarkeit und Inhaltsfreiheit wichtiger sind als Markenbekanntheit.
Der Kernwert der Hermes API ist das Fehlen von Inhaltsablehnungen für die legale Nutzung durch Erwachsene. Das Modell antwortet direkt auf kontroverse, sexuelle oder fiktive Themen. Es nervt dich nicht mit Sicherheitsrichtlinien. Die einzige harte Grenze ist, dass sexuelle Inhalte mit Minderjährigen immer blockiert werden. Dies ist ein Open-Weight-Modell, was bedeutet, dass die Gewichte öffentlich verfügbar sind, aber wir die Inferenzschicht für deinen Komfort hosten. Du musst keine GPUs verwalten oder vLLM einrichten. Der Endpunkt unterstützt Streaming-Antworten über Server-Sent Events (SSE) und standardmäßiges Tool-/Function Calling. Dies ermöglicht die Integration in bestehende Anwendungen, die OpenAI-ähnliches Verhalten erwarten. Das Modell ist kein Fine-Tuning von GPT-4 oder Llama 3; es ist eine eigenständige Architektur, die auf Reaktionsfähigkeit optimiert ist. Du kannst die Modellkarte einsehen, wenn du die Basisgewichte überprüfen möchtest. Der Hauptvorteil ist die Einfachheit: ein Modell, ein Endpunkt, ein Preis.
Die Hermes API ist als sofort einsetzbare Alternative zum OpenAI SDK konzipiert. Du kannst die offiziellen Bibliotheken in Python, Node.js oder Go verwenden. Ändere einfach die base_url in https://api.hermesllmapi.com/v1 und gib deinen API-Schlüssel an. Die zu verwendende Modell-ID ist uncensored. Diese Kompatibilität erstreckt sich auf Streaming und Function Calling. Wenn du eine Bibliothek wie LangChain oder LlamaIndex verwendest, kannst du den Anbieter wahrscheinlich mit minimalen Codeänderungen austauschen. Dies ist besonders nützlich, wenn du bereits mit OpenAI arbeitest, aber das unzensierte Verhalten testen möchtest, ohne deine Datenpipeline neu schreiben zu müssen. Die API unterstützt POST /v1/chat/completions und GET /v1/models. Sie unterstützt keine Embeddings, Bildgenerierung oder Audio. Wenn deine Anwendung auf diesen Funktionen basiert, ist diese API kein vollständiger Ersatz. Für Textgenerierung und Tool-Nutzung ist die Kompatibilität jedoch nahezu perfekt. Du kannst leicht hin- und herwechseln, um Ausgaben zu vergleichen.
Wir glauben an transparente, einfache Preisgestaltung. Es gibt keine monatlichen Abonnements oder versteckten Gebühren. Du lädst Guthaben vor, und Token werden bei der Nutzung abgezogen. Der Satz beträgt $0,25 pro Million Input-Token und $1,00 pro Million Output-Token. Dies ist wettbewerbsfähig für einen unzensierten, gehosteten Dienst. Du kannst ab $10 mit Krypto (USDT oder USDC) aufladen. Wenn du $50 auflädst, erhältst du ein 5% Bonusguthaben. Das Aufladen von $100 gibt dir einen 10% Bonus. Dein Guthaben verfällt nie, sodass du es in deinem eigenen Tempo nutzen kannst. Neue Konten erhalten $0,50 an Testguthaben, das 7 Tage gültig ist, keine Kreditkarte erforderlich. Dies ermöglicht es dir, die API gründlich zu testen, bevor du Geld investierst. Das Prepaid-Modell stellt sicher, dass du keine unerwartete Rechnung erhältst. Wenn dein Guthaben aufgebraucht ist, stoppen die Anfragen, bis du auflädst. Dies ist ideal für Entwickler, die ihre Ausgaben genau steuern möchten.
Die API unterstützt ein Kontextfenster von 100.000 Token, einschließlich sowohl des Prompts als auch der Completion. Dies ermöglicht die Verarbeitung langer Dokumente, umfangreicher Codebasen oder langer Konversationen in einer einzigen Anfrage. Die Größe des Request-Body ist auf 8 MB begrenzt, was die meisten großen Inputs abdeckt. Du bist auf 300 Anfragen pro Minute pro API-Schlüssel begrenzt. Dies reicht für die meisten Entwicklungs- und moderate Produktionsworkloads aus. Jedes Konto hat einen API-Schlüssel, den du jederzeit neu generieren kannst. Das Generieren des Schlüssels macht den alten sofort ungültig, stelle also sicher, dass dein Client aktualisiert ist. Das System bietet kein Fine-Tuning oder Embeddings an. Wenn du diese benötigst, musst du einen anderen Dienst verwenden. Die Limits sind so ausgelegt, dass Missbrauch verhindert wird, während die Kosten für legitime Nutzer niedrig bleiben. Du kannst deine Nutzung über das Dashboard überwachen, obwohl detaillierte Logs derzeit nicht bereitgestellt werden. Für die meisten textbasierten Aufgaben reicht das 100k-Kontextfenster mehr als aus, um komplexe Anweisungen zu verarbeiten.
Deine Privatsphäre hat Priorität. Wir benötigen nur eine E-Mail und ein Passwort, um ein Konto zu erstellen. Keine Telefonnummer oder Kreditkarte wird für die Testphase benötigt. Deine Prompts werden nicht verwendet, um das Modell zu trainieren. Dies ist ein wesentlicher Unterschied zu einigen kostenlosen Diensten, die deine Daten zur Verbesserung verwenden. Wir geben deine Daten nicht an Dritte weiter. Das Modell läuft auf unseren eigenen GPU-Servern, und wir verwalten die Infrastruktur durchgängig. Das bedeutet, du musst dir keine Gedanken über Data Egress oder Speicherung machen. Die API ist für Entwickler konzipiert, die eine saubere, private Schnittstelle wünschen. Wir bieten keine SLAs oder Zertifizierungen wie SOC2 an, daher ist dies möglicherweise nicht die richtige Wahl, wenn du Unternehmensgarantien benötigst. Der Dienst ist unabhängig und nicht mit einem großen Tech-Anbieter verbunden. Deine Daten gehören dir, und wir respektieren das. Du kannst dein Konto jederzeit löschen, um deine Daten zu entfernen.
Nein, dies ist ein unabhängiger Dienst. Wir hosten ein Open-Weight-Modell und bieten einen OpenAI-kompatiblen Endpunkt. Wir sind nicht die ursprünglichen Ersteller der Modellgewichte und auch nicht mit einem großen Anbieter wie OpenAI oder Together AI verbunden. Wir stellen lediglich die Infrastruktur bereit, um darauf zuzugreifen.
Das bedeutet, dass das Modell keine gesetzeskonformen, erwachsenen, fiktiven oder kontroversen Themen aufgrund von Sicherheitsfiltern verweigert. Es generiert sexuelle Inhalte, Schimpfwörter oder politische Meinungen, wenn danach gefragt wird. Die einzige harte Grenze ist, dass sexuelle Inhalte, die Minderjährige betreffen, immer blockiert werden. Dies macht es ideal für kreatives Schreiben und Roleplay.
Ja. Du kannst das offizielle OpenAI SDK verwenden, indem du die <code>base_url</code> auf <code>https://api.hermesllmapi.com/v1</code> und das Modell auf <code>uncensored</code> setzt. Die API unterstützt Standard-Chat-Vervollständigungen, Streaming und Function Calling. Sie ist als sofort einsetzbare Alternative zu OpenAI-Endpunkten konzipiert.
Nein, dein Prepaid-Guthaben verfällt nie. Du kannst es jederzeit aufladen und die Mittel nutzen, wann immer du möchtest. Es gibt keine monatlichen Gebühren oder Abonnementverlängerungen. Dies macht es kostengünstig für Langzeitprojekte, bei denen die Nutzung intermittierend ist.
Das Kontextfenster umfasst 100.000 Token, was sowohl den Eingabe-Prompt als auch die Ausgabe-Vervollständigung einschließt. Dies ermöglicht es dir, große Dokumente oder lange Gespräche in einer einzigen Anfrage zu verarbeiten. Die maximale Größe des Anfragekörpers beträgt 8 MB.
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.