Compatibilità Drop-In
Usa l'SDK ufficiale di OpenAI semplicemente cambiando la base_url e la chiave API. Supporta lo streaming via SSE e la chiamata di strumenti/funzioni out of the box.
API modello open-weight senza censura
Un endpoint LLM dedicato e senza censura compatibile con gli SDK OpenAI standard. Nessun filtro sui contenuti per uso adulto legale, nessuna complessità di routing del modello, solo testo in ingresso e testo in uscita.
Provalo con una sola richiesta
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Usa l'SDK ufficiale di OpenAI semplicemente cambiando la base_url e la chiave API. Supporta lo streaming via SSE e la chiamata di strumenti/funzioni out of the box.
Serviamo un unico modello open-weight ottimizzato per rispondere senza rifiuti per argomenti legali per adulti, di fantasia o controversi. Non è GPT, Claude o DeepSeek.
Credito prepagato a consumo senza canoni mensili. I token sono fatturati a $0,25/1M input e $1,00/1M output. Il credito non scade mai.
Elabora fino a 100.000 token per richiesta (prompt + completamento). Ideale per documenti lunghi, codebase o conversazioni estese senza troncamento.
Registrazione minima con solo email e password. I tuoi prompt non vengono utilizzati per addestrare i dati del modello.
300 richieste al minuto per chiave con un limite del corpo della richiesta di 8 MB. Una chiave per account, revocabile istantaneamente.
Registrati con email e password per ricevere immediatamente la tua chiave API; nessuna carta di credito richiesta per la prova.
Indirizza il tuo client compatibile con OpenAI a https://api.hermesllmapi.com/v1 e imposta il modello su 'uncensored'.
Invia richieste standard di completamento chat e ricevi risposte di testo senza censura con pieno supporto allo streaming.
Genera narrazioni senza censura, dialoghi tra personaggi e storie a tema adulto senza che il modello rifiuti in base ai filtri di contenuto. Ideale per autori di narrativa che testano i limiti.
Analizza codebase o documenti grandi per vulnerabilità senza che l'API blocchi risultati tecnici o controversi. Ottieni output grezzi e senza filtri del modello.
Elabora documenti lunghi fino a 100k token per estrarre dati strutturati. Il modello open-weight gestisce istruzioni complesse senza rifiuti prematuri.
Genera grandi volumi di dati sintetici per addestrare i tuoi modelli. Usa l'API per creare esempi diversificati e senza censura per domini specifici.
Molti sviluppatori hanno bisogno di un'alternativa uncensored deepseek o di un modello open-source che non filtri i contenuti legali per adulti. Mentre i grandi vendor come OpenAI o Anthropic applicano rigorosi livelli di sicurezza, l'API Hermes serve un singolo modello open-weight ottimizzato per rispondere alle domande direttamente. Questo approccio evita la complessità del routing del modello o delle infrastrutture generiche. Ottieni un'esperienza API prevedibile e diretta. Il modello non è GPT, Claude, Gemini, Grok o DeepSeek; è un modello open-weight distinto che gira sui nostri server. Questo garantisce un comportamento coerente senza aggiornamenti imprevisti delle policy da grandi aziende tech. Paghi per i token, non per un abbonamento a un ecosistema più ampio. I prezzi sono semplici: $0,25 per milione di token di input e $1,00 per milione di token di output. Il credito prepagato non scade mai, quindi puoi mettere in pausa l'utilizzo senza perdere fondi. Questo lo rende ideale per progetti in cui la prevedibilità dei costi e la libertà dei contenuti sono più importanti del riconoscimento del marchio.
Il valore principale di Hermes API è l'assenza di rifiuto dei contenuti per l'uso adulto legittimo. Il modello risponde in modo diretto a temi controversi, sessuali o di finzione. Non continua a ricordarti le policy di sicurezza. L'unico limite rigido è che i contenuti sessuali che coinvolgono minori sono sempre bloccati. Si tratta di un modello a pesi aperti, il che significa che i pesi sono pubblici, ma noi ospitiamo il layer di inferenza per la tua comodità. Non devi gestire GPU o configurare vLLM. L'endpoint supporta risposte in streaming tramite Server-Sent Events (SSE) e la chiamata di funzioni standard. Questo ti permette di integrarlo nelle applicazioni esistenti che si aspettano un comportamento in stile OpenAI. Il modello non è un fine-tune di GPT-4 o Llama 3; è un'architettura distinta ottimizzata per la reattività. Puoi ispezionare la scheda del modello se vuoi verificare i suoi pesi base. Il vantaggio principale è la semplicità: un modello, un endpoint, un prezzo.
L'API Hermes è pensata per essere un sostituto pronto all’uso per l'SDK OpenAI. Puoi usare le librerie ufficiali in Python, Node.js o Go. Basta cambiare la base_url in https://api.hermesllmapi.com/v1 e fornire la tua chiave API. L'ID del modello da usare è uncensored. Questa compatibilità si estende allo streaming e alla chiamata di funzioni. Se usi librerie come LangChain o LlamaIndex, puoi probabilmente sostituire il provider con modifiche minime al codice. Questo è particolarmente utile se stai già costruendo con OpenAI ma vuoi testare il comportamento senza censura senza riscrivere la tua pipeline di dati. L'API supporta POST /v1/chat/completions e GET /v1/models. Non supporta embeddings, generazione di immagini o audio. Se la tua applicazione dipende da quelle funzionalità, questa API non è un sostituto completo. Tuttavia, per la generazione di testo e l'uso di strumenti, la compatibilità è quasi perfetta. Puoi passare avanti e indietro facilmente per confrontare gli output.
Crediamo nella trasparenza e nella semplicità dei prezzi. Non ci sono abbonamenti mensili o costi nascosti. Pre-carichi il credito e i token vengono detratti man mano che li utilizzi. Il tasso è di $0,25 per milione di token di input e $1,00 per milione di token di output. Questo è competitivo per un servizio ospitato senza censura. Puoi ricaricare a partire da $10 utilizzando criptovalute (USDT o USDC). Se pre-carichi $50, ricevi un credito bonus del 5%. Pre-caricando $100 ottieni un bonus del 10%. Il tuo credito non scade mai, quindi puoi utilizzarlo al tuo ritmo. I nuovi account ricevono $0,50 di credito di prova valido per 7 giorni, senza bisogno di carta di credito. Questo ti permette di testare l'API a fondo prima di impegnare fondi. Il modello prepagato garantisce che tu non riceva mai bollette inaspettate. Se finisci il credito, le richieste si fermano fino alla ricarica. Questo è ideale per gli sviluppatori che vogliono controllare esattamente le loro spese.
L'API supporta una finestra di contesto di 100.000 token, inclusi sia il prompt che il completamento. Questo ti permette di elaborare documenti lunghi, codebase estese o conversazioni lunghe in una singola richiesta. La dimensione del corpo della richiesta è limitata a 8 MB, il che consente di gestire la maggior parte degli input di grandi dimensioni. Sei limitato a 300 richieste al minuto per chiave API. Questo è sufficiente per la maggior parte dei lavori di sviluppo e carichi di lavoro di produzione moderati. Ogni account ha una sola chiave API, che puoi rigenerare in qualsiasi momento. Rigenerando la chiave, quella vecchia diventa immediatamente invalida, quindi assicurati di aggiornare il tuo client. Il sistema non offre fine-tuning né embeddings. Se ne hai bisogno, devi utilizzare un servizio diverso. I limiti sono progettati per prevenire gli abusi mantenendo i costi bassi per gli utenti legittimi. Puoi monitorare il tuo utilizzo tramite la dashboard, anche se i log dettagliati non sono attualmente forniti. Per la maggior parte dei compiti basati sul testo, la finestra di contesto da 100k è più che sufficiente per gestire istruzioni complesse.
La tua privacy è una priorità. Richiediamo solo un'email e una password per creare un account. Non è necessario un numero di telefono o una carta di credito per la prova. I tuoi prompt non vengono utilizzati per addestrare il modello. Questa è una differenza chiave rispetto ad alcuni servizi di livello gratuito che usano i tuoi dati per il miglioramento. Non condividiamo i tuoi dati con terze parti. Il modello gira sui nostri server GPU, e gestiamo l'infrastruttura end-to-end. Questo significa che non devi preoccuparti di egress o archiviazione dei dati. L'API è pensata per gli sviluppatori che vogliono un'interfaccia pulita e privata. Non offriamo SLA o certificazioni come SOC2, quindi se hai bisogno di garanzie di livello enterprise, questo potrebbe non essere la scelta giusta. Il servizio è indipendente e non affiliato a nessun grande vendor tech. I tuoi dati sono tuoi e lo rispettiamo. Puoi eliminare il tuo account in qualsiasi momento per rimuovere i tuoi dati.
No, questo è un servizio indipendente. Ospitiamo un modello a pesi aperti e forniamo un endpoint compatibile con OpenAI. Non siamo i creatori originali dei pesi del modello e non siamo affiliati a grandi fornitori come OpenAI o Together AI. Forniamo semplicemente l'infrastruttura per accedervi.
Significa che il modello non rifiuta di rispondere a domande legittime su argomenti adulti, fiction o controversi basandosi sui filtri di sicurezza. Genererà contenuti sessuali, parolacce o opinioni politiche se richiesto. L'unico limite rigido è che i contenuti sessuali che coinvolgono minori sono sempre bloccati. Questo lo rende ideale per la scrittura creativa e il roleplay.
Sì. Puoi utilizzare l'SDK ufficiale di OpenAI impostando <code>base_url</code> su <code>https://api.hermesllmapi.com/v1</code> e il modello su <code>uncensored</code>. L'API supporta le chat completions standard, lo streaming e la chiamata di funzioni. È pensata per essere un'alternativa pronto all’uso agli endpoint di OpenAI.
No, il tuo credito prepagato non scade mai. Puoi ricaricarlo in qualsiasi momento e utilizzare i fondi quando vuoi. Non ci sono canoni mensili o rinnovi di abbonamento. Questo lo rende conveniente per progetti a lungo termine con un utilizzo intermittente.
La finestra di contesto è di 100.000 token, che includono sia il prompt di input che il completamento di output. Questo ti permette di elaborare documenti di grandi dimensioni o conversazioni lunghe in una singola richiesta. La dimensione massima del corpo della richiesta è di 8 MB.
Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.