IT ▾
Ottieni la chiave API

API modello open-weight senza censura

Connetti API LLM senza censura

Un endpoint LLM dedicato e senza censura compatibile con gli SDK OpenAI standard. Nessun filtro sui contenuti per uso adulto legale, nessuna complessità di routing del modello, solo testo in ingresso e testo in uscita.

  • Endpoint chat compatibile con OpenAI
  • Contenuti legali per adulti senza censura
  • Credito prepagato che non scade mai

Ottieni chiave APILeggi la documentazione

Provalo con una sola richiesta

curl https://api.hermesllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'
per 1M token di input
$0.25
Token di output / 1M
$1.00
contesto di token
100,000
credito di prova
$0.50
richieste al minuto
300
01

Cosa ottieni

Compatibilità Drop-In

Usa l'SDK ufficiale di OpenAI semplicemente cambiando la base_url e la chiave API. Supporta lo streaming via SSE e la chiamata di strumenti/funzioni out of the box.

Modello Unico Senza Censura

Serviamo un unico modello open-weight ottimizzato per rispondere senza rifiuti per argomenti legali per adulti, di fantasia o controversi. Non è GPT, Claude o DeepSeek.

Prezzi Trasparenti

Credito prepagato a consumo senza canoni mensili. I token sono fatturati a $0,25/1M input e $1,00/1M output. Il credito non scade mai.

Ampia Finestra di Contesto

Elabora fino a 100.000 token per richiesta (prompt + completamento). Ideale per documenti lunghi, codebase o conversazioni estese senza troncamento.

Privacy Prima di Tutto

Registrazione minima con solo email e password. I tuoi prompt non vengono utilizzati per addestrare i dati del modello.

Limiti Semplici

300 richieste al minuto per chiave con un limite del corpo della richiesta di 8 MB. Una chiave per account, revocabile istantaneamente.

02

Come funziona

  1. Ottieni la tua Chiave

    Registrati con email e password per ricevere immediatamente la tua chiave API; nessuna carta di credito richiesta per la prova.

  2. Aggiorna Base URL

    Indirizza il tuo client compatibile con OpenAI a https://api.hermesllmapi.com/v1 e imposta il modello su 'uncensored'.

  3. Inizia a Inviare Richieste

    Invia richieste standard di completamento chat e ricevi risposte di testo senza censura con pieno supporto allo streaming.

03

Cosa costruiscono gli altri

Roleplay e Scrittura Creativa

Genera narrazioni senza censura, dialoghi tra personaggi e storie a tema adulto senza che il modello rifiuti in base ai filtri di contenuto. Ideale per autori di narrativa che testano i limiti.

Ricerca sulla sicurezza

Analizza codebase o documenti grandi per vulnerabilità senza che l'API blocchi risultati tecnici o controversi. Ottieni output grezzi e senza filtri del modello.

Estrazione Dati

Elabora documenti lunghi fino a 100k token per estrarre dati strutturati. Il modello open-weight gestisce istruzioni complesse senza rifiuti prematuri.

Dati di Fine-Tuning Personalizzati

Genera grandi volumi di dati sintetici per addestrare i tuoi modelli. Usa l'API per creare esempi diversificati e senza censura per domini specifici.

Perché l'API Hermes?

Molti sviluppatori hanno bisogno di un'alternativa uncensored deepseek o di un modello open-source che non filtri i contenuti legali per adulti. Mentre i grandi vendor come OpenAI o Anthropic applicano rigorosi livelli di sicurezza, l'API Hermes serve un singolo modello open-weight ottimizzato per rispondere alle domande direttamente. Questo approccio evita la complessità del routing del modello o delle infrastrutture generiche. Ottieni un'esperienza API prevedibile e diretta. Il modello non è GPT, Claude, Gemini, Grok o DeepSeek; è un modello open-weight distinto che gira sui nostri server. Questo garantisce un comportamento coerente senza aggiornamenti imprevisti delle policy da grandi aziende tech. Paghi per i token, non per un abbonamento a un ecosistema più ampio. I prezzi sono semplici: $0,25 per milione di token di input e $1,00 per milione di token di output. Il credito prepagato non scade mai, quindi puoi mettere in pausa l'utilizzo senza perdere fondi. Questo lo rende ideale per progetti in cui la prevedibilità dei costi e la libertà dei contenuti sono più importanti del riconoscimento del marchio.

Funzionalità Chiave: Senza Censura e Open Source

Il valore principale di Hermes API è l'assenza di rifiuto dei contenuti per l'uso adulto legittimo. Il modello risponde in modo diretto a temi controversi, sessuali o di finzione. Non continua a ricordarti le policy di sicurezza. L'unico limite rigido è che i contenuti sessuali che coinvolgono minori sono sempre bloccati. Si tratta di un modello a pesi aperti, il che significa che i pesi sono pubblici, ma noi ospitiamo il layer di inferenza per la tua comodità. Non devi gestire GPU o configurare vLLM. L'endpoint supporta risposte in streaming tramite Server-Sent Events (SSE) e la chiamata di funzioni standard. Questo ti permette di integrarlo nelle applicazioni esistenti che si aspettano un comportamento in stile OpenAI. Il modello non è un fine-tune di GPT-4 o Llama 3; è un'architettura distinta ottimizzata per la reattività. Puoi ispezionare la scheda del modello se vuoi verificare i suoi pesi base. Il vantaggio principale è la semplicità: un modello, un endpoint, un prezzo.

Compatibilità SDK OpenAI

L'API Hermes è pensata per essere un sostituto pronto all’uso per l'SDK OpenAI. Puoi usare le librerie ufficiali in Python, Node.js o Go. Basta cambiare la base_url in https://api.hermesllmapi.com/v1 e fornire la tua chiave API. L'ID del modello da usare è uncensored. Questa compatibilità si estende allo streaming e alla chiamata di funzioni. Se usi librerie come LangChain o LlamaIndex, puoi probabilmente sostituire il provider con modifiche minime al codice. Questo è particolarmente utile se stai già costruendo con OpenAI ma vuoi testare il comportamento senza censura senza riscrivere la tua pipeline di dati. L'API supporta POST /v1/chat/completions e GET /v1/models. Non supporta embeddings, generazione di immagini o audio. Se la tua applicazione dipende da quelle funzionalità, questa API non è un sostituto completo. Tuttavia, per la generazione di testo e l'uso di strumenti, la compatibilità è quasi perfetta. Puoi passare avanti e indietro facilmente per confrontare gli output.

Prezzi: Pay-As-You-Go

Crediamo nella trasparenza e nella semplicità dei prezzi. Non ci sono abbonamenti mensili o costi nascosti. Pre-carichi il credito e i token vengono detratti man mano che li utilizzi. Il tasso è di $0,25 per milione di token di input e $1,00 per milione di token di output. Questo è competitivo per un servizio ospitato senza censura. Puoi ricaricare a partire da $10 utilizzando criptovalute (USDT o USDC). Se pre-carichi $50, ricevi un credito bonus del 5%. Pre-caricando $100 ottieni un bonus del 10%. Il tuo credito non scade mai, quindi puoi utilizzarlo al tuo ritmo. I nuovi account ricevono $0,50 di credito di prova valido per 7 giorni, senza bisogno di carta di credito. Questo ti permette di testare l'API a fondo prima di impegnare fondi. Il modello prepagato garantisce che tu non riceva mai bollette inaspettate. Se finisci il credito, le richieste si fermano fino alla ricarica. Questo è ideale per gli sviluppatori che vogliono controllare esattamente le loro spese.

Finestra di Contesto e Limiti

L'API supporta una finestra di contesto di 100.000 token, inclusi sia il prompt che il completamento. Questo ti permette di elaborare documenti lunghi, codebase estese o conversazioni lunghe in una singola richiesta. La dimensione del corpo della richiesta è limitata a 8 MB, il che consente di gestire la maggior parte degli input di grandi dimensioni. Sei limitato a 300 richieste al minuto per chiave API. Questo è sufficiente per la maggior parte dei lavori di sviluppo e carichi di lavoro di produzione moderati. Ogni account ha una sola chiave API, che puoi rigenerare in qualsiasi momento. Rigenerando la chiave, quella vecchia diventa immediatamente invalida, quindi assicurati di aggiornare il tuo client. Il sistema non offre fine-tuning né embeddings. Se ne hai bisogno, devi utilizzare un servizio diverso. I limiti sono progettati per prevenire gli abusi mantenendo i costi bassi per gli utenti legittimi. Puoi monitorare il tuo utilizzo tramite la dashboard, anche se i log dettagliati non sono attualmente forniti. Per la maggior parte dei compiti basati sul testo, la finestra di contesto da 100k è più che sufficiente per gestire istruzioni complesse.

Privacy e Utilizzo dei Dati

La tua privacy è una priorità. Richiediamo solo un'email e una password per creare un account. Non è necessario un numero di telefono o una carta di credito per la prova. I tuoi prompt non vengono utilizzati per addestrare il modello. Questa è una differenza chiave rispetto ad alcuni servizi di livello gratuito che usano i tuoi dati per il miglioramento. Non condividiamo i tuoi dati con terze parti. Il modello gira sui nostri server GPU, e gestiamo l'infrastruttura end-to-end. Questo significa che non devi preoccuparti di egress o archiviazione dei dati. L'API è pensata per gli sviluppatori che vogliono un'interfaccia pulita e privata. Non offriamo SLA o certificazioni come SOC2, quindi se hai bisogno di garanzie di livello enterprise, questo potrebbe non essere la scelta giusta. Il servizio è indipendente e non affiliato a nessun grande vendor tech. I tuoi dati sono tuoi e lo rispettiamo. Puoi eliminare il tuo account in qualsiasi momento per rimuovere i tuoi dati.

04

Domande e risposte

È questa l'API ufficiale del modello Hermes?

No, questo è un servizio indipendente. Ospitiamo un modello a pesi aperti e forniamo un endpoint compatibile con OpenAI. Non siamo i creatori originali dei pesi del modello e non siamo affiliati a grandi fornitori come OpenAI o Together AI. Forniamo semplicemente l'infrastruttura per accedervi.

Cosa significa esattamente "senza censura"?

Significa che il modello non rifiuta di rispondere a domande legittime su argomenti adulti, fiction o controversi basandosi sui filtri di sicurezza. Genererà contenuti sessuali, parolacce o opinioni politiche se richiesto. L'unico limite rigido è che i contenuti sessuali che coinvolgono minori sono sempre bloccati. Questo lo rende ideale per la scrittura creativa e il roleplay.

Posso usarlo con l'SDK Python di OpenAI?

Sì. Puoi utilizzare l'SDK ufficiale di OpenAI impostando <code>base_url</code> su <code>https://api.hermesllmapi.com/v1</code> e il modello su <code>uncensored</code>. L'API supporta le chat completions standard, lo streaming e la chiamata di funzioni. È pensata per essere un'alternativa pronto all’uso agli endpoint di OpenAI.

Il credito prepagato scade?

No, il tuo credito prepagato non scade mai. Puoi ricaricarlo in qualsiasi momento e utilizzare i fondi quando vuoi. Non ci sono canoni mensili o rinnovi di abbonamento. Questo lo rende conveniente per progetti a lungo termine con un utilizzo intermittente.

Qual è la dimensione della finestra di contesto?

La finestra di contesto è di 100.000 token, che includono sia il prompt di input che il completamento di output. Questo ti permette di elaborare documenti di grandi dimensioni o conversazioni lunghe in una singola richiesta. La dimensione massima del corpo della richiesta è di 8 MB.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.

Ottieni la chiave APILeggi la documentazione