Hermes API: переключите клиентскую библиотеку за три строки
Начните работу с hermes API за несколько минут, используя стандартные SDK OpenAI. Это краткое руководство охватывает конфигурацию, базовые запросы, потоковую передачу и обработку ошибок для вашей интеграции LLM без цензуры.
- за 1 млн входных токенов
- $0.25
- Выходные токены / 1 млн
- $1.00
- контекстное окно
- 100,000
- пробный баланс
- $0.50
- запросов в минуту
- 300
Установите SDK OpenAI
Поскольку наш эндпоинт совместим с OpenAI, вы можете использовать знакомые вам официальные SDK. Этот подход позволяет переключиться с других поставщиков без переписывания логики приложения. Мы поддерживаем стандартный пакет openai для сред Python и Node.js.
Убедитесь, что вы используете последнюю версию SDK для обеспечения совместимости с функциями потоковой передачи и вызова функций. Библиотека клиента автоматически обрабатывает сериализацию JSON и HTTP-транспорт, поэтому вы можете сосредоточиться на параметрах модели, а не на деталях сети.
Настройте базовый URL и ключ
Аутентификация осуществляется с помощью токена Bearer в заголовке Authorization. Вы получаете ключ, зарегистрировавшись по электронной почте и паролю на нашей панели управления. Для пробного периода не требуется банковская карта, и вы можете сгенерировать новый ключ в любое время, чтобы отозвать доступ.
Установите базовый URL на наш выделенный эндпоинт. Это гарантирует, что все запросы будут отправляться в инфраструктуру нашей модели без цензуры, а не в стандартное облако OpenAI. Вы можете найти свой API-ключ на странице «Получить API-ключ» сразу после регистрации.
Отправьте первый запрос
Отправьте стандартный запрос на завершение чата, чтобы проверить подключение. Идентификатор модели всегда uncensored. Эта модель настроена на ответы без отказов в контенте для законного использования взрослыми, что делает ее идеальной для творческого письма, ролевых игр или неограниченных исследований.
- Используйте
POST /v1/chat/completionsдля генерации текста. - Контекстное окно поддерживает до 100 000 токенов для промпта и завершения.
- Запросы оплачиваются на основе количества входных и выходных токенов.
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Включите потоковую передачу (SSE)
Для улучшения пользовательского опыта включите потоковую передачу, чтобы получать токены по мере их генерации. Это снижает воспринимаемую задержку, особенно для длинных ответов. Сервер возвращает события, отправляемые сервером (SSE), которые ваш клиент может обрабатывать в реальном времени.
Установите параметр stream в значение true в теле запроса. SDK будет выдавать фрагменты по мере их поступления. Это особенно полезно для интерфейсов чата, где вы хотите отображать текст постепенно, а не ждать завершения всего ответа.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Используйте вызов функций
Наш API поддерживает вызов функций, позволяя модели выводить структурированный JSON для выполнения внешних инструментов. Определите свои функции в параметре tools, и модель вернет tool_calls в ответе, если это уместно.
Эта функция работает точно так, как описано в спецификации OpenAI. Вы можете извлечь имя функции и аргументы, выполнить логику на бэкенде и передать результаты обратно в диалог. Она полностью совместима с рабочими процессами вызова инструментов в стандартных SDK OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Проверьте доступные модели
Обратитесь к эндпоинту моделей, чтобы проверить подключение и увидеть доступные варианты. В настоящее время мы предлагаем одну выделенную модель: uncensored. Эта простота избавляет от сложности маршрутизации моделей или поддержки общей инфраструктуры, обеспечивая предсказуемое поведение.
Вы также можете использовать этот эндпоинт для отладки проблем аутентификации. Если запрос не выполнен, проверьте действительность вашего API-ключа и сетевое подключение. В ответе будет перечислена информация о модели, включая размер контекстного окна и ограничения токенов.
from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Обработка лимитов запросов и ошибок
Наш API устанавливает лимит в 300 запросов в минуту на ключ. Если вы превысите этот лимит, вы получите ошибку 429. Мы также поддерживаем лимит тела запроса 8 МБ для сложных промптов или больших контекстных окон.
Распространенные ошибки включают 401 (неверный ключ) и 402 (недостаточно средств). Предоплаченный баланс не сгорает, поэтому вы можете пополнить его в удобное время. Бонусы к балансу применяются автоматически для крупных покупок: +5% от $50 и +10% от $100.
Технические характеристики
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| ID модели | uncensored |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| Авторизация | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.hermesllmapi.com/v1 |
| Максимум ответа | до остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| JSON-режим | response_format: {"type": "json_object"} |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| Контекстное окно | 100 000 токенов (вход и ответ вместе) |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| Параллельные запросы | до 8 одновременно на ключ |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Лимит запросов | 300 запросов в минуту на ключ |
| Размер запроса | до 8 МБ |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Бонус | +5% от $50, +10% от $100 |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
| Вход | Google или e-mail и пароль |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |
Вопросы и ответы
Поддерживает ли hermes API генерацию изображений или аудио?
Нет, в настоящее время мы предлагаем API только для текстовых чатов. Мы не поддерживаем эмбеддинги, генерацию изображений, аудио или видео, а также не предлагаем дообучение. Наш фокус — предоставление простой текстовой модели без цензуры для стандартных клиентов, совместимых с OpenAI.
Как модель без цензуры обрабатывает контент для взрослых?
Модель не отказывает в законных темах для взрослых, художественных или спорных вопросах. Однако существует жесткое ограничение: запросы с сексуальным контентом с участием несовершеннолетних всегда блокируются. Это единственное строгое ограничение, применяемое к вашим промптам.
Что произойдет, если у меня закончится баланс?
Ваш API-ключ остается активным, но запросы будут возвращать ошибку 402, указывающую на недостаток средств. Вы можете пополнить аккаунт криптовалютой (USDT или USDC) в любое время. Ваш предоплаченный баланс не сгорает, поэтому вы можете добавлять средства, когда будете готовы продолжить работу.
Ваш ключ — в одной форме от вас
Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.