Hermes API:三行程式碼即可切換您的客戶端
使用標準 OpenAI SDK 在幾分鐘內開始使用 hermes API。此快速入門指南涵蓋配置、基本請求、串流輸出及您的無審查 LLM 整合的錯誤處理。
- 每 1M 輸入 token
- $0.25
- 輸出 token / 1M
- $1.00
- token 上下文
- 100,000
- 試用額度
- $0.50
- 每分鐘請求數
- 300
安裝 OpenAI SDK
由於我們的端點與 OpenAI 相容,你可以使用你已經熟悉的官方 SDK。這種方法讓你能夠從其他供應商切換,而無需重寫應用程式邏輯。我們支援 Python 和 Node.js 環境中的標準 openai 套件。
請確保您使用的是最新版本的 SDK,以保證與串流輸出和函式呼叫功能的相容性。客戶端程式庫會自動處理 JSON 序列化和 HTTP 傳輸,因此您可以專注於模型參數,而非網路細節。
配置基礎 URL 與金鑰
驗證透過 Authorization 標頭中的 Bearer token 處理。你可以在儀表板上透過電子郵件和密碼註冊來取得金鑰。試用不需要信用卡,你可以隨時重新產生金鑰以撤銷存取權。
將基礎 URL 設定為我們的專屬端點。這可確保所有請求都發送至我們的無審查模型基礎設施,而非預設的 OpenAI 雲端。您可以在註冊後立即在「取得 API 金鑰」頁面找到您的 API 金鑰。
發送您的第一個請求
傳送標準聊天完成請求以測試連線。模型 ID 始終為 uncensored。此模型經過調整,可無審查地回答,適用於合法成人用途,非常適合創意寫作、角色扮演或無限制的研究。
- 使用
POST /v1/chat/completions進行文字生成。 - 上下文視窗支援最多 100,000 個 token,包含提示詞與補全。
- 請求根據輸入和輸出 token 計數收費。
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
啟用串流輸出 (SSE)
為了更好的使用者體驗,請啟用串流輸出以接收生成的 token。這可降低感知延遲,特別是對於較長的回應。伺服器會返回伺服器發送的事件 (SSE),您的客戶端可以即時解析。
在請求主體中將 stream 參數設為 true。SDK 會在資料到達時產生區塊。這對於聊天介面特別有用,你可以增量顯示文字,而不必等待整個回應完成。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
使用工具/函式呼叫
我們的 API 支援函式呼叫,允許模型輸出結構化 JSON 以執行外部工具。在 tools 參數中定義你的函式,如果合適,模型會在回應中回傳 tool_calls。
此功能完全按照 OpenAI 規格文件中所述運作。您可以解析函式名稱和參數,執行後端邏輯,並將結果回饋到對話中。它完全相容標準 OpenAI SDK 的工具呼叫工作流程。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
檢查可用模型
查詢模型端點以驗證連線並查看可用選項。目前我們提供單一專屬模型:uncensored。這種簡化避免了模型路由或通用基礎設施的複雜性,確保行為可預測。
您也可以使用此端點來除錯驗證問題。如果請求失敗,請檢查您的 API 金鑰有效性和網路連線。回應將列出模型詳細資訊,包括上下文視窗大小和 token 限制。
from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
處理速率限制與錯誤
我們的 API 對每個金鑰實施每分鐘 300 個請求的限制。如果你超過此限制,將收到 429 錯誤。我們也支援 8 MB 的請求主體限制,適用於複雜的提示詞或大的上下文視窗。
常見錯誤包括 401(金鑰無效)和 402(額度不足)。預付額度永不過期,因此您可隨時儲值。額度贈品會自動套用於較大金額的購買:$50 以上贈送 +5%,$100 以上贈送 +10%。
技術規格
購買額度前,請先確認介面是否符合你的需求——以下是全部真實參數。
| 項目 | 說明 |
|---|---|
| 介面格式 | 相容 OpenAI:任何 OpenAI SDK 只需更換 base URL 和金鑰 |
| 模型 ID | uncensored |
| 端點 | POST /v1/chat/completions · GET /v1/models |
| 驗證 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.hermesllmapi.com/v1 |
| 最大輸出 | 不另設輸出上限;提示+回覆共 100,000 個 token 視窗內,max_tokens 可選 |
| JSON 模式 | response_format: {"type": "json_object"} |
| 取樣參數 | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 函式呼叫 | 支援 tools、tool_choice;回覆包含 tool_calls(串流同樣支援),結果以 role: tool 訊息回傳 |
| 上下文視窗 | 100,000 tokens(輸入與輸出合計) |
| 串流輸出 | 支援 SSE,最後一段包含 token 用量 |
| 並行請求 | 每把金鑰同時最多 8 個請求 |
| 回應標頭 | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 速率限制 | 每把金鑰每分鐘 300 次請求 |
| 請求大小 | 每次請求不超過 8 MB |
| 價格 | 輸入 $0.25 / 百萬 tokens · 輸出 $1.00 / 百萬 tokens |
| 贈送額度 | 滿 $50 送 5%,滿 $100 送 10% |
| 儲值 | USDT(TRC20)或 USDC(Base),$10–$500 任意整數金額 |
| 免費試用 | $0.50,有效期 7 天,不需信用卡 · 試用金鑰:2 個並行請求,每分鐘 60 次;首次儲值後恢復完整限額(8 和 300) |
| 計費 | 預付額度,按實際 token 用量扣費;錯誤和拒絕不收費 |
| 額度效期 | 付費額度永不過期,無訂閱 |
| 金鑰 | 每個帳戶一把有效金鑰;產生新金鑰後舊金鑰失效 |
| 登入 | Google 或電子郵件 + 密碼 |
| 內容政策 | 允許成人內容;涉及未成年人的性內容一律拒絕 |
錯誤代碼
錯誤以 JSON 回傳,type 欄位固定;失敗或被拒絕的請求不計費。
| 狀態碼 | 類型 | 含義 |
|---|---|---|
400 | bad_request | JSON 無效、訊息為空、參數錯誤或超出上下文視窗 |
401 | missing_key · invalid_key · key_revoked | 缺少金鑰、金鑰錯誤或已被新金鑰取代 |
402 | no_credit | 餘額不足——儲值後立即恢復 |
403 | content_blocked | 涉及未成年人的性內容——拒絕且不計費 |
404 | not_found | 未知端點 |
413 | request_too_large | 請求內容超過 8 MB |
429 | rate_limited · concurrency | 超過每分鐘 300 次或 8 個並行——稍後重試 |
503 | upstream_busy | 模型忙碌——幾秒後重試 |
問答
hermes API 支援影像或音訊生成嗎?
不,我們目前提供僅限文字的聊天完成 API。我們不支援嵌入、影像、音訊或影片生成,也不提供微調。我們專注於為標準 OpenAI 相容客戶端提供簡單的無審查文字模型。
無審查模型如何處理成人內容?
模型不會拒絕合法的成人、虛構或具爭議性的主題。然而,有一個嚴格內容限制:涉及未成年人性內容的請求一律會被封鎖。這是唯一對您的提示詞套用的嚴格限制。
如果我額度用完會發生什麼事?
你的 API 金鑰保持有效,但請求會回傳 402 錯誤,表示資金不足。你可以隨時透過加密貨幣(USDT 或 USDC)為帳戶儲值。你的預付額度永不過期,因此你可以在準備好繼續時隨時加入資金。
只差一張表單,即可取得金鑰
建立帳戶、複製金鑰、更改基礎 URL。這就是整個設定。