VI ▾
Lấy khóa API

API Hermes: Chuyển đổi khách hàng của bạn chỉ với ba dòng mã

Bắt đầu với API Hermes trong vài phút bằng các SDK OpenAI tiêu chuẩn. Hướng dẫn nhanh này bao gồm cấu hình, yêu cầu cơ bản, truyền phát và xử lý lỗi cho tích hợp LLM không kiểm duyệt của bạn.

trên mỗi 1 triệu token đầu vào
$0.25
Token đầu ra / 1 triệu
$1.00
cửa sổ ngữ cảnh token
100,000
tín dụng dùng thử miễn phí
$0.50
yêu cầu mỗi phút
300

Cài đặt SDK OpenAI

Vì endpoint của chúng tôi tương thích với OpenAI, bạn có thể sử dụng các SDK chính thức mà bạn đã quen thuộc. Cách tiếp cận này cho phép bạn chuyển từ các nhà cung cấp khác mà không cần viết lại logic ứng dụng. Chúng tôi hỗ trợ gói openai tiêu chuẩn cho môi trường Python và Node.js.

Đảm bảo bạn đang sử dụng phiên bản SDK mới nhất để đảm bảo tương thích với các tính năng truyền phát và gọi hàm. Thư viện khách hàng tự động xử lý tuần tự hóa JSON và vận chuyển HTTP, vì vậy bạn có thể tập trung vào các tham số mô hình thay vì chi tiết mạng.

Cấu hình Base URL & Khóa

Xác thực được xử lý thông qua token Bearer trong tiêu đề Authorization. Bạn nhận được khóa bằng cách đăng ký với email và mật khẩu trên bảng điều khiển của chúng tôi. Không cần thẻ tín dụng cho bản dùng thử, và bạn có thể tạo lại khóa bất cứ lúc nào để thu hồi quyền truy cập.

Đặt base URL thành endpoint chuyên dụng của chúng tôi. Điều này đảm bảo tất cả các yêu cầu đều được gửi đến cơ sở hạ tầng mô hình không kiểm duyệt của chúng tôi thay vì đám mây OpenAI mặc định. Bạn có thể tìm thấy khóa API của mình trên trang 'Lấy khóa API' ngay sau khi đăng ký.

Gửi yêu cầu đầu tiên của bạn

Gửi một yêu cầu chat completion tiêu chuẩn để kiểm tra kết nối. ID mô hình luôn là uncensored. Mô hình này được tinh chỉnh để trả lời mà không có từ chối nội dung cho mục đích người trưởng thành hợp pháp, rất lý tưởng cho viết sáng tạo, nhập vai hoặc nghiên cứu không giới hạn.

  • Sử dụng POST /v1/chat/completions cho tạo văn bản.
  • Cửa sổ ngữ cảnh hỗ trợ tối đa 100.000 token cho prompt plus completion.
  • Các yêu cầu được tính phí dựa trên số lượng token đầu vào và đầu ra.
curl https://api.hermesllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Bật truyền phát (SSE)

Để cải thiện trải nghiệm người dùng, hãy bật truyền phát để nhận token khi chúng được tạo. Điều này giảm độ trễ cảm nhận, đặc biệt là đối với các phản hồi dài. Máy chủ trả về các Sự kiện được gửi bởi máy chủ (SSE) mà khách hàng của bạn có thể phân tích cú pháp theo thời gian thực.

Đặt tham số stream thành true trong thân yêu cầu của bạn. SDK sẽ trả về các chunk khi chúng đến. Điều này đặc biệt hữu ích cho các giao diện trò chuyện nơi bạn muốn hiển thị văn bản từng phần thay vì chờ toàn bộ response kết thúc.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Sử dụng gọi hàm

API của chúng tôi hỗ trợ gọi hàm, cho phép mô hình xuất JSON có cấu trúc để thực thi công cụ bên ngoài. Xác định các hàm của bạn trong tham số tools, và mô hình sẽ trả về tool_calls trong phản hồi nếu phù hợp.

Tính năng này hoạt động chính xác như được mô tả trong đặc tả OpenAI. Bạn có thể phân tích cú pháp tên hàm và đối số, thực thi logic backend của mình và đưa kết quả trở lại cuộc trò chuyện. Nó hoàn toàn tương thích với các quy trình gọi công cụ SDK OpenAI tiêu chuẩn.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Kiểm tra các mô hình có sẵn

Truy vấn endpoint models để xác minh kết nối và xem các tùy chọn có sẵn. Hiện tại, chúng tôi cung cấp một mô hình chuyên dụng duy nhất: uncensored. Sự đơn giản này tránh sự phức tạp của việc định tuyến mô hình hoặc cơ sở hạ tầng chung, đảm bảo hành vi dự đoán được.

Bạn cũng có thể sử dụng endpoint này để gỡ lỗi các vấn đề xác thực. Nếu yêu cầu thất bại, hãy kiểm tra tính hợp lệ của khóa API và kết nối mạng. Phản hồi sẽ liệt kê chi tiết mô hình, bao gồm kích thước cửa sổ ngữ cảnh và giới hạn token.

from openai import OpenAI

client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Xử lý giới hạn tốc độ & Lỗi

API của chúng tôi áp dụng giới hạn 300 yêu cầu mỗi phút trên mỗi khóa. Nếu bạn vượt quá giới hạn này, bạn sẽ nhận được lỗi 429. Chúng tôi cũng hỗ trợ giới hạn thân yêu cầu 8 MB cho các prompt phức tạp hoặc cửa sổ ngữ cảnh lớn.

Các lỗi phổ biến bao gồm 401 (khóa không hợp lệ) và 402 (thiếu tín dụng). Tín dụng trả trước không bao giờ hết hạn, vì vậy bạn có thể nạp tiền khi thuận tiện. Tiền thưởng tín dụng được áp dụng tự động cho các khoản mua lớn hơn: +5% từ $50 và +10% từ $100.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
ID mô hìnhuncensored
EndpointPOST /v1/chat/completions · GET /v1/models
Xác thựcAuthorization: Bearer YOUR_KEY
Base URLhttps://api.hermesllmapi.com/v1
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Chế độ JSONresponse_format: {"type": "json_object"}
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Thưởng+5% từ $50, +10% từ $100
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Đăng nhậpGoogle hoặc email và mật khẩu
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây
01

Hỏi đáp

API Hermes có hỗ trợ tạo ảnh hoặc âm thanh không?

Không, hiện chúng tôi chỉ cung cấp API chat-completions chỉ văn bản. Chúng tôi không hỗ trợ embeddings, tạo ảnh, âm thanh hoặc video, cũng như không cung cấp fine-tuning. Trọng tâm của chúng tôi là cung cấp mô hình văn bản không kiểm duyệt đơn giản cho các khách hàng tương thích OpenAI tiêu chuẩn.

Mô hình không kiểm duyệt xử lý nội dung người lớn như thế nào?

Mô hình không từ chối các chủ đề người lớn hợp pháp, hư cấu hoặc gây tranh cãi. Tuy nhiên, có một giới hạn nội dung cứng: các yêu cầu liên quan đến nội dung tình dục với trẻ vị thành niên luôn bị chặn. Đây là hạn chế nghiêm ngặt duy nhất áp dụng cho các prompt của bạn.

Điều gì xảy ra nếu tôi hết tín dụng?

Khóa API của bạn vẫn hoạt động, nhưng các yêu cầu sẽ trả về lỗi 402 cho biết thiếu tiền. Bạn có thể nạp tiền vào tài khoản bằng tiền điện tử (USDT hoặc USDC) bất cứ lúc nào. Tín dụng trả trước của bạn không bao giờ hết hạn, vì vậy bạn có thể thêm tiền bất cứ khi nào bạn sẵn sàng tiếp tục.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ quá trình thiết lập.

Lấy khóa APIĐọc tài liệu