TH ▾
รับคีย์ API

Hermes API: เปลี่ยนไคลเอนต์ของคุณในสามบรรทัด

เริ่มต้นใช้งาน Hermes API ในไม่กี่นาทีโดยใช้ SDK มาตรฐานของ OpenAI คู่มือเริ่มต้นอย่างรวดเร็วนี้ครอบคลุมการกำหนดค่า คำขอพื้นฐาน การสตรีมมิง และการจัดการข้อผิดพลาดสำหรับการผสาน LLM แบบไม่เซ็นเซอร์ของคุณ

ต่อ 1M โทเคนอินพุต
$0.25
โทเคนเอาต์พุต / 1M
$1.00
หน้าต่างบริบทของโทเคน
100,000
เครดิตทดลองใช้
$0.50
คำขอต่อนาที
300

ติดตั้ง OpenAI SDK

เนื่องจากเอนด์พอยต์ของเราเข้ากันได้กับ OpenAI คุณจึงสามารถใช้ SDK ทางการที่คุณคุ้นเคยอยู่แล้วได้ วิธีนี้ช่วยให้คุณเปลี่ยนจากผู้ให้บริการรายอื่นได้โดยไม่ต้องเขียนตรรกะแอปพลิเคชันใหม่ เราสนับสนุนแพ็กเกจ openai มาตรฐานสำหรับสภาพแวดล้อม Python และ Node.js

ตรวจสอบว่าคุณใช้เวอร์ชันล่าสุดของ SDK เพื่อให้แน่ใจว่าเข้ากันได้กับฟีเจอร์สตรีมมิงและการเรียกใช้ฟังก์ชัน ไลบรารีไคลเอนต์จัดการการแปลงข้อมูล JSON และการขนส่ง HTTP โดยอัตโนมัติ ดังนั้นคุณสามารถมุ่งเน้นไปที่พารามิเตอร์โมเดลแทนรายละเอียดเครือข่าย

กำหนดค่า Base URL และคีย์

การตรวจสอบสิทธิ์ดำเนินการผ่านโทเคน Bearer ในส่วนหัว Authorization คุณได้รับคีย์ของคุณโดยการสมัครสมาชิกด้วยอีเมลและรหัสผ่านบนแดชบอร์ดของเรา ไม่จำเป็นต้องใช้บัตรเครดิตสำหรับการทดลองใช้ และคุณสามารถสร้างคีย์ใหม่ได้ทุกเมื่อเพื่อยกเลิกการเข้าถึง

ตั้งค่า URL พื้นฐานเป็นเอนด์พอยต์เฉพาะของเรา สิ่งนี้ทำให้แน่ใจว่าคำขอทั้งหมดไปยังโครงสร้างพื้นฐานโมเดลที่ไม่เซ็นเซอร์ของเราแทนที่จะเป็นคลาวด์ OpenAI มาตรฐาน คุณสามารถพบคีย์ API ของคุณบนหน้า 'รับคีย์ API' ทันทีหลังจากสมัครสมาชิก

ส่งคำขอแรกของคุณ

ส่งคำขอ chat completion มาตรฐานเพื่อทดสอบการเชื่อมต่อ รหัสโมเดลคือ uncensored เสมอ โมเดลนี้ได้รับการปรับแต่งเพื่อตอบโดยไม่มีการปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ตามกฎหมาย ทำให้เหมาะสำหรับการเขียนเชิงสร้างสรรค์ การสวมบทบาท หรือการวิจัยแบบไม่มีข้อจำกัด

  • ใช้ POST /v1/chat/completions สำหรับการสร้างข้อความ
  • หน้าต่างบริบทรองรับโทเคนได้สูงสุด 100,000 โทเคนสำหรับพรอมต์และการสร้างคำตอบ
  • คำขอจะถูกเรียกเก็บตามจำนวนโทเคนอินพุตและเอาต์พุต
curl https://api.hermesllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

เปิดใช้สตรีมมิง (SSE)

เพื่อประสบการณ์ผู้ใช้ที่ดีขึ้น ให้เปิดใช้สตรีมมิงเพื่อรับโทเคนเมื่อถูกสร้าง ซึ่งช่วยลดความล่าช้าที่ผู้ใช้รู้สึก โดยเฉพาะกับคำตอบที่ยาว เซิร์ฟเวอร์จะส่งเหตุการณ์ที่ส่งโดยเซิร์ฟเวอร์ (SSE) ที่ไคลเอนต์ของคุณสามารถแยกวิเคราะห์แบบเรียลไทม์

ตั้งค่าพารามิเตอร์ stream เป็น true ในบอดี้คำขอของคุณ SDK จะส่งข้อมูลแบบชิ้นส่วนเมื่อมาถึง ซึ่งจะมีประโยชน์มากสำหรับอินเทอร์เฟซแชทที่คุณต้องการแสดงข้อความแบบเพิ่มทีละส่วนแทนที่จะรอให้คำตอบทั้งหมดเสร็จสิ้น

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

ใช้การเรียกใช้เครื่องมือ/ฟังก์ชัน

API ของเรารองรับการเรียกใช้ฟังก์ชัน ทำให้โมเดลสามารถส่งออก JSON ที่มีโครงสร้างสำหรับการดำเนินการเครื่องมือภายนอก กำหนดฟังก์ชันของคุณในพารามิเตอร์ tools และโมเดลจะส่งคืน tool_calls ในการตอบกลับหากเหมาะสม

คุณลักษณะนี้ทำงานเหมือนกับที่ระบุไว้ในสเปคของ OpenAI คุณสามารถแยกวิเคราะห์ชื่อฟังก์ชันและอาร์กิวเมนต์ ดำเนินตรรกะแบ็กเอนด์ของคุณ และป้อนผลลัพธ์กลับเข้าสู่การสนทนา มันเข้ากันได้กับเวิร์กโฟลว์การเรียกใช้ฟังก์ชันของ SDK OpenAI มาตรฐาน

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

ตรวจสอบโมเดลที่มีอยู่

เรียกใช้เอนด์พอยต์โมเดลเพื่อตรวจสอบการเชื่อมต่อและดูตัวเลือกที่มีอยู่ ปัจจุบันเราเสนอโมเดลเฉพาะเพียงรุ่นเดียว: uncensored ความเรียบง่ายนี้หลีกเลี่ยงความซับซ้อนของการจัดเส้นทางโมเดลหรือโครงสร้างพื้นฐานทั่วไป ซึ่งช่วยให้มั่นใจในพฤติกรรมที่คาดการณ์ได้

คุณยังสามารถใช้เอนด์พอยต์นี้เพื่อแก้ไขปัญหาการตรวจสอบสิทธิ์ได้ หากคำขอล้มเหลว ให้ตรวจสอบความถูกต้องของคีย์ API และการเชื่อมต่อเครือข่าย การตอบกลับจะแสดงรายละเอียดโมเดล รวมถึงขนาดหน้าต่างบริบทและขีดจำกัดโทเคน

from openai import OpenAI

client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

จัดการขีดจำกัดอัตราและข้อผิดพลาด

API ของเราจำกัดคำขอ 300 คำขอต่อนาทีต่อคีย์ หากเกินจะรับข้อผิดพลาด 429 รองรับบอดี้คำขอสูงสุด 8 MB สำหรับพรอมต์หรือหน้าต่างบริบทขนาดใหญ่

ข้อผิดพลาดทั่วไปรวมถึง 401 (คีย์ไม่ถูกต้อง) และ 402 (เครดิตไม่เพียงพอ) เครดิตแบบเติมเงินล่วงหน้าไม่หมดอายุ ดังนั้นคุณสามารถเติมเงินได้ตามความสะดวก โบนัสเครดิตจะถูกนำไปใช้โดยอัตโนมัติสำหรับการซื้อขนาดใหญ่: +5% จาก $50 และ +10% จาก $100

ข้อมูลจำเพาะทางเทคนิค

ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน

รายการค่า
รูปแบบ APIรองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์
ID โมเดลuncensored
เอนด์พอยต์POST /v1/chat/completions · GET /v1/models
การยืนยันตัวตนAuthorization: Bearer YOUR_KEY
Base URLhttps://api.hermesllmapi.com/v1
เอาต์พุตสูงสุดได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก)
โหมด JSONresponse_format: {"type": "json_object"}
พารามิเตอร์temperature, top_p, stop, seed, presence_penalty, frequency_penalty
การเรียกใช้ฟังก์ชันรองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool
หน้าต่างบริบท100,000 โทเคน (อินพุตรวมเอาต์พุต)
สตรีมมิงรองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้
คำขอพร้อมกันสูงสุด 8 คำขอพร้อมกันต่อคีย์
เฮดเดอร์ของคำตอบX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
ขีดจำกัดอัตรา300 คำขอต่อนาทีต่อคีย์
ขนาดคำขอไม่เกิน 8 MB
ราคา$0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต
โบนัส+5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100
เติมเงินUSDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500
เครดิตทดลองใช้ฟรี$0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก
การคิดเงินเครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน
อายุเครดิตเครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน
คีย์หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม
เข้าสู่ระบบGoogle หรืออีเมลและรหัสผ่าน
เนื้อหาอนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์

รหัสข้อผิดพลาด

ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน

รหัสประเภทความหมาย
400bad_requestJSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท
401missing_key · invalid_key · key_revokedไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว
402no_creditเครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที
403content_blockedเนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน
404not_foundไม่รู้จักเอนด์พอยต์
413request_too_largeขนาดเกิน 8 MB
429rate_limited · concurrencyเกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่
503upstream_busyโมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที
01

ถาม-ตอบ

Hermes API รองรับภาพหรือการสร้างเสียงหรือไม่

ไม่ ปัจจุบันเราเสนอ API การสนทนาแบบข้อความเท่านั้น เราไม่รองรับเอบเดดดิ้ง รูปภาพ เสียง หรือการสร้างวิดีโอ และเราไม่เสนอการปรับแต่งพิเศษ จุดเน้นของเราคือการมอบโมเดลข้อความที่ไม่เซ็นเซอร์ที่ตรงไปตรงมาสำหรับไคลเอนต์ที่เข้ากันได้กับ OpenAI มาตรฐาน

โมเดลไม่เซ็นเซอร์จัดการเนื้อหาสำหรับผู้ใหญ่อย่างไร

โมเดลไม่ปฏิเสธหัวข้อผู้ใหญ่ตามกฎหมาย นามสมมติ หรือที่ถกเถกันได้ อย่างไรก็ตาม มีขีดจำกัดเนื้อหาที่เข้มงวด: คำขอที่เกี่ยวข้องกับเนื้อหาทางเพศกับเด็กจะถูกบล็อกเสมอ นี่คือข้อจำกัดเดียวที่เข้มงวดกับพรอมต์ของคุณ

เกิดอะไรขึ้นหากเครดิตหมด

คีย์ API ของคุณยังคงใช้งานอยู่ แต่คำขอจะส่งข้อผิดพลาด 402 บ่งชี้ว่าเงินไม่พอ คุณสามารถเติมเงินบัญชีด้วยคริปโต (USDT หรือ USDC) ได้ตลอดเวลา เครดิตแบบเติมเงินล่วงหน้าของคุณไม่หมดอายุ ดังนั้นคุณสามารถเติมเงินเมื่อใดก็ได้เมื่อคุณพร้อมที่จะดำเนินการต่อ

คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว

สร้างบัญชี คัดลอกคีย์ เปลี่ยน base URL นั่นคือการตั้งค่าทั้งหมด

รับคีย์ APIอ่านเอกสาร