Kelola kuota token, caching respons LLM, dan akses semua model AI upstream dalam satu dashboard.
curl https://myrouter.genzx.id/v1/chat/completions \ -H "Authorization: Bearer sk-genzx-…" \ -H "Content-Type: application/json" \ -d '{"model":"openai/gpt-4o-mini", "messages":[{"role":"user", "content":"Halo!"}]}'
Satu endpoint, banyak provider, kontrol penuh.
Akses seluruh katalog upstream Anda lewat satu API key. Daftar model & harga disinkron langsung dari provider yang terdaftar.
Round-robin antar upstream key. Key yang kena 401/402 cooldown 24 jam, 429 satu jam, gangguan 5xx cuma 5 menit — request langsung pindah ke key berikutnya.
Prompt identik dilayani dari cache — nol biaya, nol latensi. TTL bisa diatur dari dashboard.
Tiap API key punya batas biaya (USD) dan batas request per menit sendiri.
Notifikasi ke URL Anda saat request selesai, kuota habis, atau semua key gagal.
Biaya, token, latensi, dan error per model / per key / per hari.
| Model ID | Context | $/1M in | $/1M out |
|---|---|---|---|
| Memuat… | |||
Python (OpenAI SDK)
from openai import OpenAI client = OpenAI( base_url="https://myrouter.genzx.id/v1", api_key="sk-genzx-…", ) r = client.chat.completions.create( model="anthropic/claude-3.5-sonnet", messages=[{"role":"user","content":"Hai"}], ) print(r.choices[0].message.content)
Endpoint
GET /v1/modelsAPI keyPOST /v1/chat/completionsAPI keyGET /healthpublikGET /dashboardloginAPI key dibuat dari dashboard. Streaming (stream:true) didukung penuh.