Tentang Hubrium

Apa yang berada di antara SDK Anda dan model.

Hubrium adalah lapisan perutean di depan penyedia model Tiongkok. Halaman ini menjelaskan apa yang terjadi pada sebuah request, bagaimana tarif ditentukan, dan apa yang kami publikasikan agar Anda bisa memeriksanya.

Model aktif
7
Keluarga model
4
Format request
OpenAI
Satuan harga
USD / 1 jt token

Jalur request

Perjalanan sebuah request

Satu lompatan. Hubrium memeriksa key, memetakan ID model ke penyedia, meneruskan request, lalu menghitung token yang dilaporkan penyedia.

  1. SDK Anda

    Klien OpenAI atau Anthropic tanpa modifikasi, diarahkan ke base URL Hubrium.

  2. Hubrium

    Pemeriksaan key, pemetaan model, penerjemahan request, dan penghitungan per token.

  3. Penyedia

    Model upstream menjalankan request dan melaporkan hitungan tokennya sendiri.

Harga transparan

Bagaimana tarif ditentukan

Setiap harga di situs ini diturunkan dari biaya upstream model, bukan dari daftar harga yang kami karang. Ada konsekuensinya yang perlu dinyatakan terang-terangan.

Tarif mengikuti upstream

Ketika penyedia mengubah harganya, tarif di sini ikut bergerak. Halaman model dihasilkan dari konfigurasi gateway yang berjalan.

Model tanpa tarif menyatakannya

Sebuah model bisa dapat diakses sebelum punya tarif publik. Model itu ditandai sesuai permintaan, bukan diberi angka pengganti.

Input, cache, dan output terpisah

Masing-masing diukur sendiri. Input cache hanya didiskon bila penyedia melaporkan cache hit yang sebenarnya.

Feed adalah sumber kebenaran

models.json memuat tarif yang sama dengan halaman ini, lengkap dengan hash versi. Bangun terhadap feed itu, bukan dengan scraping halaman.

Hubrium

Cara kami bekerja

  1. Publikasikan lebih dulu

    Model, harga, endpoint, dan status layanan bersifat publik dan terbaca mesin. Menilai kami tidak perlu akun.

  2. Tanpa penguncian

    API ini sengaja berbentuk milik orang lain. Mengganti satu base URL sudah cukup untuk pergi.

  3. Sebutkan yang belum pasti

    Bila ketersediaan atau kemampuan bergantung pada konfigurasi upstream, situs ini mengatakannya alih-alih memperhalusnya.

Panggilan inferensi berikutnya

Baca panduan cepat, lalu putuskan.

Seluruh integrasinya hanya base URL dan satu key. Mencobanya lebih cepat daripada membacanya.