Les tarifs suivent l’amont
Quand un fournisseur change son prix, le tarif ici évolue avec lui. La page modèles est générée depuis la configuration réelle de la passerelle.
À propos de Hubrium
Hubrium est une couche de routage devant des fournisseurs de modèles chinois. Cette page explique ce qui arrive à une requête, comment un tarif est fixé, et ce que nous publions pour que vous puissiez le vérifier.
Parcours d’une requête
Un seul saut. Hubrium vérifie la clé, résout l’ID du modèle vers un fournisseur, transmet la requête et compte les tokens rapportés par le fournisseur.
Un client OpenAI ou Anthropic non modifié, pointé vers l’URL de base Hubrium.
Vérification de la clé, résolution du modèle, traduction de la requête et comptage par token.
Le modèle en amont exécute la requête et rapporte ses propres compteurs de tokens.
Tarifs transparents
Chaque prix affiché découle du coût amont du modèle, et non d’une grille que nous aurions inventée. Cela a des conséquences qu’il vaut mieux énoncer clairement.
Quand un fournisseur change son prix, le tarif ici évolue avec lui. La page modèles est générée depuis la configuration réelle de la passerelle.
Un modèle peut être accessible avant d’avoir un tarif publié. Il est alors marqué « sur demande » plutôt que doté d’un nombre fictif.
Chacun est mesuré séparément. L’entrée en cache n’est réduite que si le fournisseur signale un vrai cache hit.
models.json publie les mêmes tarifs que cette page, avec un hash de version. Développez contre lui plutôt que d’extraire la page.
Hubrium
Modèles, tarifs, endpoints et état du service sont publics et lisibles par machine. Nous évaluer ne devrait pas exiger un compte.
L’API a délibérément la forme de celle d’un autre. Changer une URL de base suffit pour partir.
Quand la disponibilité ou les capacités dépendent de la configuration amont, le site le dit au lieu de l’arrondir.
Votre prochain appel d’inférence
Toute l’intégration tient dans une URL de base et une clé. L’essayer prend moins de temps que d’en lire la description.