Accueil › Routeur

En préparation · équipes pilotes

Tokenmètre Routeur : chaque appel d'IA au juste modèle, sans dégrader le produit.

Une passerelle qui mesure le coût réel de chaque fonctionnalité d'IA, teste un modèle moins cher sur votre propre jeu d'évaluation, puis route avec retour arrière. L'économie est vérifiée avant d'être annoncée, jamais promise avant d'être mesurée.

Devenir équipe pilote Voir le miroir

Prix des modèles relevés le 28 septembre 2026 · volumes de l'exemple fictifs · notre méthode

Exemple fictif

Trois fonctionnalités, une facture, un miroir

Volumes inventés pour la démonstration, prix réels du relevé Tokenmètre. Choisissez une fonctionnalité, ajustez ses volumes, lancez le miroir.

1 · La facture, attribuée par fonctionnalité

Facture mensuelle de l'exemple : 5 044,99 €

2 · Le candidat, à prix relevé

En placeGPT-6 Sol1 534,33 €par mois, au tarif relevé
CandidatGPT-6 Luna76,72 €par mois, au tarif relevé

Écart de coût : 1 457,62 € par mois, si la qualité tient. C'est tout ce qu'un prix peut dire.

3 · Le miroir, avant toute activation

Réponses comparées sur votre jeu d'évaluation0
Routage impossible

Aucune réponse comparée : rien ne change en production.

Les coûts sont calculés dans votre navigateur avec la formule du simulateur et les prix du relevé : GPT-6 Sol et GPT-6 Luna. Le compteur du miroir est une animation : dans le logiciel, il compte des réponses réellement comparées.

Trois questions auxquelles votre facture ne répond pas

Quelle fonctionnalité explique la hausse ?

Plusieurs modèles, plusieurs fournisseurs, des agents qui enchaînent les étapes : la facture arrive globale. Le routeur attribue chaque appel à une fonctionnalité, un environnement, un client.

Quel modèle moins cher est acceptable, et pour quelle tâche ?

Un prix ne dit rien de la qualité. Le miroir rejoue vos requêtes sur le candidat, hors production, et compare aux réponses que vous jugez bonnes.

D'où vient l'économie, et tient-elle ?

Routage, cache, prompts plus courts, modèle plus petit : chaque effet est mesuré séparément, sur une base comparable, avec la latence et le taux d'erreur.

Du diagnostic au routage, en sept étapes

Rien ne change en production avant l'étape six, et chaque étape laisse une trace : qui a défini quoi, quand, sur quelles mesures.

Proposer un pilote

  1. ConnecterUn compte fournisseur, un import de journaux, ou un point d'entrée compatible à la place du vôtre.
  2. VoirModèle, fournisseur, tokens, latence, erreurs et coût, par fonctionnalité et par client.
  3. RepérerLes requêtes répétitives, coûteuses, ou adaptées à un modèle moins cher.
  4. DéfinirVotre jeu d'évaluation : exemples attendus, seuils, contraintes de latence et de confidentialité.
  5. MirerComparaison en simulation ou en trafic miroir, sans changer les réponses envoyées à vos utilisateurs.
  6. ActiverUne règle graduelle, par type de tâche, pourcentage du trafic ou groupe de clients, que vous approuvez.
  7. SurveillerCoût, qualité, latence, erreurs ; retour à la route précédente dès qu'un seuil est dépassé.

Ce que le routeur ne fait pas

Il ne promet pas de pourcentage d'économie

L'économie se mesure sur votre trafic, après activation, sur une base comparable. Avant, on ne sait pas.

Il n'optimise rien sans votre approbation

Pas de bascule automatique : une règle que vous activez, graduelle, avec arrêt d'urgence et retour arrière.

Il ne juge pas la qualité à votre place

Il n'existe pas d'évaluateur universel. Votre équipe définit ce qu'est une bonne réponse pour votre produit ; le routeur compare.

Il ne garde pas vos prompts par défaut

Conservation des prompts et des sorties désactivée sauf décision de votre part ; clés fournisseurs dans un coffre ou fournies par vous ; déploiement possible dans une région de l'Union européenne.

En préparation

Nous le construisons avec des éditeurs qui paient déjà la facture

Tokenmètre Routeur n'est pas encore disponible et son prix n'est pas fixé. Nous cherchons des éditeurs de logiciels B2B qui utilisent plusieurs modèles en production et dont la dépense en modèles d'IA pèse déjà sur la marge. Le pilote tient en cinq temps : un diagnostic en lecture seule sur vos journaux, un rapport de coût par fonctionnalité, un test sur un workflow et un jeu d'évaluation que vous approuvez, le miroir, puis une activation sur une petite part du trafic. L'offre payante ne vient qu'après, si les mesures le justifient.

Ce que le pilote mesure : la part de la dépense attribuée, l'écart de qualité sur votre jeu d'évaluation, la variation de latence et d'erreurs, le nombre de retours arrière et leur raison.

Écrire à tokenmetre@zelij.ai Choisir un créneau de 30 minutes

Une personne vous répond. Aucun engagement, aucun journal réel sans accord écrit.

Questions fréquentes

Le routeur décide-t-il tout seul de changer de modèle ?

Non. Il mesure, compare sur votre jeu d'évaluation en mode miroir, puis vous proposez une règle d'activation graduelle. Rien ne change en production sans votre approbation, et chaque règle a un retour arrière.

D'où viennent les prix affichés ?

Du relevé de Tokenmètre : chaque prix vient de la page officielle de l'éditeur, converti en euros au taux de référence de la BCE et daté (28 septembre 2026). Le routeur utilise la même table de prix, versionnée.

Quelle économie puis-je attendre ?

Nous n'en promettons aucune avant d'avoir mesuré vos données : l'économie se calcule sur votre trafic réel, après activation, en excluant les périodes que l'on ne peut pas comparer proprement.

Que voit le routeur de mes données ?

Le strict nécessaire pour attribuer un appel : fonctionnalité, environnement, client, volumes. La conservation des prompts et des sorties est désactivée par défaut ; vous la contrôlez.