Accueil › Accès le moins cher

Le prix le moins cher pour accéder à chaque modèle

Au 28 septembre 2026, 11 des 30 modèles suivis sont proposés moins cher par le routeur que sur la page de tarifs de leur éditeur. Le plus grand écart concerne DeepSeek V4.1 Flash : 81 % de moins chez InferenceNet.

Offres relevées le 28 septembre 2026 chez OpenRouter · prix en euros par million de tokens, entrée puis sortie · frais du routeur en sus

Modèles relevés30avec au moins une offre standard
Moins chers par le routeur11que sur la page de l'éditeur
Plus grand écart−81 %DeepSeek V4.1 Flash
Relevé28/09/2026source : OpenRouter

30 modèles

Prix de l'éditeur et prix le moins cher relevé chez un routeur, par modèle, au 28 septembre 2026
Fournisseur Ralenti ou différéDétail
DeepSeek V4.1 FlashDeepSeek0,26 € · 1,05 €0,031 € · 0,25 €InferenceNet−81 %—27 offres
DeepSeek V4 ProDeepSeek1,16 € · 3,47 €0,23 € · 0,69 €StreamLake−80 %—22 offres
GLM-5.3 FlashZ.ai0,13 € · 0,44 €0,039 € · 0,12 €InferenceNetversion compressée fp4−71 %—33 offres
GLM-5.2Z.ai1,23 € · 3,86 €0,43 € · 1,35 €Decartversion compressée mxfp4−65 %—32 offres
GLM-5.3Z.ai1,23 € · 3,86 €0,48 € · 1,49 €Relace−61 %—40 offres
Kimi K3Moonshot AI2,63 € · 13,15 €0,88 € · 7,89 €InferenceNetversion compressée fp4−50 %—18 offres
Qwen3.8 27BAlibaba Cloud0,44 € · 2,63 €0,13 € · 1,64 €DeepInfra−48 %—16 offres
Kimi K2.6Moonshot AI0,83 € · 3,51 €0,39 € · 2,10 €Inceptronversion compressée int4−45 %—19 offres
Kimi K2.7 CodeMoonshot AI0,83 € · 3,51 €0,62 € · 2,63 €StreamLake−25 %—15 offres
MiniMax M3MiniMax0,26 € · 1,05 €0,20 € · 0,84 €CoreWeaveversion compressée fp4−21 %—13 offres
Grok 4.7SpaceXAI (Grok)1,75 € · 5,26 €1,40 € · 4,21 €xAI−20 %—4 offres
Claude Fable 5.1Anthropic8,77 € · 43,85 €8,77 € · 43,85 €tarif de l'éditeurmême prix4,38 € · 21,92 €4 offres
Claude Opus 5.5Anthropic3,51 € · 17,54 €3,51 € · 17,54 €tarif de l'éditeurmême prix1,75 € · 8,77 €11 offres
Claude Sonnet 5Anthropic1,75 € · 8,77 €1,75 € · 8,77 €tarif de l'éditeurmême prix0,88 € · 4,38 €10 offres
Claude Haiku 4.5Anthropic0,88 € · 4,38 €0,88 € · 4,38 €tarif de l'éditeurmême prix0,44 € · 2,19 €8 offres
GPT-6 AstraOpenAI8,77 € · 43,85 €8,77 € · 43,85 €tarif de l'éditeurmême prix4,38 € · 21,92 €6 offres
GPT-6 SolOpenAI1,75 € · 8,77 €1,75 € · 8,77 €tarif de l'éditeurmême prix0,88 € · 4,38 €7 offres
GPT-6 LunaOpenAI0,088 € · 0,44 €0,088 € · 0,44 €tarif de l'éditeurmême prix0,044 € · 0,22 €7 offres
Gemini 3.1 Pro PreviewGoogle1,75 € · 10,52 €1,75 € · 10,52 €tarif de l'éditeurmême prix0,88 € · 5,26 €6 offres
Gemini 3.8 FlashGoogle0,66 € · 3,29 €0,66 € · 3,29 €tarif de l'éditeurmême prix0,33 € · 1,64 €6 offres
Gemini 3.5 Flash-LiteGoogle0,26 € · 2,19 €0,26 € · 2,19 €tarif de l'éditeurmême prix0,13 € · 1,10 €8 offres
Gemini 2.5 Flash-LiteGoogle0,088 € · 0,35 €0,088 € · 0,35 €tarif de l'éditeurmême prix0,044 € · 0,18 €5 offres
Qwen3.8 2.4T-A95BAlibaba Cloud1,75 € · 5,26 €1,75 € · 5,26 €tarif de l'éditeurmême prix—7 offres
Claude Fable 5Anthropic8,77 € · 43,85 €8,77 € · 43,85 €tarif de l'éditeurmême prix4,38 € · 21,92 €6 offres
Claude Opus 5Anthropic4,38 € · 21,92 €4,38 € · 21,92 €tarif de l'éditeurmême prix2,19 € · 10,96 €11 offres
Claude Opus 4.8Anthropic4,38 € · 21,92 €4,38 € · 21,92 €tarif de l'éditeurmême prix2,19 € · 10,96 €11 offres
Claude Opus 4.7Anthropic4,38 € · 21,92 €4,38 € · 21,92 €tarif de l'éditeurmême prix2,19 € · 10,96 €8 offres
Claude Opus 4.6Anthropic4,38 € · 21,92 €4,38 € · 21,92 €tarif de l'éditeurmême prix2,19 € · 10,96 €6 offres
Claude Sonnet 4.6Anthropic2,63 € · 13,15 €2,63 € · 13,15 €tarif de l'éditeurmême prix1,32 € · 6,58 €9 offres
Qwen3.8 MaxAlibaba Cloud1,75 € · 5,26 €1,75 € · 5,26 €tarif de l'éditeurmême prix—1 offre

Aucun modèle pour ces filtres

Revenez à « Tous les éditeurs » et « Tous les prix ».

« Accès le moins cher » : l'offre en temps réel la moins chère parmi celles relevées, pour un usage composé de trois quarts de tokens en entrée et d'un quart en sortie. Un modèle absent du tableau n'avait aucune offre relevée chez le routeur à cette date.

Avant de choisir l'offre la moins chère

  • Vérifiez la version servie. Une version compressée coûte moins cher mais peut répondre moins bien.
  • Regardez où vont vos données. Passer par un routeur et un hébergeur tiers ajoute deux intermédiaires ; leurs conditions de conservation diffèrent de celles de l'éditeur.
  • Comptez les frais du routeur. Ils s'ajoutent au prix du fournisseur.
  • Testez la disponibilité. Le prix le plus bas ne garantit ni la vitesse ni la continuité du service.

D'où viennent ces prix

De l'interface publique d'OpenRouter, qui liste pour chaque modèle les fournisseurs qui le servent et leurs prix. Nous relevons ces prix tels qu'ils sont publiés, sans les modifier. Le tarif de l'éditeur vient de sa page officielle. C'est à ce jour le seul routeur que nous relevons : un accès encore moins cher peut exister ailleurs.

Questions fréquentes

Qu'est-ce qu'un routeur de modèles d'IA ?

Un service qui donne accès à de nombreux modèles par une seule interface et une seule facture. Il transmet chaque requête à un fournisseur qui fait tourner le modèle : l'éditeur lui-même, un grand hébergeur, ou un hébergeur spécialisé.

Pourquoi un modèle peut-il coûter moins cher ailleurs que chez son éditeur ?

Quand un éditeur publie les poids de son modèle, n'importe quel hébergeur peut le faire tourner et fixer son prix. Pour les modèles fermés, seuls l'éditeur et ses partenaires le proposent : le prix est alors le même presque partout.

Le modèle est-il vraiment le même ?

Pas toujours. Certains hébergeurs servent une version compressée du modèle, moins coûteuse à faire tourner, dont les réponses peuvent être un peu moins bonnes. Quand c'est le cas, le tableau l'indique. La fenêtre de contexte et la vitesse varient aussi d'un fournisseur à l'autre.

Y a-t-il des frais en plus ?

Oui. Le routeur facture ses propres frais, en plus du prix du fournisseur. Ils figurent dans ses conditions ; nous ne les incluons pas dans les prix affichés.

Que signifie « ralenti ou différé » ?

Des offres moins chères où la réponse n'arrive pas tout de suite : traitement par lots, rendu en quelques heures, ou traitement à faible priorité. Elles conviennent aux tâches qui peuvent attendre, pas à un assistant qui répond en direct.