Comparer les prix des LLM : le coût de mes modèles en un coup d'œil
Les prix des grands modèles de langage évoluent régulièrement. En parallèle, les coûts varient considérablement d’un modèle à l’autre : les tokens d’entrée et de sortie sont facturés séparément, les fenêtres de contexte diffèrent et de nouvelles variantes apparaissent continuellement aux côtés des modèles établis. Toute personne qui utilise plusieurs API ou modèles d’IA a donc besoin d’un moyen rapide de comparer les prix pertinents.
C’est précisément pour cela que j’ai créé OpenRouter Price Comparison. L’outil n’affiche pas l’intégralité du catalogue de modèles avec toutes les métadonnées disponibles, mais se concentre sur les modèles que j’utilise réellement. Ma sélection et l’ordre de tri souhaité restent enregistrés dans le navigateur. Ainsi, lors de ma prochaine visite, ma liste comparative personnalisée est immédiatement disponible.
Pourquoi utiliser un comparateur de prix dédié aux LLM ?
OpenRouter donne accès à un grand nombre de modèles de langage différents et fournit des informations détaillées à leur sujet. Toutefois, pour contrôler précisément le prix des modèles que j’utilise régulièrement, le catalogue complet est souvent plus riche que nécessaire au quotidien.
Sur une plateforme complète, je pourrais devoir commencer par me connecter, sélectionner à nouveau les modèles et trier la vue selon mes besoins. Mon comparateur de prix réduit ce processus à l’essentiel :
- aucune connexion requise
- une sélection personnalisée de modèles plutôt que le catalogue complet
- un tri enregistré par nom de modèle, prix d’entrée, prix de sortie ou longueur de contexte
- des prix affichés de manière uniforme en dollars américains par million de tokens
- un accès rapide à des informations supplémentaires sur les modèles
- une mise à jour automatique des données OpenRouter au plus tard après une heure
Il est ainsi possible, par exemple, de vérifier rapidement si le coût d’un modèle a changé avant une tâche de traitement par lots importante, un changement de modèle ou un nouveau projet.
Fonctionnement technique de l’application
L’application est volontairement légère et fonctionne entièrement dans le navigateur. Au démarrage, elle interroge le point de terminaison public des modèles de l’API OpenRouter :
https://openrouter.ai/api/v1/models
L’API renvoie notamment les noms et identifiants des modèles, les longueurs de contexte et les prix par token. Afin de faciliter la comparaison, l’outil convertit les prix pour un million de tokens :
Prix par million de tokens = prix API par token × 1 000 000
Les prix des tokens d’entrée et de sortie sont affichés séparément. C’est important, car les tokens de sortie générés sont nettement plus chers que les tokens d’entrée pour de nombreux modèles. Une comparaison fondée sur un seul prix serait donc peu pertinente.
Sélection personnalisée de modèles avec localStorage
Les identifiants des modèles sélectionnés sont enregistrés dans le localStorage du navigateur. Il en va de même pour la colonne et le sens de tri actifs. L’application peut ainsi reconstituer automatiquement la dernière vue utilisée après un rechargement.
Trois types de données sont enregistrés :
| Type de données | Objectif |
|---|---|
| Identifiants des modèles sélectionnés | Restaure la liste comparative personnalisée |
| Colonne et sens de tri | Conserve la présentation préférée du tableau |
| Catalogue de modèles OpenRouter | Réduit les appels API inutiles et accélère le démarrage |
La sélection est donc liée au navigateur et à l’appareil utilisés. Elle n’est ni synchronisée via un compte utilisateur ni transmise à un serveur distinct. Toute personne qui efface les données de son navigateur ou utilise un autre navigateur repart avec une sélection vide.
Des prix actuels avec un cache d’une heure
Le catalogue de modèles, y compris les informations tarifaires, est mis en cache localement pendant une heure au maximum. Tant que ce cache est valide, la page peut charger les données directement depuis le navigateur. Cela garantit des temps de chargement courts et évite d’envoyer une nouvelle requête à l’API OpenRouter à chaque consultation de la page.
Si le cache date de plus d’une heure, l’application charge le catalogue de modèles actuel. La sélection personnalisée est conservée : les identifiants enregistrés sont associés aux nouvelles données récupérées afin que le tableau affiche ensuite les prix actualisés des modèles sélectionnés.
Si l’API ou la connexion Internet est temporairement indisponible, l’application peut utiliser un cache existant plus ancien. L’état affiché au-dessus du champ de recherche indique si les données ont été mises à jour en direct, chargées depuis le cache ou fournies hors ligne.
Rechercher, sélectionner et trier les modèles
L’interface est conçue autour d’un processus rapide :
- Rechercher un nom ou un identifiant de modèle, par exemple
GPT,ClaudeouGemini. - Sélectionner le modèle approprié dans la liste de suggestions.
- Ajouter d’autres modèles utilisés régulièrement.
- Trier le tableau par nom, prix d’entrée, prix de sortie ou longueur de contexte.
- Si nécessaire, ouvrir la vue détaillée pour consulter la description, la modalité et la longueur de sortie maximale.
Une fois la configuration effectuée, il suffit de revenir sur la page. La sélection et le tri sont chargés depuis le localStorage ; si le cache de données a expiré, l’application récupère automatiquement les données OpenRouter actuelles.
Points à prendre en compte lors de la comparaison des prix
Le prix brut des tokens est un facteur important dans le choix d’un modèle, mais ce n’est pas le seul. Pour évaluer les coûts de manière réaliste, il convient également de prendre en compte les éléments suivants :
- Le rapport entre les tokens d’entrée et de sortie dans votre cas d’usage
- La longueur de contexte nécessaire pour les prompts, les documents ou les historiques de conversation
- La qualité et la fiabilité du modèle pour la tâche concernée
- La vitesse de réponse et les fournisseurs disponibles
- les éventuels coûts supplémentaires, remises ou conditions différentes
Un modèle moins cher peut suffire pour la classification ou l’extraction simple, tandis que des tâches exigeantes de programmation, de raisonnement ou d’analyse peuvent justifier un modèle plus performant. Le comparateur permet de visualiser rapidement l’aspect financier ; il ne remplace pas vos propres tests de performance.
Confidentialité et limites du stockage local
La liste personnalisée de modèles est gérée exclusivement dans le stockage du navigateur. Aucune inscription ni aucun compte utilisateur ne sont nécessaires. Cela réduit la quantité de données personnelles transmises et simplifie l’utilisation de l’outil.
Cependant, le localStorage n’est pas un système de stockage partagé entre plusieurs appareils. La sélection n’est ni synchronisée ni sauvegardée automatiquement et peut être perdue lorsque les données du site sont supprimées. De plus, les informations sur les modèles et les prix proviennent de l’API OpenRouter. Pour la facturation et les calculs de coûts en production, les informations du fournisseur en vigueur au moment concerné font donc toujours foi.
Conclusion
OpenRouter Price Comparison est conçu comme un outil ciblé pour un usage quotidien : il affiche les prix des LLM qui sont réellement pertinents, enregistre localement la sélection et le tri, et actualise régulièrement les données OpenRouter sous-jacentes. Au lieu de parcourir sans cesse un vaste catalogue de modèles, vous disposez ainsi d’une vue comparative personnalisée et permanente, sans connexion.
Il devient alors possible de vérifier rapidement les coûts d’entrée et de sortie de GPT, Claude, Gemini et d’autres modèles OpenRouter avant de sélectionner ou de remplacer un modèle, ou d’accroître son utilisation en production.
Questions fréquentes
Les prix des LLM affichés sont-ils à jour ?
Les données des modèles OpenRouter sont mises en cache dans le navigateur pendant une heure au maximum. Une fois ce délai écoulé, l’application récupère les données actuelles depuis l’API OpenRouter lors du chargement suivant.
Mes modèles sélectionnés sont-ils enregistrés ?
Oui. Les identifiants des modèles ainsi que le tri choisi sont enregistrés dans le localStorage du navigateur. Ils restent disponibles après un rechargement normal ou lors d’une visite ultérieure.
Ai-je besoin d’un compte OpenRouter ?
Non. Aucune connexion n’est requise pour utiliser le comparateur de prix. Les données des modèles sont chargées via le point de terminaison API accessible au public.
Quels prix sont comparés ?
L’outil affiche les prix fournis par OpenRouter pour les tokens d’entrée et de sortie, convertis pour un million de tokens. Le tableau peut également être trié par longueur de contexte et par nom de modèle.
Mes données sont-elles transmises à un serveur distinct ?
Non. La sélection, le tri et le cache restent stockés localement dans le navigateur. Pour récupérer le catalogue de modèles, le navigateur envoie une requête directement à l’API OpenRouter.
Pourquoi la même liste de modèles ne s’affiche-t-elle pas sur un autre appareil ?
Les paramètres sont enregistrés dans le stockage local du navigateur et ne sont pas synchronisés via un compte. Chaque navigateur et chaque appareil possède donc sa propre sélection.