Confrontare i prezzi degli LLM: i costi dei miei modelli a colpo d'occhio

I prezzi dei Large Language Model cambiano regolarmente. Allo stesso tempo, i costi variano notevolmente a seconda del modello: i token di input e output vengono calcolati separatamente, le finestre di contesto hanno dimensioni diverse e accanto ai modelli consolidati compaiono continuamente nuove varianti. Chi utilizza più API o modelli AI ha quindi bisogno di un modo rapido per confrontare i prezzi rilevanti.

È proprio per questo che ho creato OpenRouter Price Comparison. Lo strumento non mostra l’intero catalogo dei modelli con tutti i metadati disponibili, ma si concentra sui modelli che utilizzo realmente. La mia selezione e l’ordinamento desiderato restano salvati nel browser. Alla visita successiva, il mio elenco di confronto personale è quindi subito di nuovo disponibile.

Perché creare un confronto dei prezzi degli LLM?

OpenRouter offre accesso a un gran numero di modelli linguistici diversi e mette a disposizione informazioni dettagliate al loro riguardo. Tuttavia, per controllare in modo mirato i prezzi dei modelli che utilizzo regolarmente, il catalogo completo spesso contiene più informazioni di quante me ne servano ogni giorno.

In una piattaforma più articolata potrei dover prima effettuare l’accesso, selezionare nuovamente i modelli e ordinare la vista nel modo desiderato. Il mio confronto dei prezzi riduce questo processo all’essenziale:

  • nessun accesso richiesto
  • selezione personale dei modelli anziché catalogo completo
  • ordinamento salvato per nome del modello, prezzo di input, prezzo di output o lunghezza del contesto
  • prezzi espressi in modo uniforme in dollari statunitensi per milione di token
  • accesso rapido a ulteriori dettagli sui modelli
  • aggiornamento automatico dei dati OpenRouter entro un’ora al massimo

Prima di un batch job di grandi dimensioni, di un cambio di modello o di un nuovo progetto, è così possibile verificare rapidamente se i costi di un modello utilizzato sono cambiati.

Come funziona tecnicamente l’applicazione

L’applicazione è volutamente leggera e funziona interamente nel browser. All’avvio interroga l’endpoint pubblico dei modelli dell’API di OpenRouter:

https://openrouter.ai/api/v1/models

L’API fornisce, tra le altre informazioni, nomi e ID dei modelli, lunghezze del contesto e prezzi per token. Per rendere più semplice il confronto, lo strumento converte i prezzi su un milione di token:

Prezzo per 1 milione di token = Prezzo API per token × 1.000.000

I prezzi di input e output vengono mostrati separatamente. È importante perché, per molti modelli, i token di output generati costano molto più dei token di input. Un confronto basato su un unico prezzo sarebbe quindi poco significativo.

Selezione personale dei modelli con localStorage

Gli ID dei modelli selezionati vengono salvati nel localStorage del browser. Lo stesso vale per la colonna di ordinamento attiva e per la direzione dell’ordinamento. In questo modo, dopo aver ricaricato la pagina, l’applicazione ricostruisce automaticamente l’ultima vista utilizzata.

Vengono salvati tre tipi di dati:

Tipo di datiScopo
ID dei modelli selezionatiRipristina l’elenco di confronto personale
Colonna e direzione dell’ordinamentoMantiene la vista preferita della tabella
Catalogo dei modelli OpenRouterRiduce le chiamate API non necessarie e velocizza l’avvio

La selezione è quindi legata al browser e al dispositivo utilizzati. Non viene sincronizzata tramite un account utente né trasmessa a un server proprietario. Chi elimina i dati del browser o ne utilizza un altro riparte con una selezione vuota.

Prezzi aggiornati con una cache di un’ora

Il catalogo dei modelli, compresi i prezzi, viene memorizzato localmente nella cache per un massimo di un’ora. Finché la cache è valida, la pagina può caricare i dati direttamente dal browser. Questo garantisce tempi di caricamento brevi ed evita una nuova richiesta all’API di OpenRouter a ogni apertura della pagina.

Se la cache risale a più di un’ora prima, l’applicazione carica il catalogo dei modelli aggiornato. La selezione personale viene mantenuta: gli ID salvati vengono associati ai dati dei modelli appena recuperati, così la tabella mostra poi i prezzi aggiornati dei modelli selezionati.

Se l’API o la connessione Internet sono temporaneamente indisponibili, l’applicazione può utilizzare una cache precedente già presente. Lo stato sopra il campo di ricerca indica se i dati sono stati aggiornati in tempo reale, caricati dalla cache o forniti offline.

Cercare, selezionare e ordinare i modelli

L’utilizzo è pensato per un flusso di lavoro breve:

  1. Cercare il nome o l’ID di un modello, ad esempio GPT, Claude o Gemini.
  2. Selezionare il modello appropriato dall’elenco dei suggerimenti.
  3. Aggiungere altri modelli utilizzati regolarmente.
  4. Ordinare la tabella per nome, prezzo di input, prezzo di output o lunghezza del contesto.
  5. Se necessario, aprire la vista dettagliata per consultare descrizione, modalità e lunghezza massima dell’output.

Una volta completata la configurazione, in seguito basta riaprire la pagina. La selezione e l’ordinamento vengono caricati dal localStorage; se la cache dei dati è scaduta, l’applicazione recupera automaticamente dati OpenRouter aggiornati.

Che cosa considerare nel confronto dei prezzi

Il semplice prezzo dei token è un fattore importante, ma non è l’unico nella scelta di un modello. Per valutare i costi in modo realistico, occorre considerare anche i seguenti aspetti:

  • Il rapporto tra token di input e output nel proprio caso d’uso
  • La lunghezza del contesto necessaria per prompt, documenti o cronologie delle conversazioni
  • La qualità e l’affidabilità del modello per l’attività specifica
  • La velocità di risposta e i provider disponibili
  • eventuali costi aggiuntivi, sconti o condizioni differenti

Un modello più economico può essere sufficiente per la classificazione o una semplice estrazione, mentre attività complesse di coding, reasoning o analisi possono giustificare un modello più potente. Il confronto dei prezzi aiuta a rendere rapidamente visibile l’aspetto economico, ma non sostituisce un benchmark specifico.

Privacy e limiti dell’archiviazione locale

L’elenco personale dei modelli viene gestito esclusivamente tramite l’archiviazione del browser. Non sono necessari né registrazione né account utente. Questo riduce i dati personali trasmessi e rende l’utilizzo più semplice.

Tuttavia, localStorage non è un sistema di archiviazione condiviso tra dispositivi. La selezione non viene sincronizzata né sottoposta a backup e può andare persa quando si eliminano i dati del sito web. Inoltre, le informazioni e i prezzi dei modelli provengono dall’API di OpenRouter. Per la fatturazione e i calcoli in produzione fanno quindi sempre fede le informazioni del provider valide in quel momento.

Conclusione

OpenRouter Price Comparison è pensato come uno strumento mirato per l’uso quotidiano: mostra i prezzi esattamente degli LLM rilevanti al momento, salva localmente la selezione e l’ordinamento e aggiorna regolarmente i dati OpenRouter sottostanti. Invece di consultare ripetutamente un vasto catalogo di modelli, offre una vista di confronto personale permanente senza login.

Consente così di verificare rapidamente i costi di input e output di GPT, Claude, Gemini e altri modelli OpenRouter prima di scegliere o sostituire un modello oppure di aumentarne l’utilizzo in produzione.

Domande frequenti

Quanto sono aggiornati i prezzi degli LLM mostrati?

I dati dei modelli OpenRouter vengono memorizzati nella cache del browser per un massimo di un’ora. Trascorso questo periodo, al caricamento successivo l’applicazione recupera dati aggiornati dall’API di OpenRouter.

I modelli che ho selezionato vengono salvati?

Sì. Gli ID dei modelli e l’ordinamento scelto vengono salvati nel localStorage del browser. Restano disponibili dopo un normale aggiornamento della pagina o una visita successiva.

Ho bisogno di un account OpenRouter?

No. Per utilizzare il confronto dei prezzi non è necessario effettuare l’accesso. I dati dei modelli vengono caricati tramite l’endpoint API accessibile pubblicamente.

Quali prezzi vengono confrontati?

Lo strumento mostra i prezzi forniti da OpenRouter per i token di input e output, convertiti su un milione di token. È inoltre possibile ordinare per lunghezza del contesto e nome del modello.

I miei dati vengono trasmessi a un server proprietario?

No. Selezione, ordinamento e cache rimangono in locale nel browser. Per recuperare il catalogo dei modelli, il browser invia una richiesta diretta all’API di OpenRouter.

Perché su un altro dispositivo non vedo lo stesso elenco di modelli?

Le impostazioni si trovano nell’archiviazione locale del browser e non vengono sincronizzate tramite un account. Per questo ogni browser e ogni dispositivo hanno una propria selezione.