Il crollo dei costi di inferenza dell'IA

Il costo di esecuzione di un modello IA con qualità equivalente a GPT-3.5 è sceso da circa 20 USD per milione di token a fine 2022 a all'incirca 0,07 USD per milione di token entro ottobre 2024 — una riduzione di oltre 280 volte in circa 18 mesi. Un'IA capace è diventata drasticamente più economica da implementare.

20 $/M tokenNov 20220.07 $/M tokenOtt 2024
Costo per interrogare un modello di livello GPT-3.5, USD per milione di token (Stanford AI Index 2025).

Source: Stanford HAI — AI Index 2025: State of AI in 10 Charts (2025)

What it means

Un calo di 280 volte del costo di un'IA capace in meno di due anni è la ragione per cui le applicazioni che erano antieconomiche nel 2023 — analizzare ogni registro di manutenzione, ogni flusso di sensori, ogni immagine di qualità — sono ora accessibili da eseguire in continuo. Per un operatore il messaggio pratico è che la barriera di budget all'applicazione dell'IA in tutte le operazioni è in gran parte scomparsa.

Context

Lo Stanford AI Index traccia il prezzo per raggiungere una soglia di qualità fissa (circa il 64,8% sul benchmark MMLU) anziché il prezzo di un singolo modello con nome. A seconda del compito, il rapporto rileva che i prezzi di inferenza calano da 9 fino a 900 volte all'anno. Poiché la metrica mantiene fissa la qualità mentre hardware e modelli migliorano, cattura guadagni economici autentici anziché un semplice sconto.

Related charts

Related topics

All industrial data & charts →