Der Einbruch der Kosten für KI-Inferenz

Die Kosten für den Betrieb eines KI-Modells in einer Qualität entsprechend GPT-3.5 fielen von etwa 20 USD je Million Tokens Ende 2022 auf rund 0,07 USD je Million Tokens bis Oktober 2024 – eine mehr als 280-fache Reduktion in etwa 18 Monaten. Leistungsfähige KI ist im Einsatz dramatisch günstiger geworden.

20 $/M tokensNov. 20220.07 $/M tokensOkt. 2024
Kosten für eine Abfrage an ein Modell auf GPT-3.5-Niveau, USD je Million Tokens (Stanford AI Index 2025).

Source: Stanford HAI — AI Index 2025: State of AI in 10 Charts (2025)

What it means

Ein 280-facher Rückgang der Kosten leistungsfähiger KI in weniger als zwei Jahren ist der Grund, warum Anwendungen, die 2023 unwirtschaftlich waren – die Analyse jedes Instandhaltungsprotokolls, jedes Sensorstroms, jedes Qualitätsbildes –, nun erschwinglich im Dauerbetrieb laufen. Für einen Betreiber lautet die praktische Botschaft, dass die Budgetbarriere für den Einsatz von KI im gesamten Betrieb weitgehend verschwunden ist.

Context

Der Stanford AI Index erfasst den Preis für das Erreichen einer festen Qualitätsschwelle (etwa 64,8 % im MMLU-Benchmark) statt den Preis eines einzelnen benannten Modells. Je nach Aufgabe stellt der Bericht fest, dass die Inferenzpreise um das 9- bis 900-Fache pro Jahr fallen. Da die Kennzahl die Qualität konstant hält, während sich Hardware und Modelle verbessern, erfasst sie echte wirtschaftliche Gewinne statt bloßer Preisnachlässe.

Related charts

Related topics

All industrial data & charts →