Der Einbruch der Kosten für KI-Inferenz
Die Kosten für den Betrieb eines KI-Modells in einer Qualität entsprechend GPT-3.5 fielen von etwa 20 USD je Million Tokens Ende 2022 auf rund 0,07 USD je Million Tokens bis Oktober 2024 – eine mehr als 280-fache Reduktion in etwa 18 Monaten. Leistungsfähige KI ist im Einsatz dramatisch günstiger geworden.
Quelle: Stanford HAI — AI Index 2025: State of AI in 10 Charts (2025)
Was die Daten bedeuten
Ein 280-facher Rückgang der Kosten leistungsfähiger KI in weniger als zwei Jahren ist der Grund, warum Anwendungen, die 2023 unwirtschaftlich waren – die Analyse jedes Instandhaltungsprotokolls, jedes Sensorstroms, jedes Qualitätsbildes –, nun erschwinglich im Dauerbetrieb laufen. Für einen Betreiber lautet die praktische Botschaft, dass die Budgetbarriere für den Einsatz von KI im gesamten Betrieb weitgehend verschwunden ist.
Kontext
Der Stanford AI Index erfasst den Preis für das Erreichen einer festen Qualitätsschwelle (etwa 64,8 % im MMLU-Benchmark) statt den Preis eines einzelnen benannten Modells. Je nach Aufgabe stellt der Bericht fest, dass die Inferenzpreise um das 9- bis 900-Fache pro Jahr fallen. Da die Kennzahl die Qualität konstant hält, während sich Hardware und Modelle verbessern, erfasst sie echte wirtschaftliche Gewinne statt bloßer Preisnachlässe.
Verwandte Diagramme
Wie verbreitet KI in der Fertigung eingeführt ist
Installationen von Industrierobotern weltweit
Roboterdichte in der Fertigung
Verwandte Themen
Generative AI in Manufacturing: Practical Examples · AI Agents for Industrial Maintenance: What They Are and Where They Help · Large Language Model (LLM) · Generative AI · Machine Learning (Industrial)
Relevant für: Chemicals · Food Processing · Pharmaceuticals