Naar de inhoud
Terug naar overzicht
AI NieuwsOnderzoekPrijzenModellen

AI wordt elk jaar dertien keer goedkoper, meet Epoch AI

·Door
AI wordt elk jaar dertien keer goedkoper, meet Epoch AI

13x

goedkoper per jaar, voor hetzelfde resultaat

725x

goedkoper in 18 maanden, op GPQA Diamond

54x

sneller dan elektriciteit ooit goedkoper werd

Van 30 cent naar 0,04 cent per vraag

Op 31 januari 2025 bracht OpenAI o3 uit. Volgens Epoch AI haalde dat model 75 procent op GPQA Diamond, een meerkeuzetoets op promotieniveau in natuurkunde, scheikunde en biologie, voor gemiddeld 30 cent per vraag. Net geen anderhalf jaar later haalde GPT-5.6 Luna dezelfde score voor 0,04 cent per vraag (Epoch AI).

Epoch rekent die daling om naar een auto: de nieuwprijs zou in anderhalf jaar van $50.000 naar $69 zakken.

Dat ene voorbeeld is het uiterste. Over vijf toetsen in wiskunde, wetenschap en puzzels komt Epoch uit op 47 procent daling per kwartaal sinds 2023. Wiskunde gaat het hardst, met 50 tot 52 procent per kwartaal. Spelpuzzels het langzaamst, met 39 tot 43 procent.

"AI has gotten cheaper more quickly than any other transformative technology in history."

— Luke Emberson, onderzoeker bij Epoch AI, en gastauteur David Roodman (Epoch AI)

Sneller dan stroom, chips, accu's en DNA-sequencing

Epoch zet de AI-lijn naast vier technologieën die de economie eerder omgooiden. Per jaar, gecorrigeerd voor inflatie:

TechnologiePeriodeGoedkoper per jaarAI gaat zoveel keer sneller
AI, vast prestatieniveau2023 tot 202613x
DNA-sequencing2001 tot 20251,84x4x
Rekenkracht1940 tot 20011,51x6x
Lithium-accu's1991 tot 20241,16x18x
Elektriciteit (VS, thuis)1892 tot 19731,05x54x
Lijngrafiek van relatieve kosten op een logaritmische schaal tegen het aantal jaren sinds het begin van de prijsdaling, voor AI (2021 tot 2026), DNA-sequencing (2001 tot 2022), lithium-accu's (1991 tot 2024), rekenkracht (1940 tot 2001) en elektriciteit (1892 tot 1973). De AI-lijn daalt veel steiler dan alle andere.
Grafiek: Epoch AI (CC-BY)

Rekenkracht werd in zestig jaar vele miljarden keren goedkoper. De AI-lijn in de grafiek beslaat nog maar vijf jaar. Het tempo is steiler dan ooit, maar de periode is kort.

Nieuw kost een premie

Een prestatie die net voor het eerst gehaald wordt, wordt 66 procent per kwartaal goedkoper, zo'n 75 keer per jaar. Twee jaar later daalt dezelfde prestatie nog maar 32 procent per kwartaal, of 4,7 keer per jaar.

Epoch verklaart dat met een premie. Wie iets als eerste kan, vraagt er een tijd lang veel geld voor. Daarna volgen concurrenten met kleinere en goedkopere modellen, en zakt de prijs hard. Zo ging het in juni ook, toen MiniMax M3 voor zo'n vijftig dollarcent per miljoen tokens in de topklasse meedraaide.

Lijngrafiek van de kosten per taak op een logaritmische schaal tegen de releasedatum van AI-modellen, van eind 2023 tot medio 2026. Per toets (GPQA Diamond, AIME, schaakpuzzels en FrontierMath) volgt een lijn het goedkoopste model dat 25 of 75 procent haalt. Elke lijn daalt in ongeveer twee jaar met een factor tien tot duizend.
Grafiek: Epoch AI (CC-BY)

De rekening per taak daalt trager

Wie hieruit concludeert dat de AI-rekening van een organisatie elk jaar met een factor dertien krimpt, leest het rapport verkeerd. De onderzoekers zeggen dat zelf ook.

Ten eerste meten ze het goedkoopste model dat een bepaalde score haalt. Gebruikers volgen die grens niet: "real users do not switch models so often". Ten tweede zijn benchmarks een gebrekkige maat voor nuttig werk, en trainen labs soms gericht op de toets. Ten derde gaat het om drie jaar data. Afhankelijk van hoe je middelt, komt de daling uit tussen 43 en 58 procent per kwartaal. Epoch noemt de uitkomst zelf "reasonable but rough".

Onderzoekers van MIT kwamen vorig jaar op een vergelijkbaar maar voorzichtiger getal. Zij zagen de prijs per prestatieniveau 5 tot 10 keer per jaar dalen. Slechts een factor 3 daarvan kwam uit slimmere algoritmes, de rest uit goedkopere hardware en concurrentie. En de prijs om het beste model te draaien stijgt volgens hen juist, met 3 tot 18 keer per jaar, door grotere modellen en langer nadenken (arXiv).

Die stijging zagen we deze maand twee keer. Fable 5.1 werd goedkoper per token en duurder per taak, omdat het model meer schreef. En Opus 5.5 gebruikt op de hoogste stand zo'n 119.000 uitvoertokens per taak, tegen 27.000 bij GPT-6 Astra.

Voor mij is dat verschil nuttiger dan het record: de prijs van een vast niveau stort in, wie steeds het nieuwste niveau wil betaalt de premie. Bij de organisaties waar ik kom, draait het meeste werk op een niveau dat een jaar geleden de top was. Dat niveau heeft de steilste prijsval, die van het eerste jaar, al achter de rug.


Volgende Stap

Welk model een taak krijgt en wat dat per afgeronde taak kost, verschilt per proces. Dat rekenwerk doen we graag samen met je, onafhankelijk van welk lab je kiest.

→ Plan een AI Strategie Sessie.


Bronnen: Epoch AI (data en code op GitHub), Gundlach e.a., MIT en The Decoder. Headerbeeld en grafieken: Epoch AI (CC-BY).

Hoe AI-ready is jouw organisatie?

Doe de gratis AI-Readiness Scan: 9 vragen, 2 minuten, direct een persoonlijk advies.