AI-ECONOMIE
FIELD NOTE 07 / 15De krachtigste AI-modellen zijn niet goedkoop. Goedkope demo's wel.
Een paar cent kan een indrukwekkend antwoord opleveren. Een betrouwbaar revenue system heeft mogelijk lange context, redenering, informatieopvraging, tools, nieuwe pogingen, evaluatie en menselijke aandacht nodig. De demoprijs is niet de operationele kostprijs.
Meet de kosten van nuttig werk, niet de prijs van één modelantwoord.
DEEL DEZE FIELD NOTE
Geef het nuttige signaal door.
Het goedkoopste AI-systeem is het systeem dat maar één keer hoeft te werken.
Een heldere prompt gaat erin. Een verzorgd antwoord komt eruit. Iemand controleert het gebruiksdashboard en ontdekt dat de modelaanroep minder kostte dan de lunch. De conclusie schrijft zichzelf: intelligentie is nu bijna gratis.
Wat het bonnetje niet laat zien, is hoe zorgvuldig de demonstratie was voorbereid. Het bronmateriaal was geselecteerd, de taak was gunstig, een mens beoordeelde de output en de lastige pogingen verdwenen vóór de vergadering. Eén geslaagd antwoord wordt geprijsd alsof het een productiesysteem is.
Echt commercieel werk komt niet binnen als één helder verzoek. Het komt als onvolledige CRM-records, tegenstrijdig klantbewijs, dubbelzinnige bedrijfsnamen, veranderend aanbod, rechten, uitzonderingen en deadlines. Het systeem moet meer doen dan genereren. Het moet vinden, interpreteren, beslissen, handelen en laten zien waarom het werk te vertrouwen is.
Een goedkoop antwoord en een goedkoop systeem zijn niet hetzelfde.
Het model leest de context opnieuw, telkens wanneer het systeem nadenkt.
Modelprijzen worden meestal gepresenteerd als een tarief per eenheid input en output. Dat laat de rekensom prachtig klein lijken. Maar een agentisch systeem kan lange instructies lezen, bedrijfscontext ophalen, een tool aanroepen, het resultaat bekijken, zijn plan herzien en opnieuw proberen. Elke ronde voegt werk toe. Langere context en diepere redenering kunnen van één bedrijfstaak veel modelaanroepen maken in plaats van één.
Dan komen de omliggende diensten op de rekening: zoeken, verrijking, informatieopvraging, transcriptie, beeldgeneratie, gegevensverplaatsing, opslag en de software die alles coördineert. Een mislukte toolaanroep kan herstel vereisen. Een onzeker antwoord kan een tweede model of menselijke beoordeling nodig hebben. Een actie met grote gevolgen kan beide nodig hebben.
Niets hiervan maakt geavanceerde intelligentie onrendabel. Het betekent dat de gekochte eenheid geen token is. De nuttige eenheid is een succesvol afgeronde taak met een acceptabel niveau van kwaliteit, snelheid en risico.
- Context die in elke modelronde wordt verwerkt.
- Redenering, nieuwe pogingen en alternatieve routes.
- Informatieopvraging, zoeken en toolaanroepen bij derden.
- Evaluatie, beoordeling en uitzonderingsafhandeling.
- Bewaking, onderhoud en verbetering na de lancering.
Het goedkoopste model kan het duurste resultaat opleveren.
Een kleiner model dat minder kost per aanroep kan meer pogingen, uitgebreidere instructies en meer menselijke correctie nodig hebben. Als het een koopsignaal mist, een klantclaim verzint of een account verkeerd toewijst, is de modelbesparing onbelangrijk naast het commerciële gevolg.
De omgekeerde fout is het sterkste model voor elke stap gebruiken. Een geavanceerd model hoort geen veld te classificeren dat een regel kan valideren, of tekst te herschrijven die een kleiner model betrouwbaar verwerkt. Het vermogen moet passen bij de gevolgen. Gebruik gewone software voor vaste regels, voordelige modellen voor afgebakend werk en de krachtigste modellen waar moeilijke interpretatie het resultaat verandert.
Dit is modelroutering als zakelijke beslissing. De vraag is niet: ‘Welk model is het goedkoopst?’ Het is: ‘Wat is het goedkoopste systeem dat dit soort werk betrouwbaar afrondt?’
Bereken de kosten van het pad naar geaccepteerd werk.
Een bruikbaar kostenmodel volgt de taak van vraag tot acceptatie. Het omvat wat er gebeurt wanneer de eerste poging zwak is, het geval ongewoon is of het systeem moet leren. Zo wordt een onvoorspelbare technologierekening een operationele vraag die het bedrijf kan beheren.
Vraag → Uitvoeren → Verifiëren → Herstellen → Verbeteren
- 01Vraag
Schat het echte taakvolume, piekgebruik, de contextomvang en de mix van gewone en moeilijke gevallen.
- 02Uitvoeren
Tel per route modelrondes, redenering, informatieopvraging, toolaanroepen, gegevensverwerking en andere gebruikte diensten.
- 03Controleren
Neem geautomatiseerde evaluatie, steekproeven, goedkeuringen en de menselijke aandacht voor acceptatie mee.
- 04Herstellen
Bereken de kosten van nieuwe pogingen, terugvalopties, mislukte acties, escalaties en het corrigeren van wezenlijke fouten.
- 05Verbeteren
Financier bewaking, contextupdates, tests en systeemwijzigingen terwijl het bedrijf en de modellen zich ontwikkelen.
Zodra de volledige kosten zichtbaar zijn, heeft de waardeclaim een even eerlijke causale keten nodig.
Als €100 aan AI je €1 miljoen omzet oplevert, ren dan weg.Begroot het resultaat voordat je de tokenrekening optimaliseert.
Kies één terugkerende commerciële taak en bepaal de huidige kosten, kwaliteit, doorlooptijd en foutfrequentie. Laat vervolgens representatieve gevallen door het voorgestelde systeem lopen. Neem eenvoudig werk, rommelig werk en uitzonderingen met commercieel risico mee. Deel de volledige operationele kosten door het aantal resultaten dat het team werkelijk zou accepteren en gebruiken.
Optimaliseer pas daarna. Cache herhaalde context. Leid eenvoudigere stappen naar kleinere modellen. Vervang interpretatie door regels waar het antwoord vaststaat. Verminder onnodige rondes. Verbeter het bewijs zodat het systeem geen geld besteedt aan redeneren rond ontbrekende informatie.
De krachtigste modellen kunnen buitengewone meerwaarde creëren. Doen alsof ze gratis zijn, maakt die meerwaarde moeilijker te beheren, te prijzen en te vertrouwen. Serieuze kopers hebben niet de laagste demokosten nodig. Ze hebben eerlijke economische cijfers nodig voor nuttig werk op schaal.
Vraag niet wat het antwoord kostte. Vraag wat het kostte om werk te produceren dat het bedrijf kon gebruiken.
Bewijs en verder lezen.
Actuele prijzen voor modellen, tokens, tools en verwerking die tonen hoe keuzes rond mogelijkheden, context en diensten de gebruikskosten beïnvloeden.
02Modelprijzen van AnthropicPrijsinformatie voor modelinput, output, caching, batchverwerking en andere gebruikspatronen.
03OpenAI: een scorekaart voor het AI-tijdperkEen pleidooi voor het meten van kosten per geslaagde taak, betrouwbaarheid en waarde in plaats van alleen kosten per token.