AI coding agent: van flat-rate naar consumption pricing

Samenvatting

De AI coding agent markt onderging een structurele prijsherziening. GitHub Copilot schakelde op 1 juni 2026 naar consumption-based AI Credits. Devin liep hiervan voorop. Het essentiële signal: kostenrisico's van agent-autonomie verplaatsen zich van vendor naar buyer across de hele categorie.

Desk van software engineer 's nachts met monitors die blurred code review interface tonen

De AI coding agent markt repriced zichzelf in de loop van een enkel kwartaal. GitHub Copilot verliet op 1 juni 2026 zijn flat per-seat abonnement voor usage-based billing. Devin factureerde al op compute units. Cursor verhandelt reportedly op een $50B waardering terwijl ruwweg $2B annualized revenue draait. Het signaal is niet welke vendor "wint." Het is dat de gehele verticaal zojuist de autonomiekosten van de vendor naar de buyer verplaatste.

Wat veranderde op 1 juni 2026 voor GitHub Copilot

Voor het grootste deel van Copilot's bestaan was het model eenvoudig: betaal een vaste maandelijkse fee per developer, gebruik het zoveel je wilt. Op 1 juni 2026 schakelde GitHub alle plannen over naar usage-based billing via AI Credits: Pro bevat $15 per maand in credits, Pro+ bevat $70, Max bevat $200. Premium modelaanroepen trekken het budget op. Het TechCrunch-artikel over de reactie, met een quote van een developer die de wijziging "a joke" noemde, vat de gemoedstoestand beter samen dan enig persbericht.

De mechanica weegt zwaarder dan de weerstand. Een flat seat is een budgetteringsinstrument: één getal, geen verrassingen, vendor draagt het risico dat sommige gebruikers het product nauwelijks aanraken terwijl anderen het dagelijks gebruiken. Usage-based pricing draait dat om. De buyer draagt nu de kosten van elke planningstap, elke sub-agent delegatie, elke retry op een gefaalde test. Devin prijsde het zo van dag één, met ACU (Agent Compute Unit) in plaats van een seat. Copilot voegt zich daar nu bij.

Geen van de vier major players verkoopt nog steeds een echte unlimited flat seat voor agent werk. Dat is het eigenlijke nieuws. De vergelijkingstabel is afleidend van het structurele punt: niemand subsidieert meer het gebruik van je zwaarste engineer.

De reden is structureel, niet competitief. Oudere AI assistants boden single-line autocomplete: kleine context in, klein voorstel uit, goedkoop te serveren op schaal. Moderne coding agents lezen grote delen van een codebase, behouden lange context windows, plannen over meerdere stappen, en roepen tools herhaaldelijk aan, soms gedurende minuten per taak. Elke stap verbruikt tokens, en hoe autonomer de agent, hoe meer tokens per gedelegeerde werkunit. Een vendor die een flat seat handhaudt bovenop die kostencurve subsidieert zware gebruikers uit eigen marge of is nog niet geschaald tot die subsidie pijnlijk wordt. Gartner's guidance voor enterprise buyers beschouwt een consumption-cost model gebaseerd op daadwerkelijk gebruik van de afgelopen 90 dagen nu als verplichte stap voor agent contract renewals.

De waarderingsgap die revenue niet verklaart

Zet de getallen naast elkaar en het beeld wordt vreemder voordat het helderder wordt. Cursor's parent Anysphere sloot een $2.3B Series D op $29.3B waardering in november 2025 en verhandelde reportedly rond $50B in april 2026, ondersteund door ruwweg $2B annualized revenue. Cognition fundraisde voorbij $1B op $26B waardering. Replit verdrievoudigde zijn eigen waardering van $3B naar $9B in maart 2026.

Absolute revenue verklaart onderdeel van de gap: Cursor's run rate is bijna vier keer Cognition's. Het verklaart niet alles. Cognition's ARR verplaatste van $73M annualized mid-2025 naar ruwweg $492M mid-2026, een delta die zelfs Cursor's groeipercentage overstijgt in dezelfde periode ondanks kleinere basis. Replit's ARR verplaatste van $2.8M naar over $150M voordat het rond $240M stabiliseerde, nu gericht op $1B tegen jaareinde. Lees die twee getallen naast elkaar en het verhaal is niet "wie is het grootst." Het is "wiens delta groeit sneller hiervandaan."

Close-up van handen die op een toetsenbord typen met een wazig terminalvenster op de achtergrond

Dat onderscheid is degene die werkelijk zou moeten informeren hoe een operator deze verticaal underwrites, of de lens nu competitive audit, partnership decision of build-versus-buy call is. Augment en Poolside, twee andere goed gefinancierde entrants in dezelfde categorie, publiceerden geen revenue figures die tegen de drie leiders hierboven opwegen, wat op zichzelf een signaal is: in een verticaal die zo goed gefinancierd is, stilte over ARR betekent meestal het getal is nog niet klaar voor vergelijking, niet dat het niet bestaat.

Devin prijsde compute in voordat iemand anders dat hoefde

Cognition bouwde Devin's pricing rond Agent Compute Units vanaf het begin, wat achteraf minder als prijsquirk en meer als vroeg inzicht in waar de hele categorie naartoe ging. Het Team-plan draait ruwweg $500 per seat per maand, geen per-user cap op wie het gedeelde budget kan gebruiken, en extra ACU's bovenop als een job langer duurt.

Wat die prijs koopt is smal bij ontwerp: PR review, code migrations, issue triage, scheduled maintenance, niet open-ended research of slide generation. Cognition rapporteert Devin kan een specifieke codebase's conventions leren over herhaalde sessions in plaats van koud starten, en dat enterprise usage ruwweg 50% maand-over-maand groeide gedurende zes opeenvolgende maanden voordat ARR de $492M grens passeerde. De $500/seat floor plaatst het buiten bereik van solo developers. Het is gebouwd voor engineering orgs die al een migration backlog kunnen aanwijzen en er een dollarbedrag op kunnen plakken voor handmatige clearing.

Replit's wedbeschrijving op consumptieprijs op consumentenschaal

Replit nam het tegengestelde ingangspunt op dezelfde onderliggende verschuiving. Replit Agent zit binnen Replit Core op $25 per maand, ruwweg 5% van Devin's listprijs, en scaffoldt een full-stack app, wires een database, en deployt het vanuit natural-language prompt zonder lokale setup.

De vangst is dezelfde computer economics iedereen navigeert: een subscriber die Agent 3 op maximale autonomie voor lange session runt kan $5 tot $15 credits in één workflow verbranden, omdat de agent sandboxed environments spint en premium frontier models op elke stap roept. Replit's wedbeschrijving is niet dat usage-based billing verdwijnt. Het is dat entry price vriendelijk voor consumer plus transparante credit consumptie een veel grotere top of funnel converteert dan enterprise-only sales motion, en de ARR trajectory (50+ miljoen registered users, stated $1B ARR target voor jaareinde 2026) is het bewijs die wedbeschrijving uitbetaalt.

Engineering team die een dashboard op een grote monitor in daylight kantooral review

Wat Manus's acquisitie signaleert over de breder agent economie

Niet elke agent die van belang was voor deze categorie verscheepte als standalone coding tool. Manus werkte als volledig autonome general-purpose agent, draaiend binnen eigen virtual browser, terminal, en file system om multi-step tasks end-to-end te plannen en uit te voeren. Meta verkreeg de startup erachter in 2026, vouwde een credible autonomous-agent product in veel groter balance sheet in plaats van het laten blijven raising en scaling onafhankelijk.

Dat outcome loont het volgen naast pure-play coding agents omdat het een tweede, onderscheidend exit pattern in dezelfde breder categorie is: in plaats van $9B of $26B onafhankelijke waardering, buyer koopt het vermogen outright. Voor iedereen die mapt welke AI coding agent en general-agent startups structureel duurzaam zijn versus acquisition targets, M&A exit van goed gefinancierde general agent is datapoint die in hetzelfde model hoort als funding rounds.

Het open-source tegenargument: wat Suna bewijst over het token math

Suna, gebouwd door Kortix, draait dezelfde taakcategorie (browser, shell, file system, multi-step execution) als open-source, self-hostable project met ruwweg 20.000 GitHub stars, vaak aangehaald als dichtste open-source antwoord op Manus. Core software is free. Real cost verplaatst volledig naar compute plus welk model API je connects, dezelfde usage-based math elke proprietary vendor net adopteerde, minus vendor's marge erop.

Data center server corridor met rijen racks lit door blauwe en groene status lights

De tradeoff is expliciet in plaats van verborgen achter pricing page: je bezit uptime, security patching, en prompt-engineering effort zelf, in ruil voor volledige inspectie van wat de agent eigenlijk doet en geen verplicht abonnement. Voor platform team dat al eigen model infrastructure draait, kan die math $500 per seat verslaan. Voor meeste teams is de setup cost precies waarom de hosted vendors nog steeds een business hebben.

Wat de human-in-the-loop pushback procurement teams vertelt

Cognition's eigen CEO, Scott Wu, betoogde publiekelijk dat AI coding agents geen menselijke engineers moeten vervangen, notable voorzichtige positie van degene die de agent verkoopt. Dezelfde week rapporteerde TechCrunch de tegengestelde druk van andere kant: sommige developers weigeren nu zonder AI tools te werken, afhankelijkheid het outlet flagde als risico op zichzelf.

Gelezen naast de billing shift, zijn die twee datapoints geen filosofisch debat. Ze zijn operationeel. Usage-based pricing betekent team cost die hard op agentic execution leunt is nu variabel en zichtbaar op de invoice, niet fixed en buried in headcount. CTO die "hoeveel moeten we delegeren naar agent" als productivity vraag behandelt zonder als budget vraag is gaat verrast zijn door de token line dezelfde manier GitHub Copilot's user base was verrast in juni.

Moet u een seat-based contract ondertekenen voordat u renew?

Overslaan als vendor het nog toestaat. Flat seat is het laatste artefact van economics regime de gehele verticaal net verliet. Vraag vendor te modelleren uw daadwerkelijke gebruik van afgelopen 90 dagen onder hun consumption pricing voordat u iets nieuws ondertekent, de manier procurement guidance van Gartner en anderen nu over deze categorie aanbevelen.

Lock in waard als u vendor's kleinste, lichtste user bent: zware discounts op legacy seat contracts bestaan nog als retention tactic, en light-usage team kan echte waarde extraheren uit exception sales rep niet wil verliezen. Voor iedereen anders, delta te volgen is niet sticker price op pricing page. Het is de gap tussen wat team werkelijk verbruikt en wat contract aanneemt u zal. Signals, niet narratives, is enig correcte manier die gap te underwrite.

Veelgestelde vragen

Waarom schakelde GitHub Copilot op 1 juni 2026 naar usage-based billing?
Modern coding agents lezen grote codebase delen, behouden lange context windows, plannen over meerdere stappen, en roepen tools herhaaldelijk aan. Dit verbruikt significant meer tokens dan oudere single-line autocomplete assistants. Vendors kunnen deze hogere compute kosten niet meer subsidieert op flat-rate modellen.
Welke AI coding agents gebruiken nu consumption-based pricing?
GitHub Copilot (AI Credits sinds juni 2026), Devin (ACU sinds launch), Cursor (usage-based met included pool), en Replit Agent (credits met overage) voeren allen consumption-based models in.
Hoe erkent Gartner procurement teams om agent contracts te evalueren?
Gartner adviseert teams om daadwerkelijk gebruik van afgelopen 90 dagen te modelleren onder vendor's consumption pricing voordat nieuwe agent contracts ondertekend.
Wat is Suna en waarom het relevant?
Suna is open-source self-hostable agent (20k GitHub stars) dat dezelfde taken als proprietary agents kan, maar zonder vendor margin. De koststructuur verplaatst volledig naar compute plus model API gebruik.
Waarom overweegt Cognition's CEO dat agents geen menselijke engineers moeten vervangen?
Terwijl revenue scenery gebruikers reports sommige developers nu zonder AI tools weigeren te werken. Beide datapoints signals operationele realiteit: compute cost is nu visible op invoices, teams moeten delegatie als budget vraag, niet alleen productivity vraag, behandelen.