Agenti di coding IA: il ribilanciamento del pricing

Riassunto

Il mercato degli agenti di coding IA si è riprezzato in un solo trimestre. Tutti i principali vendor hanno spostato il costo del calcolo dal loro bilancio al buyer. GitHub Copilot ha adottato il modello usage-based nel giugno 2026, seguendo la strada già tracciata da Devin. Il vero segnale non è chi sta vincendo, ma che l'intero verticale ha riposizionato i rischi di costo. Come deve cambiare il modello di procurement.

Postazione di lavoro di software engineer di notte con monitor che mostrano interfaccia di code review sfuocata

Un agente di coding IA costa ora in base al consumo. Il 1° giugno 2026, GitHub Copilot ha abbandonato l'abbonamento flat per billing basato su AI Credits: Pro include $15 mensili, Pro+ include $70, Max include $200. Devin ha già prezzato per compute unit dal lancio. Cursor è in trattative a $50 miliardi su $2 miliardi di run rate. Il segnale non è quale vendor vince, ma che l'intero verticale ha spostato il costo dell'autonomia dal bilancio del vendor a quello del buyer.

Il cambio di prezzo del 1° giugno 2026

Per gran parte della vita di Copilot, il modello era semplice: paghi una fee mensile fissa per sviluppatore, lo usi quanto vuoi. Il 1° giugno 2026, GitHub ha spostato ogni plan a billing usage-based basato su AI Credits: Pro include $15 al mese di crediti, Pro+ include $70, Max include $200. Le chiamate ai modelli premium consumano il pool. Il titolo di TechCrunch sulla reazione, che cita uno sviluppatore definendo il cambio "una barzelletta", racconta il sentimento meglio di qualsiasi press release.

La meccanica conta più della reazione. Un abbonamento flat è uno strumento di budgeting: un numero, niente sorprese, e il vendor assorbe il rischio che alcuni utenti toccano a malapena il prodotto mentre altri lo martellano quotidianamente. Il pricing usage-based capovolge questo. Il buyer porta ora il costo di ogni planning loop, di ogni delegazione a sub-agent, di ogni retry su un test fallito. Devin ha prezzato in questo modo dal primo giorno, chiamando la sua unità ACU (Agent Compute Unit) piuttosto che un seat. Copilot ha appena raggiunto la stessa configurazione.

Nessuno dei quattro principali vende ancora un vero seat illimitato flat per lavoro agentivo. Questa è la vera notizia. Il grafico di comparazione vendor è una distrazione dal punto strutturale: nessuno sta più sussidiando l'utilizzo del tuo engineer più pesante.

La ragione è strutturale, non competitiva. Gli assistant IA più vecchi offrivano autocomplete single-line: piccolo contesto in, piccolo suggerimento fuori, economico da servire in scala. Gli agenti di coding moderni leggono ampie sezioni di una codebase, mantengono finestre di contesto lunghe, pianificano attraverso più step, e chiamano tool ripetutamente, a volte eseguendo per minuti per task. Ogni uno di questi step consuma token, e più autonomo è l'agent, più token brucia per unità di lavoro delegato. Un vendor che mantiene un prezzo di seat flat sulla cima di questa curva di costo sta sussidiando utenti pesanti dal suo margine oppure non ha ancora scalato al punto in cui il sussidio fa male. Le linee guida di Gartner stesso ai buyer enterprise ora trattano un modello di costo a consumo, eseguito contro i tuoi ultimi 90 giorni di utilizzo reale, come un passo obbligatorio prima di qualsiasi rinnovo di contratto agente.

Il gap di valutazione che il revenue non spiega

Allinea i soldi e il quadro diventa più strano prima di diventare più chiaro. Cursor/Anysphere ha chiuso una Series D di $2.3 miliardi a una valutazione di $29.3 miliardi a novembre 2025 ed era reportedly in trattative vicino a $50 miliardi ad aprile 2026, supportato da circa $2 miliardi di revenue annualizzato. Cognition ha raccolto oltre $1 miliardo a una valutazione di $26 miliardi. Replit ha triplicato la sua valutazione da $3 miliardi a $9 miliardi in un round di marzo 2026.

Il revenue assoluto spiega parte del gap: il run rate di Cursor è circa quattro volte quello di Cognition. Non spiega tutto. L'ARR di Cognition si è spostato da $73 milioni annualizzati a metà 2025 a circa $492 milioni a metà 2026, un delta che supera il tasso di crescita di Cursor nella stessa finestra anche se la base è più piccola. L'ARR di Replit si è spostato da $2.8 milioni a oltre $150 milioni prima di stabilizzarsi vicino a $240 milioni, poi mirando a $1 miliardo entro fine anno. Leggi questi due numeri fianco a fianco e la storia non è "chi è più grande". È "il cui delta si compone più veloce da qui".

Close-up di mani che digitano su una tastiera con una finestra del terminale sfuocata in background

Questa distinzione è quella che dovrebbe effettivamente informare il modo in cui un operatore sottoscrive questo verticale, sia che la lente sia un audit competitivo, una decisione di partnership, o una call build-versus-buy per un'org di engineering interna. Augment e Poolside, due altri entranti ben capitalizzati nella stessa categoria, non hanno pubblicato figure di revenue che reggono il paragone con nessuno dei tre leader sopra, il che è di per sé un segnale: in un verticale così ben finanziato, il silenzio su ARR solitamente significa che il numero non è ancora pronto per essere confrontato, non che non esista.

Devin ha prezzato per compute prima che chiunque altro dovesse

Cognition ha costruito il pricing di Devin intorno agli Agent Compute Units dal primo giorno, il che in retrospettiva somiglia meno a una stranezza di pricing e più a una lettura tempestiva di dove l'intera categoria stava andando. Il plan Team ha un costo di circa $500 per seat al mese, senza cap per-user su chi può usare l'allotment condiviso, e ACU extra fatturati in cima quando un job dura a lungo.

Ciò che questo prezzo compra è stretto da design: PR review, code migration, issue triage, scheduled maintenance, non ricerca open-ended o generazione di slide. Cognition riferisce che Devin può imparare le convenzioni di una codebase specifica su sessioni ripetute piuttosto che iniziare da zero ogni volta, e che l'utilizzo enterprise è cresciuto circa il 50% mese su mese per sei mesi consecutivi prima che l'ARR della compagnia superasse i $492 milioni. Il floor $500/seat lo mette fuori portata per uno sviluppatore solista. È costruito per un'org di engineering che può già indicare un backlog di migration e mettere una figura di dollari sulle ore che costa cancellarlo manualmente.

La scommessa di Replit sul pricing a consumo in scala consumer

Replit ha preso il punto di ingresso opposto sulla stessa shift sottostante. Replit Agent si trova all'interno di Replit Core a $25 al mese, circa il 5% del prezzo di lista di Devin, e scaffolda un'app full-stack, cabla un database, e la deploy da un prompt in linguaggio naturale senza setup locale.

L'agganciamento è la stessa economia di compute che tutti gli altri stanno ora navigando: un subscriber che esegue Agent 3 a massima autonomia per una sessione lunga può bruciare da $5 a $15 di crediti in un singolo workflow, perché l'agent gira up ambienti sandboxed e chiama modelli frontier premium su ogni step. La scommessa di Replit non è che il billing usage-based scompaia. È che un prezzo di ingresso consumer-friendly più il consumo di crediti trasparente converte un funnel superiore molto più grande di quanto una motion di vendita enterprise-only farebbe, e la traiettoria ARR (oltre cinquanta milioni di utenti registrati, un target dichiarato di $1 miliardo ARR per fine 2026) è l'evidenza che quella scommessa sta pagando.

Team di engineering che rivede un dashboard su un monitor grande in un ufficio illuminato dalla luce naturale

Ciò che l'acquisizione di Manus segnala sull'economia degli agent più ampia

Non ogni agent che ha importanza per questa categoria è stato spedito come uno strumento di coding standalone. Manus ha operato come un agent completamente autonomo di proposito generale, funzionando all'interno del suo browser virtuale, terminale, e file system per pianificare ed eseguire task multi-step end to end. Meta ha acquisito la startup dietro di esso nel 2026, piegando un prodotto autonomous-agent credibile in un bilancio molto più grande piuttosto che lasciargli continuare a raccogliere e scalare indipendentemente.

Questo risultato è degno di tracking insieme agli agent di coding pure-play perché è un secondo, distinto pattern di exit nella stessa categoria più ampia: invece di una valutazione indipendente di $9 miliardi o $26 miliardi, un incumbent compra il capability direttamente. Per chiunque stia mappando quali AI coding agent e general-agent startup sono strutturalmente durevoli versus acquisition targets, un exit M&A da un agent general well-funded è un data point che appartiene nello stesso modello dei funding round.

Il contro-argomento open-source: ciò che Suna dimostra sulla matematica dei token

Suna, costruito da Kortix, esegue la stessa categoria di task (browser, shell, file system, esecuzione multi-step) come un progetto open-source, self-hostable con circa 20.000 stelle GitHub, spesso citato come la risposta open-source più vicina a Manus. Il software core è gratuito. Il costo reale si sposta interamente al compute più qualsiasi API di modello tu connetti, che è la stessa matematica usage-based che ogni vendor proprietario ha appena adottato, meno il margine del vendor in cima.

Corridoio di server del data center con file di rack illuminati da status light blu e verde

L'opportunità commerciale è esplicita piuttosto che nascosta dietro una pricing page: tu possiedi uptime, security patching, e prompt-engineering effort da solo, in cambio della piena ispezione di ciò che l'agent sta effettivamente facendo e nessun abbonamento obbligatorio. Per un platform team già funzionante con la propria infrastruttura di modelli, quella matematica può battere $500 a seat. Per la maggior parte dei team, il costo di setup è esattamente il perché i vendor hosted hanno ancora un business.

Ciò che la spinta human-in-the-loop dice ai procurement team

Il CEO stesso di Cognition, Scott Wu, ha sostenuto pubblicamente che gli AI coding agent non dovrebbero sostituire gli engineer umani, una posizione notevolmente cauta da parte di chi vende l'agent. La stessa settimana, TechCrunch ha riferito della pressione opposta dall'altra direzione: alcuni sviluppatori ora rifiutano di lavorare senza strumenti IA del tutto, una dipendenza che l'outlet ha segnalato come un rischio di per sé.

Leggi questo accanto allo shift di billing, e questi due data point non sono un dibattito filosofico. Sono uno operazionale. Il pricing usage-based significa che il costo di un team che fa leva pesante su esecuzione agentiva è ora variabile e visibile sulla fattura, non fisso e sepolto nella headcount. Un CTO che tratta "quanto dovremmo delegare all'agent" come una domanda di produttività senza trattarla come una domanda di budget sarà sorpreso dalla linea di token nello stesso modo in cui la base utenti di GitHub Copilot è stata sorpresa a giugno.

Dovresti firmare un contratto basato su seat prima del tuo prossimo rinnovo?

Salta se il vendor te lo consente ancora. Un seat flat è l'ultimo artefatto di un regime di economia che l'intero verticale ha appena lasciato. Fai modellare al vendor i tuoi ultimi 90 giorni di utilizzo effettivo secondo il loro pricing a consumo prima di firmare qualcosa di nuovo, nel modo in cui la guida di procurement da Gartner e altri sta ora raccomandando in tutta questa categoria.

Vale la pena bloccare se sei l'utente più piccolo e leggero del vendor: forti sconti su contratti di seat legacy ancora esistono come tattiche di retention, e un team di utilizzo leggero può estrarre valore reale dall'essere l'eccezione che un sales rep non vuole perdere. Per chiunque altro, il delta da tracciare non è il prezzo di listing sulla pricing page. È il gap tra ciò che il tuo team effettivamente consuma e ciò che il contratto assume che consumerai. Segnali, non narrativi, è l'unico modo di sottoscrivere correttamente quel gap.

Domande frequenti

Qual è la differenza tra pricing flat-seat e usage-based per gli agenti di coding IA?
Il pricing flat-seat è un abbonamento mensile fisso per sviluppatore, indipendentemente da quanto usi l'agent. Usage-based billing addebita in base ai token consumati o ai compute unit utilizzati. Nel giugno 2026, GitHub Copilot ha spostato tutti i piani a usage-based, spostando il rischio di costo dal vendor al buyer.
Perché tutti i principali vendor di agenti di coding hanno adottato pricing a consumo?
Gli agenti moderni mantengono lunghe finestre di contesto, leggono ampie sezioni del codice, pianificano multi-step, e richiamano tool ripetutamente. Ogni operazione consuma token. Un vendor che mantiene un prezzo fisso su questa curva di costo dovrebbe sussidiare gli utenti pesanti, il che non scala. È un cambio strutturale, non competitivo.
Quale agente ha il tasso di crescita ARR più veloce?
Cognition (Devin) ha riportato una crescita ARR da $73 milioni (metà 2025) a $492 milioni (metà 2026), con utilizzo enterprise in crescita del 50% mese su mese per sei mesi consecutivi. Questo tasso di delta supera quello di Cursor e Replit sulla stessa finestra.
Suna open-source è una vera alternativa ai tool commerciali?
Suna è tecnicamente valida per organizzazioni con infrastruttura di modelli proprietaria. L'agganciamento: il tuo team possiede uptime, security patching, e prompt engineering. Per la maggior parte, il costo di setup non scena il valore di una soluzione hosted.
Come dovrebbe cambiare il mio modello di procurement con usage-based pricing?
Chiedi ai vendor di modellare i tuoi ultimi 90 giorni di utilizzo reale secondo il loro pricing a consumo prima di firmare. Questo è ora linea guida standard di Gartner per qualsiasi rinnovo di contratto di agent. Evita contratti flat-seat per asset agentivi.
L'ARR di Cursor è veramente 4 volte superiore a quello di Cognition?
Sì, a metà 2026 Cursor riportava circa $2 miliardi di run rate annualizzato contro i $492 milioni di Cognition. Tuttavia, il delta di crescita di Cognition (raggiunto in un solo anno) supera il tasso di crescita di Cursor sulla stessa finestra.