Agentes de IA para codificação: precificação por consumo

Resumo

O mercado de agentes de codificação IA reprecia-se em um trimestre. GitHub Copilot migrou para faturamento por uso em junho de 2026, acompanhando Devin, Cursor e Replit neste novo paradigma. Investidores acompanham o delta de crescimento, não apenas a receita absoluta. A arbitragem entre modelos abertos e proprietários agora se traduz em cobrança transparente de compute.

Escritório do engenheiro de software à noite com monitores mostrando interface de revisão de código desfocada

Agente de IA para codificação: a mudança de modelo de preço

O agente de IA para codificação mudou radicalmente em 2026. GitHub Copilot, que cobrava uma taxa fixa por desenvolvedor, passou para faturamento por uso em junho. Devin, Cursor e Replit fizeram o mesmo. Não é qual fornecedor está vencendo. É que todo o segmento vertical deslocou o custo de computação do vendedor para o cliente.

O que mudou em 1º de junho de 2026

Durante a maior parte da vida útil do Copilot, o negócio era simples: pague uma taxa mensal fixa por desenvolvedor, use o quanto quiser. Em 1º de junho de 2026, o GitHub moveu todos os planos para faturamento por uso construído em AI Credits: Pro inclui $15 de créditos mensais, Pro+ inclui $70, Max inclui $200. Chamadas de modelo premium reduzem o saldo. A manchete do TechCrunch sobre a reação, citando um desenvolvedor que chamou a mudança de "uma piada", captura o humor melhor do que qualquer comunicado de imprensa.

A mecânica importa mais do que o retrocesso. Um assento fixo é um instrumento orçamentário: um número, sem surpresas, e o fornecedor absorve o risco de que alguns usuários mal usem o produto enquanto outros o martelam diariamente. Precificação por uso inverte isso. O cliente agora carrega o custo de cada loop de planejamento, cada delegação de sub-agente, cada retry em um teste falhado.

Devin precificou assim desde o primeiro dia, chamando sua unidade de ACU (Agent Compute Unit) em vez de assento. Copilot acabou de se juntar a ele. Nenhuma das quatro maiores ainda vende um assento completamente ilimitado e fixo para trabalho de agentes.

Essa é a notícia real. A comparação de fornecedores é uma distração do ponto estrutural: ninguém está mais subsidiando o uso do seu engenheiro mais pesado.

A razão é estrutural, não competitiva. Assistentes de IA mais antigos ofereciam autocompletar de linha única: contexto pequeno dentro, sugestão pequena para fora, barato de servir em escala. Agentes de codificação modernos leem grandes trechos de uma base de código, mantêm janelas de contexto longas, planejam através de múltiplos passos e chamam ferramentas repetidamente, às vezes rodando por minutos por tarefa. Cada um desses passos consome tokens, e quanto mais autônomo o agente, mais tokens ele queima por unidade de trabalho delegado.

Um fornecedor que mantém um preço de assento fixo no topo dessa curva de custo está subsidiando usuários pesados fora de sua própria margem ou ainda não escalou ao ponto em que o subsídio dói. A própria orientação Gartner para compradores corporativos agora trata um modelo de custo por consumo, executado contra seus últimos 90 dias de uso real, como uma etapa obrigatória antes de qualquer renovação de contrato de agente.

O hiato de valorização que a receita não explica

Alinhe o dinheiro e a imagem fica estranha antes de ficar mais clara. Cursor (Anysphere) fechou um Series D de $2.3B a uma avaliação de $29.3B em novembro de 2025 e estava em negociações relatadas perto de $50B em abril de 2026, apoiado por aproximadamente $2B em receita anualizada. Cognition levantou mais de $1B a uma avaliação de $26B. Replit triplicou sua própria avaliação de $3B para $9B em uma rodada de março de 2026.

A receita absoluta explica parte do hiato: a taxa de execução de Cursor é próxima a quatro vezes a de Cognition. Não explica tudo. O ARR de Cognition passou de $73M anualizados em meados de 2025 para aproximadamente $492M em meados de 2026, um delta que supera a taxa de crescimento de Cursor na mesma janela mesmo que a base seja menor. O ARR de Replit passou de $2.8M para mais de $150M antes de se estabilizar perto de $240M, depois direcionando $1B até o final do ano. Leia esses dois números lado a lado e a história não é "quem é maior". É "cujo delta cresce mais rápido a partir daqui".

Close-up de mãos digitando em um teclado com uma janela de terminal desfocada ao fundo

Essa distinção é a que deve realmente informar como um operador subscreve este segmento vertical, seja a perspectiva é uma auditoria competitiva, uma decisão de parceria ou uma chamada build-versus-buy para uma organização de engenharia interna. Augment e Poolside, dois outros participantes bem capitalizados na mesma categoria, não publicaram números de receita que se sustentam contra nenhum dos três líderes acima, o que é em si um sinal: em um segmento assim bem financiado, o silêncio em ARR geralmente significa que o número não está pronto para ser comparado ainda, não que não exista.

Devin precificou por computação antes que qualquer outro

Cognition construiu a precificação do Devin em torno de Agent Compute Units desde o início, o que parece menos uma peculiaridade de precificação em retrospecto e mais como uma leitura antecipada de para onde toda a categoria estava indo. O plano de equipe funciona com aproximadamente $500 por assento por mês, sem limite de usuários por pessoa que pode usar a alocação compartilhada, e ACUs extras faturadas quando um trabalho demora mais.

O que esse preço compra é restrito por design: revisão de PR, migrações de código, triagem de problemas, manutenção agendada, não pesquisa aberta ou geração de slides. Cognition relata que Devin pode aprender as convenções da base de código específica de uma organização ao longo de sessões repetidas em vez de começar do zero toda vez, e que o uso empresarial cresceu aproximadamente 50% mês a mês durante seis meses consecutivos antes do ARR da empresa ultrapassar $492M. O piso de $500 por assento o coloca fora do alcance de um desenvolvedor solo. É construído para uma organização de engenharia que já pode apontar para uma ordem de trabalho de migração e colocar um valor em dólar nas horas que custa limpá-la manualmente.

Replit aposta em consumo em escala de consumidor

Replit tomou o ponto de entrada oposto na mesma mudança subjacente. Replit Agent fica dentro de Replit Core a $25 por mês, aproximadamente 5% do preço de tabela de Devin, e monta um aplicativo full-stack, conecta um banco de dados e o implanta a partir de um prompt em linguagem natural sem configuração local.

A pegadinha é a mesma economia de computação que todos os outros agora estão navegando: um assinante que executa Agent 3 com autonomia máxima em uma sessão longa pode queimar $5 a $15 de créditos em um único fluxo de trabalho, porque o agente inicia ambientes em sandbox e chama modelos de fronteira premium em cada etapa. A aposta de Replit não é que a faturação por uso desapareça. É que um preço de entrada amigável ao consumidor mais consumo de crédito transparente converte um funil de topo muito maior do que um movimento de vendas apenas para empresas faz, e a trajetória de ARR (mais de cinquenta milhões de usuários registrados, um alvo de $1B ARR declarado para o final de 2026) é a evidência de que essa aposta está compensando.

Equipe de engenharia revisando um painel em um monitor grande em um escritório à luz do dia

O que a aquisição de Manus sinaliza

Nem todo agente que importava para essa categoria foi enviado como uma ferramenta de codificação independente. Manus operava como um agente de propósito geral totalmente autônomo, rodando dentro de seu próprio navegador virtual, terminal e sistema de arquivos para planejar e executar tarefas multi-etapas de ponta a ponta. Meta adquiriu a startup por trás dela em 2026, dobrando um produto de agente autônomo credível em uma folha de balanço muito maior em vez de deixá-lo continuar levantando e escalando independentemente.

Esse resultado vale a pena rastrear ao lado dos agentes de codificação puros porque é um segundo padrão de saída distinto na mesma categoria mais ampla: em vez de uma avaliação independente de $9B ou $26B, um incumbente compra a capacidade direto. Para qualquer pessoa mapeando quais startups de agentes de IA para codificação e agentes gerais são estruturalmente duráveis versus alvos de aquisição, uma saída M&A de um agente geral bem financiado é um ponto de dados que pertence ao mesmo modelo que as rodadas de financiamento.

O que Suna prova sobre a matemática do token open-source

Suna, construído por Kortix, executa a mesma categoria de tarefa (navegador, shell, sistema de arquivos, execução multi-etapas) como um projeto open-source auto-hospedado com aproximadamente 20 mil estrelas GitHub, frequentemente citado como a resposta open-source mais próxima de Manus. O software principal é gratuito. O custo real muda inteiramente para computação mais qualquer API de modelo que você conecte, que é a mesma matemática por uso que todo fornecedor proprietário acabou de adotar, menos a margem do fornecedor em cima dela.

Corredor de servidor do data center com fileiras de racks iluminados por luzes de status azuis e verdes

O trade é explícito em vez de escondido atrás de uma página de preços: você possui uptime, patches de segurança e esforço de engenharia de prompt você mesmo, em troca de inspeção completa do que o agente realmente está fazendo e nenhuma assinatura obrigatória. Para uma equipe de plataforma já executando sua própria infraestrutura de modelo, essa matemática pode vencer $500 por assento. Para a maioria das equipes, o custo de configuração é exatamente por que os fornecedores hospedados ainda têm um negócio.

O retrocesso human-in-the-loop e as equipes de aquisição

O próprio CEO de Cognition, Scott Wu, argumentou publicamente que agentes de IA para codificação não devem substituir engenheiros humanos, uma posição notavelmente cautelosa de quem está vendendo o agente. A mesma semana, TechCrunch reportou a pressão oposta da outra direção: alguns desenvolvedores agora se recusam a trabalhar sem ferramentas de IA, uma dependência que o outlet sinalizou como um risco em seu próprio direito.

Leia ao lado da mudança de faturamento, esses dois pontos de dados não são um debate filosófico. São um operacional. Precificação por uso significa que o custo de uma equipe que depende fortemente da execução de agentes agora é variável e visível na fatura, não fixo e enterrado em headcount. Um CTO que trata "quanto devemos delegar ao agente" como uma questão de produtividade sem tratá-la como uma questão de orçamento vai ser surpreendido pela linha de token da mesma forma que a base de usuários do GitHub Copilot foi surpreendida em junho.

Renovar contratos de assento antes do final do ano?

Pule-o se o fornecedor ainda deixar você. Um assento fixo é o último artefato de um regime de economia que todo o segmento vertical acabou de deixar. Faça o fornecedor modelar seus últimos 90 dias de uso real sob sua precificação por consumo antes de assinar qualquer coisa nova, da forma como a orientação de aquisição de Gartner e outros está recomendando em toda essa categoria.

Vale a pena bloquear se você for o usuário mais leve e mais pequeno do fornecedor: descontos pesados em contratos de assento antigos ainda existem como uma tática de retenção, e uma equipe de uso leve pode extrair valor real por ser a exceção que um rep de vendas não quer perder. Para todos os outros, o delta a rastrear não é o preço de tabela na página de preços. É o hiato entre o que sua equipe realmente consome e o que o contrato assume que você consumirá. Signals, não narrativas, é a única forma de subscrever esse hiato corretamente.

Perguntas frequentes

Por que o GitHub Copilot mudou para precificação por uso?
Agentes de IA modernos consomem significativamente mais tokens do que assistentes tradicionais. Um modelo de preço fixo não pode sustentar essa curva de custo. Vendedores como Devin já haviam adotado esse modelo; Copilot e concorrentes se juntaram em 2026.
Cursor está ganhando porque é o maior em receita?
Não é apenas tamanho. O delta de crescimento de Cognition (6x em um ano) e Replit (50x em 18 meses) é mais importante para avaliação do que a receita absoluta. Investidores estão cotando quem cresce mais rápido, não quem é maior agora.
O que significa para um CTO: agentes abertos ou proprietários?
Suna open-source reduz custo de licença para zero, mas você assume manutenção + infraestrutura. Para 90% das equipes, a economia do software hospedado ganha. Para grandes organizações com equipes de platform, open-source pode ser competitivo.
Devo renovar meu contrato de assento do Copilot antes do fim do ano?
Não. Modele seus últimos 90 dias de uso real sob precificação por consumo. Se você é um usuário leve, os descontos de retenção em contratos antigos podem valer a pena. Caso contrário, saia do assento fixo.
O que a aquisição de Manus por Meta significa?
Sinalizou que um grande incumbente comprava capacidade autônoma em vez de deixar um startup bem financiado continuar crescendo independentemente. Um padrão de saída diferente dos IPOs/rounds de agentes de codificação puros.