A tesoura: a fronteiraencareceu e o modeloaberto virou centavo
Em 2023, o modelo mais capaz do mundo cobrava US$ 60 por milhão de tokens de saída. Em abril de 2025 cobrava US$ 8. Na quinta-feira passada, o GPT-6 Astra saiu a US$ 50 — o mesmo preço do Claude Fable 5.1, e duas vezes e meia o do modelo que a OpenAI lançou em junho. No mesmo intervalo de duas semanas, a Z.ai colocou um modelo de 320 bilhões de parâmetros, sob licença MIT, servido segundo a empresa só em chips chineses, a US$ 0,50. A distância entre as duas pontas é de cem vezes. É isso que chamamos de tesoura: as lâminas se afastam, e o que está entre elas é o mercado inteiro de quem constrói com IA.
A tese desta edição é simples de enunciar e difícil de aceitar: o preço por token deixou de ser a variável que decide entre fechado e aberto. Para trabalho agentivo — código, terminal, operação de sistemas — os modelos abertos permissivos chegaram a uma faixa de capacidade em que a decisão de compra passa a depender de outras três coisas: se o modelo funciona no seu domínio (e os benchmarks que todo lançamento cita não dizem), se dá para confiar no que ele diz que está pensando (o próprio relatório do GPT-6 diz que cada vez menos), e onde ele roda (o que, no Brasil, virou uma licitação de R$ 959 milhões com prazo em 8 de outubro).
Os cinco movimentos abaixo seguem essa ordem: o peso dos pesos abertos, o preço, o benchmark que não separa mais, o raciocínio que não se deixa ler, e os sete mil petaflops de Macaíba. Cada um tem um gráfico ou um trecho de código executado; os números estão nas tabelas; as fontes, numeradas no fim. Se você só tem tempo para um: o segundo.
Os cinco movimentos
- IModelos abertos
O peso dos pesos
A Tencent publicou um mixture-of-experts de 770 bilhões de parâmetros sob Apache 2.0. Custa para rodar como um modelo de 49 bilhões — e precisa de memória para os 770. “Aberto”, nesse tamanho, é uma palavra com dono.
- IIInfra e custo
Quinze centavos
A fronteira fechada voltou a custar o que custava em 2023. O modelo aberto que a acompanha de perto custa um centésimo disso. O preço de lista virou um sinal de posicionamento — e parou de ser uma medida de custo.
- IIIAvaliação
O número que não separa mais
O SWE-bench Verified foi de 33% a 96% em dois anos e parou de distinguir modelos. Um grupo de Fudan reuniu 119 bugs reais de software científico: o melhor agente resolve menos da metade — e, com essa amostra, os cinco primeiros são estatisticamente o mesmo.
- IVProduto · Interpretabilidade
Ler o raciocínio
O GPT-6 Astra resetou o teto de quase todos os benchmarks que a OpenAI escolheu mostrar. O system card, lido até o fim, diz outra coisa: as cadeias de pensamento ficaram mais curtas, e a empresa terá “confiança significativamente reduzida” para detectar alguns comportamentos desalinhados.
- VRegulação e Brasil
Sete mil petaflops
Depois de dois anos e três adiamentos, o supercomputador do Plano Brasileiro de IA virou um edital: R$ 959 milhões, 7.200 PFLOPS em FP16, Macaíba (RN), propostas até 8 de outubro. É o primeiro passo com número, prazo e documento. Também é menor, em dinheiro e em megawatts, do que o plano prometia.
Receba o próximo Cinco
Terça, 7h, no seu e-mail. Cinco itens, com fonte. Sem newsletter diária, sem promoção, e o descadastro é um clique.
O que estamos construindo
- No arEdição semanal
Cinco
Um ensaio por semana sobre o mercado de IA, em cinco movimentos — com gráficos, código executado e fontes numeradas. Toda terça às 7h.
- No arServiço para empresas
Briefings sob medida
Uma pergunta da sua empresa sobre IA, respondida em dez páginas com fonte e uma hora de conversa — a partir do que o Acervo já leu.
- Em construçãoProduto de agentes
Ofício
Agentes que executam o trabalho repetitivo de empresas brasileiras — com verificação em cada passo e um humano no circuito.
- PrevistoPublicação semestral
Radar GenAI BR
O que adotar, testar, observar e evitar em IA, a cada seis meses, com uma página por item e o que mudou desde a última edição.
- PrevistoRelatório anual
State of AI Brasil
Pesquisa anual com profissionais de IA no Brasil: o que usam, quanto ganham, o que muda — aberta, com dados publicados.
- PrevistoPerfis e leitura
Sala
Um perfil por leitor: o que você guardou, os temas que segue, as trilhas que fez — privado por padrão, público se quiser.
- ConceitoÍndice mensal
Índice de Custo de Inferência
Quanto custa, em reais, rodar IA de verdade: uma cesta fixa de tarefas, reprecificada todo mês em modelos abertos e fechados, servidos aqui e fora.
- ConceitoBase viva
Mapa da IA no Brasil
Quem faz IA no país — laboratórios, empresas, programas públicos, datacenters, leis — cada entrada com fonte e data, num mapa que se atualiza com o Cinco.
- E o catálogo inteiroTodos os projetos→
O que mudou desde a última edição
- A Tencent abriu um MoE de 770B sob Apache 2.0 — e ele bate o Kimi K3 em código com um quarto dos parâmetros
- GLM-5.3-Flash: um modelo MIT de 320B servido inteiramente em chips chineses, a US$ 0,15 por milhão de tokens
- Em software científico de verdade, o melhor agente de código resolve menos da metade dos bugs
- GPT-6 Astra: mesmo preço, novo teto nos benchmarks — e um system card que diz que ficou mais difícil monitorar o raciocínio
- O governo publicou a licitação de R$ 959 milhões do supercomputador de IA do Rio Grande do Norte — propostas até 8 de outubro
- ReAct: intercalar raciocínio e ação foi o que fez os primeiros agentes de linguagem funcionarem
Acervo por tema
Acervo→- Modelos abertos
Pesos abertos, licenças, relatórios técnicos e o que dá para rodar por conta própria.
- Agentes
Sistemas que planejam, usam ferramentas e agem — e como saber quando funcionam.
- Avaliação
Benchmarks, contaminação, leaderboards e a distância entre a nota e o uso real.
- Interpretabilidade
O que acontece dentro do modelo: features, circuitos, fidelidade da cadeia de pensamento.
- Infra e custo
Inferência, GPUs, preço por token, e o que muda quando o custo cai dez vezes.
- Multimodal
Imagem, áudio, vídeo e texto no mesmo modelo — e o que isso custa.
- Regulação e Brasil
PL 2338, ANPD, PBIA, mercado de trabalho e o que acontece com IA daqui.
- Produto
Lançamentos, preços, APIs e decisões de produto que mudam o que dá para construir.
Hoje, uma pessoa: João Campista, em São Paulo. Leio umas duzentas coisas por semana e escolho cinco. A triagem é assistida por IA; a leitura, o julgamento e o texto são meus.