Pular para o conteúdo
GenAI BR
Índice mensalConceito

Índice de Custo de Inferência

Quanto custa, em reais, rodar IA de verdade: uma cesta fixa de tarefas, reprecificada todo mês em modelos abertos e fechados, servidos aqui e fora.

Situação
Em avaliação · sem data
Ritmo
Mensal · primeiro dia útil
Acesso
Gratuito, dados abertos.
Ano
2027
Em uma frase

O IPCA da inferência: um número por mês que diz se ficou mais barato ou mais caro construir com IA no Brasil — e por quê.

Para quem
  • 01Quem paga a conta de tokens e precisa prever o próximo trimestre.
  • 02Quem escolhe entre modelo aberto servido no Brasil e API estrangeira em dólar.
  • 03Quem escreve sobre custo de IA e hoje cita preço de lista em dólar, sem tarefa.
O que você recebe
O número
Um índice base 100, em reais, publicado no primeiro dia útil do mês, com variação mensal e anual.
A cesta
Doze tarefas fixas — classificação, extração, RAG, código, agente — com prompts e volumes públicos.
A decomposição
Quanto da variação veio de preço de lista, de câmbio, de eficiência (tokens por tarefa) e de troca de modelo.
Os dados
CSV com cada tarefa, modelo, provedor e preço, todo mês, para refazer o índice do seu jeito.
Como funciona
  1. 1Fixar a cesta

    Doze tarefas reais, com volume mensal típico de uma empresa média. A cesta muda uma vez por ano, com aviso.

  2. 2Medir tokens

    Cada tarefa roda de verdade em cada modelo da cesta: tokens de entrada e saída medidos, não estimados.

  3. 3Precificar

    Preço de lista do provedor × tokens × câmbio médio do mês. Provedores brasileiros em reais direto.

  4. 4Publicar e decompor

    O índice, a decomposição e o CSV. Com um parágrafo de quem leu: por que mexeu.

Calendário
  1. 2027Decisão de ir ou não, depois de seis meses de Cinco medindo preços
Amostra

A cesta, em rascunho

Doze tarefas; aqui, cinco. Todas com prompt e volume públicos no dia em que o índice existir.

Classificar
50 mil tickets de atendimento por mês em doze categorias.
Extrair
10 mil notas fiscais em campos estruturados.
Responder com RAG
20 mil perguntas sobre uma base de 2 mil documentos.
Programar
2 mil tarefas de correção de bug com teste.
Agir
500 casos de um agente com cinco chamadas de ferramenta cada.
Por que existe

Toda semana o Cinco registra um preço por milhão de tokens. Nenhum desses números diz, sozinho, se ficou mais barato construir com IA no Brasil: o câmbio mexe, os modelos mudam de eficiência, os provedores daqui entram e saem. O Índice de Custo de Inferência é a tentativa de responder com um número só, todo mês, em reais.

É o projeto mais 'inteligência de mercado' da casa, e o que mais depende de rigor: uma cesta fixa, tokens medidos e não estimados, e uma decomposição que separa preço, câmbio e eficiência. Por isso ainda é um conceito, com uma decisão marcada — e não uma promessa.

Perguntas
Por que é só conceito?
Porque medir tokens de verdade em vinte modelos todo mês custa dinheiro e tempo. A decisão vem depois de seis meses de Cinco acompanhando preços.
Qualidade entra?
Não no índice — custo é custo. Mas cada tarefa publica uma nota mínima de qualidade para entrar na cesta.

Receba o próximo Cinco

Terça, 7h, no seu e-mail. Cinco itens, com fonte. Sem newsletter diária, sem promoção, e o descadastro é um clique.

Só o e-mail. Nada de rastreador de terceiros nesta página. Política de privacidade.

Próximo projeto · Conceito
Mapa da IA no Brasil