Rodar um modelo de IA generativa caiu para US$ 0,98 por milhão de tokens — a primeira vez abaixo da barreira de US$ 1, registrada em 31 de agosto pelo índice da Silicon Data. Para o dono de PME que adiou automação por achar IA cara, a régua mudou: a pergunta certa deixou de ser “IA é cara?” e passou a ser “quanto custa uma tarefa concluída?”.
A queda não é detalhe. Segundo o InfoMoney, o preço por token despencou mais de 90% desde 2023. O corte mais recente da OpenAI, de 30 de julho, derrubou até 80% os modelos de alto volume: o que custava US$ 1 (entrada) e US$ 6 (saída) por milhão de tokens foi para US$ 0,20 e US$ 1,20, com repasse integral na AWS Bedrock.
Há um contraponto que o gestor precisa conhecer: o token 90% mais barato ampliou o uso e o gasto total do setor quase dobrou desde 2025. A economia por unidade não dispensa controle — ela desloca o debate para produtividade e governança.
Como recalcular a conta da IA em 3 passos
- Troque a régua de medida. Pare de perguntar “IA é cara?” e calcule o custo por tarefa concluída: fatura mensal de IA dividida pelas tarefas entregues — atendimentos respondidos, propostas geradas, pedidos classificados. Token consumido não é resultado.
- Cote o workload no preço de hoje. Com o índice de mercado a US$ 0,98 por milhão de tokens e modelos de alto volume a partir de US$ 0,20, rode o mesmo teste em 2 ou 3 modelos e compare o custo por tarefa. Contrato fechado há 6 meses provavelmente está caro.
- Passe o volume alto para o modelo barato e revise por trimestre. Classificação, triagem e resumo ficam no modelo de entrada; o modelo caro fica nos 10% de casos difíceis. Recote a cada nova queda do índice.
O efeito é concreto na ponta. Um escritório de contabilidade com 15 funcionários em Campinas que usa um agente para classificar 3.000 e-mails por mês paga centavos de modelo a US$ 0,20 por milhão de tokens de entrada — o custo real passa a ser montar e supervisionar a tarefa, não rodar o modelo.
Em escala, a operação brasileira já mostra o ganho: a indústria farmacêutica Hypera Pharma mantém cerca de 400 agentes de IA em produção com meta de economia de R$ 436 mil por ano e reduziu o tempo de criação de cada agente de 16 para 4 dias — 75% menos tempo por fluxo, segundo o Mobile Time.
Erro a evitar
Não trave contrato anual de IA com o preço de meses atrás: com queda de mais de 90% desde 2023 e o índice em mínima histórica, caro é pagar pelo ontem. E não meça sucesso em tokens consumidos — meça em tarefas concluídas.
O custo deixou de ser a barreira de entrada da automação. Comece por recalcular o custo por tarefa da sua operação com os preços desta semana, migre o volume alto para o modelo mais barato e revise a conta a cada trimestre.
Fontes: Silicon Data — LLM Token Expenditure Index — https://www.silicondata.com/products/silicon-index/llm-token-expenditure-index | InfoMoney — Preços de tokens de IA caem e acendem alerta sobre a tese do setor — https://www.infomoney.com.br/mercados/precos-de-tokens-de-ia-caem-e-acendem-alerta-sobre-a-tese-do-setor/ | AWS — OpenAI GPT Terra e Luna: novo preço no Bedrock — https://aws.amazon.com/about-aws/whats-new/2026/07/openai-gpt-terra-luna-pricing-bedrock/ | Mobile Time — Hypera Pharma com agentes de IA — https://www.mobiletime.com.br/noticias/20/08/2026/hypera-pharma-agentes/
Deixe um comentário