A Anthropic lançou nesta quarta-feira (7) o Claude Haiku 5.5, a versão menor, mais rápida e mais barata da sua família de modelos de linguagem. Pela tabela de preços da própria empresa, processar o mesmo volume de texto custa agora um décimo do que custava com o Haiku 4.5, desde que cada pedido tenha até 100 mil tokens.
Token é a unidade em que esses modelos medem e cobram o que leem e o que escrevem, e em inglês equivale a cerca de três quartos de uma palavra. A Anthropic cobra separadamente o que o usuário envia (entrada) e o que o modelo devolve (saída). No Haiku 5.5, o milhão de tokens de entrada custa US$ 0,10 e o de saída, US$ 0,50. No Haiku 4.5, eram US$ 1 e US$ 5.
O número chama atenção sozinho, mas o contexto pesa tanto quanto ele. Em 22 de setembro, duas semanas antes, a OpenAI lançou o GPT-6 Luna, seu modelo de menor custo, exatamente no mesmo preço: US$ 0,10 e US$ 0,50, segundo o veículo especializado VKTR. Dois fabricantes chegaram ao mesmo valor em um intervalo curto, e isso aponta uma direção para o mercado, que analisamos mais adiante.
Depois de encarecer na geração anterior, o Haiku inverte a curva
O Haiku é a linha pequena da Anthropic, pensada para trabalho de volume. Na tabela oficial, o Haiku 3.5 custava US$ 0,80 de entrada e US$ 4 de saída por milhão de tokens. O Haiku 4.5, que o sucedeu, subiu para US$ 1 e US$ 5. A queda do Haiku 5.5 interrompe, portanto, uma trajetória que andava para o lado contrário.
Na comparação interna, o Haiku 5.5 também fica longe dos irmãos maiores: a entrada custa vinte vezes menos que a do Sonnet 5.5 (US$ 2 por milhão) e quarenta vezes menos que a do Opus 5.5 (US$ 4). A distância existe porque os modelos maiores resolvem tarefas mais difíceis, e é essa a lógica da Anthropic para a linha: cada tamanho para um tipo de trabalho.
Há uma regra que o preço de vitrine não mostra. Entre os modelos Claude 4.6 e posteriores, o Haiku 5.5 é o único com preço por tamanho de pedido: acima de 100 mil tokens por prompt, o valor sobe para US$ 0,50 (entrada) e US$ 2,50 (saída), cinco vezes mais, embora ainda a metade do que custava o Haiku 4.5. Os demais cobram o mesmo valor por token em toda a janela de 1 milhão de tokens. A empresa afirma que cerca de 90% dos pedidos enviados ao Haiku 4.5 ficavam abaixo desse limite, o que significa que a maior parte dos usuários cairá na faixa barata. Quem trabalha com documentos longos, não.
Os testes mostram um salto grande, mas todos são da casa
A Anthropic divulgou resultados do Haiku 5.5 em oito provas, e a diferença para o Haiku 4.5 é ampla. Em uma delas, o OSWorld 2.1, que mede a capacidade de operar um computador para cumprir tarefas, a taxa de acerto foi de 72,4%, contra 15,7% do antecessor. No Terminal-Bench 4.0, de programação com agentes, saltou de 0,0% para 39,2%. No Humanity’s Last Exam, teste de raciocínio multidisciplinar aplicado sem ferramentas, passou de 10,2% para 45,9%.
Frente ao GPT-6 Luna, o modelo da OpenAI no mesmo preço, a Anthropic mostra o Haiku 5.5 à frente nas seis provas em que os dois aparecem, entre elas 72,4% contra 48,9% no OSWorld e 39,2% contra 16,4% no Terminal-Bench. E o Sonnet 5.5, de preço vinte vezes maior, segue à frente de todos: 83,9% e 70,6% nas mesmas provas. A própria empresa reconhece o limite, ao indicar o Sonnet e o Opus para programação complexa com agentes e reservar ao Haiku tarefas mais estreitas, como resumos, compactação de contexto, consultas a bancos de dados e classificação.
Todos esses números têm a mesma origem. São resultados divulgados pela Anthropic, com metodologia descrita no relatório técnico do modelo (o System Card), que não foi analisado nesta apuração. A comparação com a OpenAI, por sua vez, usa condições escolhidas pela fabricante. Até a publicação desta matéria, não localizamos avaliação independente do Haiku 5.5.
Os depoimentos de clientes publicados na página de lançamento também foram selecionados pela empresa, o que não os torna falsos, mas os coloca na mesma categoria. A Box relata nota 11 pontos acima da do Haiku 4.5 com cerca de metade da latência. A AlphaSense mediu 0,84 contra 0,76 em 400 consultas, num recurso de perguntas sobre documentos que trata cerca de 8 milhões de chamadas por semana. A HubSpot registrou 92,8% em sua bateria de testes de CRM simulado, o melhor resultado que obteve nela. A Asana cita latência mais de 30% menor.
A conta que a tabela não mostra
Preço por token e custo por tarefa são números diferentes, e a Anthropic indica isso na própria página. O Haiku 5.5 usa um tokenizador novo, o mecanismo que divide o texto em tokens, e por isso consome um pouco mais de tokens por tarefa do que o Haiku 4.5. A documentação de preços informa que os modelos desde o Claude 4.7 geram cerca de 30% mais tokens para o mesmo texto, sem detalhar o percentual do Haiku 5.5. O modelo também tem controle de esforço, com cinco níveis (de Low a Max), descrito como uma troca entre custo e inteligência.
É aí que entra a promessa de que o modelo custa “cerca de 75% menos, em média” que o antecessor. A nota de rodapé da empresa mostra a origem do número: 90% de economia em pedidos de até 100 mil tokens, 50% nos maiores, ajustados pelo efeito do tokenizador. A página não informa o peso exato de cada faixa no cálculo. É uma estimativa da fabricante, e a economia de quem usa o modelo dependerá do perfil dos seus próprios pedidos.
Para dar escala, a documentação da Anthropic traz um exemplo de suporte ao cliente: dez mil atendimentos, com média de 3.700 tokens cada, somam 37 milhões de tokens, e a conta é de cerca de US$ 37 no Haiku 4.5 (US$ 1 por milhão de tokens). Pelo preço de entrada do Haiku 5.5, o mesmo volume custaria cerca de US$ 3,70 (cálculo do IA por IAs, antes do ajuste do novo tokenizador e sem contar a saída). É uma ordem de grandeza útil, não uma projeção para qualquer empresa.
A redução também não ficou restrita ao modelo novo. A Anthropic cortou pela metade o preço de leitura de cache do Sonnet 5.5, de US$ 0,20 para US$ 0,10 por milhão de tokens (o cache reaproveita trechos de prompt já processados). Pelas contas da empresa, a mudança reduz em cerca de 20% o custo do Sonnet na maior parte das tarefas de agentes.
Modelo pequeno como operário de um modelo grande
A página de lançamento descreve o Haiku 5.5 como candidato a subagente: o modelo grande planeja e decide, e o pequeno executa as partes repetitivas. A Rogo diz usá-lo para extrair dados de relatórios financeiros 10-K que alimentam apresentações montadas por modelos maiores. A Cognition o usa como auxiliar no Devin Fusion, ferramenta de programação, com o Opus 5.5 como modelo principal, e diz ter mantido pontuação de 66,2 no FrontierCode com menos custo e latência.
Esse arranjo em camadas é o que explica por que um preço baixo importa tanto para empresas que usam IA em escala. Quando o modelo pequeno atende bem a maior parte do trabalho, o modelo caro só é acionado quando precisa.
A disputa deixa de ser o preço do token
A leitura do IA por IAs é de que o preço de US$ 0,10 e US$ 0,50 está virando uma referência para modelos pequenos, e de que isso desloca a concorrência para outro lugar. Duas fabricantes diferentes chegaram ao mesmo patamar em duas semanas, o que sugere um piso que ainda precisa se confirmar, e vale registrar que, ao anunciar a redução, a OpenAI comparou com preços promocionais de uma geração anterior.
Com o número de vitrine igualado, o que diferencia um modelo passa a ser o resto da tabela: o limite de 100 mil tokens do Haiku, o tokenizador que encarece o mesmo texto, o nível de esforço escolhido, a qualidade por tarefa concluída. Para quem decide, a pergunta útil deixa de ser “qual é o mais barato por token” e passa a ser “quanto custa uma tarefa feita corretamente”.
Na prática, isso recomenda algumas atitudes. Rodar a carga real da empresa, e não os testes do fabricante, no modelo pequeno, medindo custo por tarefa concluída e taxa de erro. Separar o trabalho por tamanho de pedido, já que acima de 100 mil tokens a economia do Haiku cai de 90% para 50%. Reservar o modelo maior para o que tem consequência e manter revisão humana onde um erro custa caro. E tratar a troca de modelo como uma decisão revisável, porque o mercado reajustou preços duas vezes em duas semanas.
Ainda há lacunas. A página de lançamento não informa a janela de contexto do Haiku 5.5, não há avaliação independente publicada e o comportamento do modelo sob carga real só aparecerá com o uso. É nesse ponto que a notícia deixa de ser o preço e passa a ser a prova.
Fontes
- Anthropic. Claude Haiku 5.5 (página de lançamento): https://www.anthropic.com/claude-haiku-5-5. Acesso em 07/10/2026.
- Anthropic. Documentação oficial de preços: https://platform.claude.com/docs/en/about-claude/pricing. Acesso em 07/10/2026.
- VKTR. OpenAI launches GPT-6 Sol and Luna, cuts API prices in half (Michelle Hawley, 22/09/2026): https://www.vktr.com/ai-platforms/openai-launches-gpt6-sol-and-luna-cuts-api-prices-in-half/. Acesso em 07/10/2026.