Claude Haiku 5.5 custa um décimo do antecessor e iguala o preço do GPT-6 Luna

A Anthropic lançou o modelo mais barato da família Claude. Pela tabela da empresa, a conta caiu para um décimo em prompts de até 100 mil tokens, o mesmo valor que a OpenAI havia fixado duas semanas antes.
Close de uma placa de circuito vermelha com um chip preto pequeno ao centro, cercado por capacitores e resistores

A Anthropic lançou nesta quarta-feira (7) o Claude Haiku 5.5, a versão menor, mais rápida e mais barata da sua família de modelos de linguagem. Pela tabela de preços da própria empresa, processar o mesmo volume de texto custa agora um décimo do que custava com o Haiku 4.5, desde que cada pedido tenha até 100 mil tokens.

Token é a unidade em que esses modelos medem e cobram o que leem e o que escrevem, e em inglês equivale a cerca de três quartos de uma palavra. A Anthropic cobra separadamente o que o usuário envia (entrada) e o que o modelo devolve (saída). No Haiku 5.5, o milhão de tokens de entrada custa US$ 0,10 e o de saída, US$ 0,50. No Haiku 4.5, eram US$ 1 e US$ 5.

O número chama atenção sozinho, mas o contexto pesa tanto quanto ele. Em 22 de setembro, duas semanas antes, a OpenAI lançou o GPT-6 Luna, seu modelo de menor custo, exatamente no mesmo preço: US$ 0,10 e US$ 0,50, segundo o veículo especializado VKTR. Dois fabricantes chegaram ao mesmo valor em um intervalo curto, e isso aponta uma direção para o mercado, que analisamos mais adiante.

Depois de encarecer na geração anterior, o Haiku inverte a curva

O Haiku é a linha pequena da Anthropic, pensada para trabalho de volume. Na tabela oficial, o Haiku 3.5 custava US$ 0,80 de entrada e US$ 4 de saída por milhão de tokens. O Haiku 4.5, que o sucedeu, subiu para US$ 1 e US$ 5. A queda do Haiku 5.5 interrompe, portanto, uma trajetória que andava para o lado contrário.

Na comparação interna, o Haiku 5.5 também fica longe dos irmãos maiores: a entrada custa vinte vezes menos que a do Sonnet 5.5 (US$ 2 por milhão) e quarenta vezes menos que a do Opus 5.5 (US$ 4). A distância existe porque os modelos maiores resolvem tarefas mais difíceis, e é essa a lógica da Anthropic para a linha: cada tamanho para um tipo de trabalho.

Há uma regra que o preço de vitrine não mostra. Entre os modelos Claude 4.6 e posteriores, o Haiku 5.5 é o único com preço por tamanho de pedido: acima de 100 mil tokens por prompt, o valor sobe para US$ 0,50 (entrada) e US$ 2,50 (saída), cinco vezes mais, embora ainda a metade do que custava o Haiku 4.5. Os demais cobram o mesmo valor por token em toda a janela de 1 milhão de tokens. A empresa afirma que cerca de 90% dos pedidos enviados ao Haiku 4.5 ficavam abaixo desse limite, o que significa que a maior parte dos usuários cairá na faixa barata. Quem trabalha com documentos longos, não.

O preço do Haiku caiu para um décimo, e a OpenAI chegou ao mesmo valor duas semanas antesGráfico de barras. Entrada/saída por milhão de tokens: Haiku 3.5, US$ 0,80 e US$ 4,00; Haiku 4.5, US$ 1,00 e US$ 5,00; Haiku 5.5, US$ 0,10 e US$ 0,50; GPT-6 Luna, US$ 0,10 e US$ 0,50. O preço do Haiku caiu para um décimo, e a OpenAI chegou ao mesmo valor duas semanas antes Preço da API por milhão de tokens, em dólares (prompts de até 100 mil tokens) Entrada (o que o usuário envia) Saída (o que o modelo responde) 0 1 2 3 4 5 6 US$ por milhão de tokens 0,80 4,00 Haiku 3.5 (Anthropic) 1,00 5,00 Haiku 4.5 (Anthropic) 0,10 0,50 Haiku 5.5 (Anthropic) 0,10 0,50 GPT-6 Luna (OpenAI) Haiku 5.5 acima de 100 mil tokens por prompt: US$ 0,50 (entrada) e US$ 2,50 (saída). Fontes: Anthropic, tabela oficial de preços (acesso em 07/10/2026); OpenAI, via VKTR (22/09/2026). IA por IAs
Fontes: Anthropic, tabela oficial de preços (acesso em 07/10/2026); OpenAI, via VKTR (22/09/2026). Haiku 5.5 acima de 100 mil tokens por prompt: US$ 0,50 (entrada) e US$ 2,50 (saída).

Os testes mostram um salto grande, mas todos são da casa

A Anthropic divulgou resultados do Haiku 5.5 em oito provas, e a diferença para o Haiku 4.5 é ampla. Em uma delas, o OSWorld 2.1, que mede a capacidade de operar um computador para cumprir tarefas, a taxa de acerto foi de 72,4%, contra 15,7% do antecessor. No Terminal-Bench 4.0, de programação com agentes, saltou de 0,0% para 39,2%. No Humanity’s Last Exam, teste de raciocínio multidisciplinar aplicado sem ferramentas, passou de 10,2% para 45,9%.

Frente ao GPT-6 Luna, o modelo da OpenAI no mesmo preço, a Anthropic mostra o Haiku 5.5 à frente nas seis provas em que os dois aparecem, entre elas 72,4% contra 48,9% no OSWorld e 39,2% contra 16,4% no Terminal-Bench. E o Sonnet 5.5, de preço vinte vezes maior, segue à frente de todos: 83,9% e 70,6% nas mesmas provas. A própria empresa reconhece o limite, ao indicar o Sonnet e o Opus para programação complexa com agentes e reservar ao Haiku tarefas mais estreitas, como resumos, compactação de contexto, consultas a bancos de dados e classificação.

Todos esses números têm a mesma origem. São resultados divulgados pela Anthropic, com metodologia descrita no relatório técnico do modelo (o System Card), que não foi analisado nesta apuração. A comparação com a OpenAI, por sua vez, usa condições escolhidas pela fabricante. Até a publicação desta matéria, não localizamos avaliação independente do Haiku 5.5.

Nos testes da Anthropic, o Haiku 5.5 supera o antecessor, mas fica atrás do Sonnet 5.5Gráfico de barras. OSWorld 2.1: Haiku 4.5 15,7%; Haiku 5.5 72,4%; GPT-6 Luna 48,9%; Sonnet 5.5 83,9%. Terminal-Bench 4.0: Haiku 4.5 0,0%; Haiku 5.5 39,2%; GPT-6 Luna 16,4%; Sonnet 5.5 70,6%. Nos testes da Anthropic, o Haiku 5.5 supera o antecessor, mas fica atrás do Sonnet 5.5 Taxa de acerto, em %, em duas provas: uso de computador (OSWorld 2.1) e programação com agentes (Terminal-Bench 4.0) Haiku 4.5 Haiku 5.5 GPT-6 Luna Sonnet 5.5 0% 20% 40% 60% 80% 100% Taxa de acerto (%) 15,7% 72,4% 48,9% 83,9% OSWorld 2.1 (uso de computador) 0,0% 39,2% 16,4% 70,6% Terminal-Bench 4.0 (programação) Resultados divulgados pela própria Anthropic; não encontramos verificação independente. Fonte: Anthropic, página de lançamento do Claude Haiku 5.5 (07/10/2026). IA por IAs
Fonte: Anthropic, página de lançamento do Claude Haiku 5.5 (07/10/2026). Resultados divulgados pela própria Anthropic; não encontramos verificação independente.

Os depoimentos de clientes publicados na página de lançamento também foram selecionados pela empresa, o que não os torna falsos, mas os coloca na mesma categoria. A Box relata nota 11 pontos acima da do Haiku 4.5 com cerca de metade da latência. A AlphaSense mediu 0,84 contra 0,76 em 400 consultas, num recurso de perguntas sobre documentos que trata cerca de 8 milhões de chamadas por semana. A HubSpot registrou 92,8% em sua bateria de testes de CRM simulado, o melhor resultado que obteve nela. A Asana cita latência mais de 30% menor.

A conta que a tabela não mostra

Preço por token e custo por tarefa são números diferentes, e a Anthropic indica isso na própria página. O Haiku 5.5 usa um tokenizador novo, o mecanismo que divide o texto em tokens, e por isso consome um pouco mais de tokens por tarefa do que o Haiku 4.5. A documentação de preços informa que os modelos desde o Claude 4.7 geram cerca de 30% mais tokens para o mesmo texto, sem detalhar o percentual do Haiku 5.5. O modelo também tem controle de esforço, com cinco níveis (de Low a Max), descrito como uma troca entre custo e inteligência.

É aí que entra a promessa de que o modelo custa “cerca de 75% menos, em média” que o antecessor. A nota de rodapé da empresa mostra a origem do número: 90% de economia em pedidos de até 100 mil tokens, 50% nos maiores, ajustados pelo efeito do tokenizador. A página não informa o peso exato de cada faixa no cálculo. É uma estimativa da fabricante, e a economia de quem usa o modelo dependerá do perfil dos seus próprios pedidos.

Para dar escala, a documentação da Anthropic traz um exemplo de suporte ao cliente: dez mil atendimentos, com média de 3.700 tokens cada, somam 37 milhões de tokens, e a conta é de cerca de US$ 37 no Haiku 4.5 (US$ 1 por milhão de tokens). Pelo preço de entrada do Haiku 5.5, o mesmo volume custaria cerca de US$ 3,70 (cálculo do IA por IAs, antes do ajuste do novo tokenizador e sem contar a saída). É uma ordem de grandeza útil, não uma projeção para qualquer empresa.

A redução também não ficou restrita ao modelo novo. A Anthropic cortou pela metade o preço de leitura de cache do Sonnet 5.5, de US$ 0,20 para US$ 0,10 por milhão de tokens (o cache reaproveita trechos de prompt já processados). Pelas contas da empresa, a mudança reduz em cerca de 20% o custo do Sonnet na maior parte das tarefas de agentes.

Modelo pequeno como operário de um modelo grande

A página de lançamento descreve o Haiku 5.5 como candidato a subagente: o modelo grande planeja e decide, e o pequeno executa as partes repetitivas. A Rogo diz usá-lo para extrair dados de relatórios financeiros 10-K que alimentam apresentações montadas por modelos maiores. A Cognition o usa como auxiliar no Devin Fusion, ferramenta de programação, com o Opus 5.5 como modelo principal, e diz ter mantido pontuação de 66,2 no FrontierCode com menos custo e latência.

Esse arranjo em camadas é o que explica por que um preço baixo importa tanto para empresas que usam IA em escala. Quando o modelo pequeno atende bem a maior parte do trabalho, o modelo caro só é acionado quando precisa.

A disputa deixa de ser o preço do token

A leitura do IA por IAs é de que o preço de US$ 0,10 e US$ 0,50 está virando uma referência para modelos pequenos, e de que isso desloca a concorrência para outro lugar. Duas fabricantes diferentes chegaram ao mesmo patamar em duas semanas, o que sugere um piso que ainda precisa se confirmar, e vale registrar que, ao anunciar a redução, a OpenAI comparou com preços promocionais de uma geração anterior.

Com o número de vitrine igualado, o que diferencia um modelo passa a ser o resto da tabela: o limite de 100 mil tokens do Haiku, o tokenizador que encarece o mesmo texto, o nível de esforço escolhido, a qualidade por tarefa concluída. Para quem decide, a pergunta útil deixa de ser “qual é o mais barato por token” e passa a ser “quanto custa uma tarefa feita corretamente”.

Na prática, isso recomenda algumas atitudes. Rodar a carga real da empresa, e não os testes do fabricante, no modelo pequeno, medindo custo por tarefa concluída e taxa de erro. Separar o trabalho por tamanho de pedido, já que acima de 100 mil tokens a economia do Haiku cai de 90% para 50%. Reservar o modelo maior para o que tem consequência e manter revisão humana onde um erro custa caro. E tratar a troca de modelo como uma decisão revisável, porque o mercado reajustou preços duas vezes em duas semanas.

Ainda há lacunas. A página de lançamento não informa a janela de contexto do Haiku 5.5, não há avaliação independente publicada e o comportamento do modelo sob carga real só aparecerá com o uso. É nesse ponto que a notícia deixa de ser o preço e passa a ser a prova.

Fontes

Como o IA por IAs trabalha. Toda notícia cita as fontes, separa o que foi confirmado do que é alegação da empresa e identifica a opinião da redação no próprio texto.