A Anthropic lançou o Claude Haiku 5.5, seu novo modelo pequeno de inteligência artificial (IA). Segundo a empresa, é o modelo pequeno mais rápido e mais barato que ela já fez. Ela afirma que o Haiku 5.5 custa em média 75% menos que o Haiku 4.5, a versão anterior. O modelo já está disponível nos serviços de nuvem da Amazon, do Google e da Microsoft.
Para o site The Decoder, o maior salto aparece quando o modelo opera um computador sozinho. Na prova OSWorld 2.1, o Haiku 5.5 marcou 72,4%, contra 15,7% do Haiku 4.5. Esse tipo de tarefa gasta muitos tokens, os pedaços de texto que o modelo processa. Por isso, segundo o site, um modelo barato e rápido combina com ela.
Segundo a Unite.AI, a tabela de testes da Anthropic mostra 1.620 pontos para o Haiku 5.5 numa prova de trabalho intelectual. O Haiku 4.5 tinha feito 735. No Humanity's Last Exam, um teste de conhecimento acadêmico de alto nível, foram 45,9% sem ferramentas e 57,4% com elas. O modelo anterior tinha marcado 10,2% e 18,7%.
No Terminal-Bench 4.0, teste de programação feita por agentes, programas de IA que agem sozinhos, a nota foi 39,2%. O Haiku 4.5 tinha zerado. Na mesma tabela, o novo modelo supera o GPT-6 Luna, modelo barato da OpenAI, em todas as categorias. Mas ainda fica bem atrás do Sonnet 5.5, modelo maior da Anthropic.
A Unite.AI relata que seis clientes contaram como foram os primeiros testes, em comentários divulgados pela Anthropic. Aaron Vinh, engenheiro de software da Asana, disse que o tempo para concluir tarefas caiu mais de 30% frente ao modelo que a Asana usa hoje. Yashodha Bhavnani, vice-presidente de produtos de IA da Box, afirmou que o modelo fez 11 pontos a mais que o Haiku 4.5, com cerca de metade do tempo de resposta.
Nos pedidos de até 100 mil tokens, o preço cai até 90%. A Anthropic diz que essa faixa reúne cerca de 90% dos pedidos já feitos ao Haiku. Segundo a Unite.AI, o milhão de tokens de entrada, o texto enviado ao modelo, passa de US$ 1 para US$ 0,10. O de saída, a resposta do modelo, cai de US$ 5 para US$ 0,50. Acima de 100 mil tokens, o preço é cinco vezes maior.
A Anthropic diz que o Haiku 5.5 foi feito para tarefas em grande volume, como resumos, consultas a bancos de dados e atendimento ao cliente ao vivo. É também o primeiro Haiku em que o usuário escolhe o nível de raciocínio, equilibrando custo e qualidade. Segundo a empresa, ele rende mais em tarefas bem delimitadas, como resumir textos ou fazer partes do trabalho de outro modelo.
A ficha técnica do modelo, segundo a Unite.AI, mostra que ele recusou 82,59% das tarefas maliciosas de uso do computador nos testes. O Haiku 4.5 tinha recusado 58,93%. A Anthropic afirma que as proteções aceitam mais tarefas de defesa digital que as do Sonnet 5.5. Mas testes de invasão seguem bloqueados.
No dia do lançamento, 7 de outubro de 2026, a Anthropic cortou pela metade o preço da leitura de cache no Sonnet 5.5, segundo a Unite.AI. O cache é o texto já processado que fica guardado para ser reaproveitado. O preço caiu de US$ 0,20 para US$ 0,10 por milhão de tokens. Segundo a empresa, isso deve baratear em cerca de 20% a maioria das tarefas de agentes.
Por que importa
A Anthropic avisa que o Haiku 5.5 usa um novo tokenizador, o sistema que corta o texto em tokens. Com ele, o modelo gasta um pouco mais de tokens por tarefa que o anterior. Nos modelos Opus 4.x, uma troca assim elevou o consumo em cerca de 30%, lembra o The Decoder. Por isso, segundo o site, a economia real deve ser menor do que os preços sugerem.
A plataforma de testes Artificial Analysis pôs o Haiku 5.5 no topo dos modelos pequenos, com 43 pontos, à frente do GPT-6 Luna, com 38. Mas, no nível máximo de esforço, ele gasta cerca de 162 mil tokens de saída por tarefa. É o triplo, aproximadamente, dos 50 mil do GPT-6 Luna. Nessa análise, o modelo da OpenAI fica à frente na relação entre desempenho e gasto.
A mesma plataforma mediu que o Haiku 5.5 inventa informação em 40% dos casos, contra 77% do rival. E, segundo a Unite.AI, a ficha técnica registra que ele recusou pedidos inofensivos mais vezes que qualquer outro modelo testado pela Anthropic numa auditoria automática.
