A Anthropic anunciou o Claude Haiku 5.5, modelo compacto voltado a tarefas repetitivas e de alto volume, como resumir textos, classificar dados e consultar bancos de dados. A empresa afirma que operar o modelo custa cerca de 75% menos, em média, do que operar o Haiku 4.5. O texto não informa preços por unidade de uso, então não é possível calcular quanto uma aplicação específica economizaria.
Segundo a Anthropic, o Haiku 5.5 é seu modelo mais rápido na configuração padrão. Ele também estreia na linha Haiku um ajuste de esforço: desenvolvedores podem priorizar uma execução mais econômica ou mais capacidade de raciocínio, conforme a tarefa. A empresa aponta atendimento ao cliente e navegação na web como exemplos de usos em tempo real.
O que mostram os testes?
Os resultados divulgados para três avaliações são superiores aos do Haiku 4.5: no OSWorld 2.1, de 15,7% para 72,4%; no Terminal-Bench 4.0, de 0,0% para 39,2%; e no Humanity’s Last Exam, de 10,2% para 45,9%. Os testes tratam, respectivamente, do uso do computador, de programação com agentes e de raciocínio multidisciplinar sem ferramentas.
O texto não especifica quem conduziu essas avaliações nem detalha as configurações usadas. Portanto, os números não bastam para concluir como o modelo se sairá em tarefas reais ou em testes independentes.
Onde está disponível?
O modelo está disponível na Claude Platform, na AWS, no Google Cloud e no Microsoft Azure. Na plataforma da Anthropic, desenvolvedores podem selecioná-lo pelo identificador claude-haiku-5-5. Os SDKs para Python e TypeScript receberam suporte beta a recursos de uso do computador e do navegador.
O Haiku 5.5 também pode funcionar como subagente de programação junto aos modelos maiores Opus 5.5 e Sonnet 5.5. A Anthropic anunciou créditos mensais de API para alguns assinantes: US$ 100 no Claude Max 5x, US$ 200 no Max 20x e até US$ 500 compartilhados no plano Team.
Por que importa
Para desenvolvedores que processam muitos resumos, classificações ou consultas, o Haiku 5.5 pode reduzir custos e oferecer uma opção de resposta rápida, segundo a Anthropic. O valor economizado em cada aplicação continua incerto: a fonte não dá preços por uso nem resultados de validação independente.