A Anthropic lançou o Claude Haiku 5.5 na quarta-feira, descrevendo-o como o modelo pequeno mais barato, rápido e capaz que já criou. Ele é direcionado para tarefas de alto volume, como resumir documentos e consultar bancos de dados, além de trabalhos sensíveis à velocidade, como suporte ao cliente em tempo real e operação de um navegador web para o usuário.
Desenvolvedores que integram o Claude em seus próprios produtos pagam US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída para prompts de até 100.000 tokens. Tokens são pequenos fragmentos de texto, aproximadamente três quartos de uma palavra, que os modelos de inteligência artificial leem e escrevem — e são por eles que as grandes empresas de IA cobram. Isso corresponde à taxa que a OpenAI estabeleceu para o GPT-6 Luna, seu modelo pequeno rival, quando foi lançado em 22 de setembro.
O Haiku 4.5 cobrava US$ 1 e US$ 5, então a nova taxa é 90% menor, enquanto os prompts acima de 100.000 tokens recebem um corte de 50%. Como cerca de 90% das solicitações ao modelo anterior estavam abaixo desse limite, e o Haiku 5.5 divide o texto em um número ligeiramente maior de tokens, a Anthropic estima a economia média em cerca de 75%.
Conversas de suporte ao cliente e resumos de e-mails longos são as tarefas para as quais a Anthropic construiu o Haiku. Portanto, tarefas essencialmente repetitivas, fáceis e não criativas são as mais adequadas para este modelo.
Dito isso, os benchmarks mostram que este não é, de forma alguma, um modelo “burro”. Por exemplo, no OSWorld 2.1, um teste de capacidade de uma IA de operar um computador real através de tarefas longas e de múltiplas etapas, pontuado como uma porcentagem de crédito parcial, o Haiku 5.5 supera o GPT Luna da OpenAI, marcando uma taxa de sucesso de 72,4% contra 48,9%.
Leia também: Google lança Nano Banana 2.1, IA de imagens com desempenho melhor e preço pela metade
O Terminal-Bench 4.0 atribui a agentes de IA tarefas profissionais para serem concluídas digitando comandos por conta própria, e pontua a proporção concluída corretamente na primeira tentativa. O Haiku 5.5 atingiu 39,2%, contra 16,4% para o Luna da OpenAI e 0% para o Haiku 4.5.
Para comparação, o Claude Sonnet 5.5 da Anthropic marcou 70,6%.
Testamos o modelo com uma simples questão de lógica e ele respondeu extremamente rápido, quase instantaneamente. Também deu a resposta errada, o que não é o que se espera de um modelo, então é preciso ter cuidado ao confiar cegamente nele.
No GDPval-AA v2.1, que avalia modelos em trabalhos profissionais reais em 44 ocupações usando uma escala Elo — o sistema de classificação mano a mano emprestado do xadrez —, o Haiku 5.5 obteve uma pontuação de 1620. O Luna alcançou 1437 e o Haiku 4.5, 735.
Este também é o primeiro modelo Haiku com uma configuração de esforço ajustável, um seletor que permite aos usuários trocar custo por respostas mais inteligentes. A Anthropic também reduziu pela metade o preço de leitura de cache do Sonnet 5.5 para US$ 0,10 por milhão de tokens, a taxa com desconto para textos que um modelo já processou.
O Haiku 5.5 chega 15 dias após o Opus 5.5, em 22 de setembro, e nove dias após o Sonnet 5.5, em 28 de setembro, sendo este o último dos três modelos Claude 5.5 que a Anthropic havia prometido. O Opus 5.5 foi o primeiro lançamento desde que o CEO Dario Amodei publicou um ensaio instando a indústria a desacelerar os avanços nas capacidades de inteligência artificial.
O Haiku 5.5 está disponível agora no site do Claude, Amazon Web Services, Google Cloud e Microsoft Azure sob o nome claude-haiku-5-5. A Anthropic também está lançando créditos mensais de API esta semana: US$ 100 para assinantes do plano Max 5x, US$ 200 para o Max 20x e até US$ 500, compartilhados entre os usuários, para planos Team.
* Traduzido e editado com autorização do Decrypt.
Procurando uma alternativa para aumentar seus ganhos? A Renda Fixa Digital do MB é a solução: até 18% de ganho ao ano, risco controlado e a segurança que seu dinheiro merece. Conheça agora!