Pular para o conteúdo

Anthropic lança Claude Haiku 5.5, seu modelo de IA mais rápido e 75% mais barato

Anthropic lançou o Claude Haiku 5.5, seu modelo pequeno mais rápido e barato. A nova IA tem contexto de 1 milhão de tokens e custa em média 75% menos que o Haiku 4.5.

Por · · 5 min de leitura
Notebook exibindo Claude Haiku 5.5 em um ambiente de inteligência artificial
Imagem ilustrativa gerada por IA
Publicidade

A Anthropic lançou nesta quarta-feira (7) o Claude Haiku 5.5, nova versão do seu modelo de inteligência artificial voltado a tarefas rápidas e de grande volume. Segundo a empresa, ele é o Haiku mais rápido, barato e capaz já lançado e custa, em média, cerca de 75% menos para operar do que o Claude Haiku 4.5.

O lançamento completa, por enquanto, a família Claude 5.5, que já conta com os modelos Opus 5.5 e Sonnet 5.5. A ideia da Anthropic é oferecer opções diferentes para cada tipo de uso: modelos maiores para tarefas complexas e um modelo menor para situações em que velocidade e custo são mais importantes.

O que é o Claude Haiku 5.5?

O Haiku é a linha de modelos mais leves da Anthropic. Em vez de tentar ser sempre o modelo mais poderoso da empresa, ele é pensado para responder rapidamente e executar muitas tarefas gastando menos recursos.

Na prática, isso torna o Claude Haiku 5.5 especialmente indicado para atividades como:

  • resumir grandes quantidades de textos;
  • classificar documentos e mensagens;
  • extrair informações de bancos de dados;
  • atender clientes em tempo real;
  • operar assistentes dentro de aplicativos;
  • realizar tarefas rápidas em navegadores;
  • funcionar como um “subagente” de modelos mais poderosos em trabalhos de programação.

Para o usuário comum, a diferença pode ser percebida principalmente na velocidade. Para empresas e desenvolvedores, o ganho mais importante tende a ser o custo menor para rodar milhares ou milhões de solicitações.

Quanto custa o Claude Haiku 5.5?

Na API da Anthropic, o novo modelo tem preço inicial de US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída em solicitações com até 100 mil tokens.

Em solicitações maiores, o preço sobe para US$ 0,50 por milhão de tokens de entrada e US$ 2,50 por milhão de tokens de saída.

Um token é, de forma simplificada, uma pequena unidade de texto processada pela inteligência artificial. Empresas que usam IA em atendimento, automação, análise de documentos ou programação normalmente pagam de acordo com a quantidade desses tokens.

Segundo a Anthropic, considerando o uso típico do modelo anterior, o Haiku 5.5 custa em média cerca de 75% menos para executar a mesma categoria de trabalho. Em solicitações de até 100 mil tokens, o preço por token chega a ser 90% menor que o do Haiku 4.5.

Contexto de 1 milhão de tokens

Outra mudança importante é a capacidade de trabalhar com uma quantidade muito maior de informação de uma só vez. O Claude Haiku 5.5 oferece uma janela de contexto de 1 milhão de tokens.

Isso permite, por exemplo, enviar grandes conjuntos de documentos, códigos de programação extensos ou enormes volumes de texto para análise dentro da mesma tarefa.

O modelo também pode gerar respostas de até 128 mil tokens e utiliza o chamado adaptive thinking, recurso que permite ajustar quanto esforço de raciocínio a IA deve usar dependendo da complexidade da tarefa.

Mais rápido, mas não necessariamente melhor para tudo

O lançamento não significa que o Haiku 5.5 substitua os modelos Sonnet 5.5 ou Opus 5.5.

A própria Anthropic posiciona cada modelo para uma necessidade diferente. O Haiku é voltado para velocidade, escala e baixo custo. O Sonnet busca um equilíbrio entre desempenho e preço, enquanto o Opus é indicado para tarefas mais complexas que exigem maior capacidade de análise.

Em outras palavras: para responder milhares de perguntas simples em um serviço de atendimento, o Haiku pode fazer mais sentido. Para desenvolver um sistema complexo, analisar informações difíceis ou executar longas tarefas de programação, modelos maiores ainda podem ser a melhor escolha.

Claude Haiku 5.5 chega a várias plataformas

O novo modelo já está disponível na plataforma da Anthropic e também pode ser utilizado por desenvolvedores por meio de serviços como Amazon Web Services, Google Cloud e Microsoft Foundry.

O identificador utilizado na API da Anthropic é claude-haiku-5-5.

Além do novo modelo, a Anthropic também anunciou uma redução no preço de leitura de cache do Claude Sonnet 5.5. Segundo a empresa, a mudança pode reduzir em aproximadamente 20% o custo de muitos trabalhos realizados por agentes de IA.

Assinantes dos planos Claude Max e Team também começarão a receber créditos mensais de API para criar aplicativos e agentes usando a Claude Platform.

Por que esse lançamento é importante?

Grande parte da disputa atual entre empresas de inteligência artificial não está apenas em quem possui o modelo mais inteligente. Velocidade e preço estão se tornando tão importantes quanto capacidade.

Para uma pessoa fazendo algumas perguntas por dia, pequenas diferenças no custo de processamento quase não aparecem. Mas para empresas que executam milhões de tarefas diariamente, reduzir o custo de cada solicitação pode representar uma economia significativa.

Esse é justamente o mercado que o Claude Haiku 5.5 tenta atender: aplicações em que a IA precisa trabalhar continuamente, responder rápido e custar pouco.

A família Claude 5.5 fica mais completa

O Haiku 5.5 é o terceiro modelo da geração Claude 5.5 lançado pela Anthropic em poucas semanas, depois do Opus 5.5 e do Sonnet 5.5.

Com isso, a empresa passa a oferecer uma linha mais claramente dividida entre inteligência máxima, equilíbrio e velocidade. Essa estratégia é semelhante ao que outras empresas de IA vêm fazendo ao criar versões diferentes de seus modelos para tarefas e faixas de preço distintas.

Para o público, a consequência mais importante deve aparecer aos poucos: serviços de inteligência artificial mais rápidos e baratos podem permitir que recursos baseados em IA sejam incluídos em muito mais aplicativos, sites, sistemas de atendimento e ferramentas de produtividade.

Fontes: documentação oficial e notas de lançamento da Anthropic, além de informações publicadas pela Reuters em 7 de outubro de 2026.

Redação Code Tech Connect

Equipe editorial do Code Tech Connect. Escrevemos sobre tecnologia, viagens e o que move o dia a dia conectado.

Leia também