Claude Opus 5.5 é lançado pela Anthropic, focando em programação e tarefas complexas no uso de computadores

Na última terça-feira (22), a Anthropic anunciou o lançamento do Claude Opus 5.5, que marca a estreia da nova linha Claude 5.5. A empresa destaca que esta versão aprimorou o desempenho em áreas como programação, operações em computadores e tarefas de conhecimento, além de oferecer um custo reduzido e maior agilidade.

Este novo modelo incorpora mecanismos de segurança mais robustos, incluindo defesas contra ciberataques e questões biológicas, além de proteções contra ataques por injeção de comandos e medidas para minimizar tentativas de burlar os limites em ambientes controlados.

Desempenho superior com economia

Nos testes realizados pela Anthropic, o Opus 5.5 obteve os melhores resultados já registrados pela empresa em seu teste automatizado de alinhamento. Também foram observados avanços significativos nas áreas de programação, operações com computadores e tarefas cognitivas.

Em uma das primeiras avaliações, um usuário conseguiu migrar um código com 680 mil linhas em menos de 24 horas. Em outra situação, o modelo demonstrou eficiência ao reduzir o tempo de carregamento de páginas em um aplicativo em 39 das 40 tentativas realizadas.

Além disso, os custos operacionais também diminuíram. A Anthropic informou que operar o Opus 5.5 é 40% mais barato comparado ao Opus 5 durante cargas de trabalho típicas e que as respostas são geradas com uma velocidade mais rápida, superando os 30% em relação à versão anterior.

Os preços por cada milhão de tokens são os seguintes:

  • US$ 4 (aproximadamente R$ 20,40) para tokens de entrada;
  • US$ 20 (cerca de R$ 102,20) para tokens de saída;
  • US$ 0,20 (por volta de R$ 1,02) para leituras em cache;
  • US$ 5 (cerca de R$ 25,55) para gravações em cache.

Foco na segurança do lançamento

O Claude Opus 5.5 é a primeira novidade da Anthropic após a empresa propagar a ideia de “desacelerar a fronteira” no desenvolvimento da inteligência artificial, assegurando que as práticas seguras acompanhem o progresso das capacidades dos modelos.

Conforme os testes realizados pela companhia, o novo modelo apresentou uma redução significativa nas tentativas de contornar as restrições dos ambientes controlados, mostrando cerca de 85% menos ocorrências quando comparado ao Opus 5 ou ao Claude Mythos 5.1. Todas as tentativas foram classificadas como não graves e relatadas pelo próprio modelo.

A Anthropic também ressalta que o Opus 5.5 possui maior resistência contra ataques por injeção de comandos. Para solicitações relacionadas à cibersegurança que acionem as proteções do sistema, estas serão redirecionadas ao Claude Opus 4.8; enquanto pedidos vinculados à biologia poderão ser encaminhados ao Opus 5.

Feedback dos avaliadores iniciais

As primeiras avaliações ressaltaram especialmente o desempenho do modelo em programação. Mario Rodriguez, diretor de produto do GitHub, comentou que o novo modelo utilizou alguns dos menores números registrados quanto a tokens e etapas e conseguiu resolver mais tarefas no terminal do VS Code que seu antecessor Opus 5 utilizando menos da metade das etapas necessárias.

Leia mais:

  • Anthropic, OpenAI, SpaceXAI e Google enfrentam acusações por suposto acordo ilegal visando limitar o avanço da IA;
  • A empresa coloca avaliadores externos para testar a segurança dos seus modelos de IA;
  • A IA ajudando na criação: Anthony revela que Claude já lidera parte do desenvolvimento tecnológico futuro.

Na perspectiva da Deloitte Consulting, o desempenho do modelo superou o do Opus 5 em várias tarefas específicas. Carl Bennett, CIO da Deloitte, afirmou: “Mesmo na configuração com menor esforço do Claude Opus 5.5, conseguimos captar 72% dos erros conhecidos durante nossas revisões de código; enquanto o Opus 5 obteve apenas 56% sob alta demanda, com menos falsos alarmes e uma quantidade reduzida de saídas.”

Comunicação aprimorada e lançamentos futuros

A Anthropic também alterou a forma como seu modelo se comunica. O Opus 5.5 prioriza as informações mais relevantes no início das respostas, utiliza uma linguagem menos técnica e segue melhor as diretrizes fornecidas pelos usuários.

Um dos avaliadores resumiu essa evolução dizendo: “ele escreve como eu escrevo”.

O Claude Opus 5.5 já pode ser acessado nas plataformas da Anthropic assim como nos serviços da Amazon Web Services, Google Cloud e Microsoft Azure. Desenvolvedores têm acesso ao modelo através da Claude Platform utilizando o identificador claude-opus-5-5.

Ainda este mês serão lançados os modelos Claude Sonnet 5.5 e Claude Haiku 5.5.

Deixe um comentário