A Anthropic lançou na segunda-feira (28) o Claude Sonnet 5.5, segundo modelo da família Claude 5.5, depois do Opus 5.5. Segundo o anúncio oficial, o modelo roda pelo menos 30% mais rápido e custa até 30% menos que o Sonnet 5 na maior parte das tarefas, com o mesmo preço por token.
Desempenho e preço
O Sonnet 5.5 é, segundo a Anthropic, o complemento mais rápido e barato do Opus 5.5: o Opus 5.5 foi feito para trabalho complexo que exige julgamento cuidadoso, e a empresa diz que o Sonnet 5.5 é mais forte em tarefas cotidianas bem delimitadas, correção de bugs e criação de documentos, slides e planilhas, com o que a Anthropic chama de "olho afiado para design".
Em avaliação própria da empresa, o Sonnet 5.5 marca 70,6% no Terminal-Bench 4.0, teste de codificação agêntica, contra 10,3% do Sonnet 5. No GDPval-AA, teste de trabalho em ocupações reais, o novo modelo fica dois pontos atrás do Opus 5.5. A Anthropic também diz que o Sonnet 5.5 é o primeiro modelo Sonnet a vencer o jogo Pokémon Red trabalhando só a partir de capturas de tela.
O preço por token não muda em relação ao Sonnet 5. Segundo a tabela publicada pela Anthropic, em dólares por milhão de tokens:
| Item | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| Entrada | US$ 2 | US$ 4 |
| Saída | US$ 10 | US$ 20 |
| Leitura de cache | US$ 0,20 | US$ 0,20 |
| Escrita de cache | US$ 2,50 | US$ 5 |
Segundo a Anthropic, o modelo precisa de bem menos tokens para fazer o mesmo trabalho, o que leva ao corte de até 30% no custo por tarefa em relação ao Sonnet 5, e a saída é gerada pelo menos 30% mais rápido.
Segurança e resguardos
Na auditoria comportamental automatizado da empresa, que testa o Claude em cerca de 1.850 cenários, o Sonnet 5.5 melhora ou iguala o Sonnet 5 na maioria das medidas de alinhamento, resistência a uso indevido e honestidade, segundo a Anthropic.
A empresa diz que a capacidade cibernética do Sonnet 5.5 é uma grande melhoria em relação ao Sonnet 5, por isso ele é implantado com resguardos parecidos com os do Opus 5.5: usuários continuam podendo encontrar e corrigir bugs no desenvolvimento de software comum, mas tarefas de segurança cibernética de risco mais alto caem automaticamente para o Sonnet 5. Os resguardos de biologia do Sonnet 5.5 são os mesmos do Sonnet 5: miram pedidos nocivos, e a Anthropic diz que a maior parte do trabalho de pesquisa, educação e clínico não é afetada, embora alguns pedidos de microbiologia e virologia possam ser sinalizados por engano.
A Anthropic apresenta o Sonnet 5.5 como o primeiro modelo Sonnet a sair com classificadores de segurança contra extração de raciocínio, defesa contra ataques de destilação em que agentes maliciosos usam milhares de contas falsas para copiar as capacidades de um modelo em escala industrial. O recurso de "pensamento preservado", que impede que o raciocínio do Claude seja separado da conta que o criou, também foi ampliado no Sonnet 5.5.
Disponibilidade
Segundo a Anthropic, o Claude Sonnet 5.5 já está disponível em todas as plataformas da empresa, incluindo Amazon Web Services, Google Cloud e Microsoft Azure, com retenção zero de dados, no mesmo padrão do Opus 5.5 e do Sonnet 5. Na Claude Platform, o identificador do modelo para desenvolvedores é claude-sonnet-5-5. A empresa também informa que um Claude Haiku 5.5, voltado a aplicações de alto volume e sensíveis a custo, deve chegar nas próximas semanas para completar a família Claude 5.5.
Por que importa
O Sonnet 5.5 chega seis dias depois do Opus 5.5, lançado em 22 de setembro, o que mostra a rapidez com que a Anthropic está renovando a família Claude 5.5, e a promessa de um Haiku 5.5 "nas próximas semanas" indica que o ciclo não para por aí. Para quem usa Claude em tarefas do dia a dia (atendimento, revisão de texto, planilhas, automação simples), o dado mais prático do lançamento é o corte de até 30% no custo por tarefa sem mudança no preço por token: o mesmo orçamento cobre mais volume de trabalho, com o mesmo modelo de cobrança que quem já usa o Sonnet 5 conhece.