Anthropic apresenta Claude Sonnet 5: recursos agentes estão se tornando mais acessíveis

5 julho 20265 visualizações

O novo modelo médio da Anthropic aborda as capacidades da Opus 4.8, mas custa significativamente menos. Ele já se tornou o padrão para assinaturas gratuitas e Pro, e desenvolvedores podem economizar em agentes em execução graças a preços temporários.

Anthropic apresenta Claude Sonnet 5: recursos agentes estão se tornando mais acessíveis

Capacidades de agente tornam-se a linha de base

A Anthropic apresentou oficialmente Claude Sonnet 5 — uma nova versão de seu modelo de médio porte que torna os fluxos de trabalho agenticos acessíveis a uma gama mais ampla de usuários. De acordo com a empresa, o modelo pode fazer planos de forma independente, usar um navegador e terminal e completar tarefas sem supervisão constante — um nível de autonomia que até recentemente exigia soluções emblemáticas e caras. Com o lançamento do Sonnet 5, fica claro que os recursos agentic não são mais a prerrogativa de modelos top-tier e estão se tornando o padrão para cada segmento de preço. A competição está agora mudando para o preço e confiabilidade, em vez de simplesmente a presença de capacidades "agentes".

Desempenho e preços

Os desenvolvedores prometem que Claude Sonnet 5 oferece resultados próximos ao Opus 4.8, mas com um custo muito menor. A partir de 30 de junho, o modelo torna-se o modelo padrão em planos gratuitos e Pro, e também está disponível em todas as assinaturas. No lançamento, um preço especial está em vigor: $2 por milhão fichas de entrada e $10 por milhão fichas de saída até 31 de agosto, após o qual o preço vai subir para $3 e $15, respectivamente.

De acordo com Anthropic, o novo modelo supera significativamente seu antecessor — Sonnet 4.6, lançado em fevereiro — em raciocínio, uso de ferramentas, escrita de código e trabalho de conhecimento. No referencial de codificação agente, Sonnet 5 pontua 63,2%, enquanto Opus 4,8 69,2% e Sonnet 4,6 58,1%. Ao mesmo tempo, nos testes de conhecimento, o Sonnet 5 ainda supera ligeiramente Opus 4.8. Anthropic enfatiza que Opus 4.8 continua a ser a escolha para máxima precisão, mas Sonnet 5 oferece aos desenvolvedores opções muito melhores de baixo custo. Os usuários podem ajustar o nível de esforço entre os dois modelos, escolhendo o equilíbrio certo de desempenho e orçamento.

Em termos de preço, Sonnet 5 é mais barato do que GPT-5.5 da OpenAI e da Gemini 3.1 Pro do Google, mas mais caro do que a Gemini 3.5 Flash.

Impressões sobre segurança e desenvolvimento

Testers cujo feedback Anthropic cita nota que Claude Sonnet 5 é melhor em levar tarefas complexas até a conclusão, enquanto versões anteriores muitas vezes parou a meio caminho. O modelo também verifica seus próprios resultados por conta própria, mesmo quando não solicitado. Por exemplo, Daniel Shepard, engenheiro sênior da Zapier, disse que a Sonnet 5 completou uma tarefa de duas partes do início ao fim: atualizou contas na Salesforce e enviou um anúncio para contatos corporativos. Anteriormente, segundo ele, cenários semelhantes "ficariam presos".

Quanto à segurança, o novo modelo apresenta um comportamento indesejável menos frequente: é melhor recusar pedidos maliciosos, é mais resiliente para desencadear injeções, alucina menos frequentemente e é menos propenso à sicofania em comparação com Sonnet 4.6. Ao mesmo tempo, ainda segue Opus 4.8 e Claude Mythos Preview em sua capacidade de resistir ao comportamento desalinhado. Anthropic também observa que Sonnet 5 tem uma capacidade significativamente menor para executar tarefas perigosas de segurança cibernética do que os atuais modelos Opus. Fabian Hedin, co-fundador de Lovable, confirmou que Claude Sonnet 5 "limpamente e consistentemente recusa pedidos inseguros".

Perguntas mais frequentes

Claude Sonnet 5 — Revisão do novo modelo Antrópico com preços