Claude Sonnet 5.0
A empresa Anthropic acaba de lançar a versão 5.0 do seu modelo de tamanho médio, Sonnet, que promete ser o mais “agente” até o momento. Para os desenvolvedores que criam agentes para automatizar tarefas tediosas e recorrentes, o Sonnet 5 promete melhorias nas capacidades de raciocínio, uso de ferramentas, codificação e trabalho de conhecimento. Além disso, essa versão é menos propensa a cometer erros constrangedores, como a falta de compreensão, afirma a empresa. De acordo com um post de blog introdutório publicado na terça-feira, as avaliações de segurança da empresa encontraram que o Sonnet 5 apresenta uma taxa geral mais baixa de comportamentos indesejados em comparação com o Sonnet 4.6 e é geralmente mais seguro para uso em contextos agente.
O Sonnet 5 é mais inteligente ao recusar solicitações maliciosas e resistir a tentativas de injeção de prompts. Ele também não “halucina” tanto e não se curva às vontades do usuário, como fazia o seu antecessor, o Sonnet 4.6. Além disso, o Sonnet 5 é mais consciente do uso indevido e da tentativa de enganar o usuário, de acordo com os benchmarks do System Card da Anthropic. O Sonnet é o modelo padrão para os usuários do Claude Free e Pro, e também está disponível para os clientes do Max, Team e Enterprise. Os benchmarks também indicam que o desempenho do Sonnet 5 pode se aproximar do desempenho do modelo de empresa da Anthropic, o Opus 4.8, mas pode executar as mesmas tarefas de forma mais econômica.
Starting em setembro, os usuários do Sonnet pagarão $3 por milhão de tokens de entrada e $15 por milhão de tokens de saída, embora a Anthropic esteja oferecendo uma promoção especial até o final de agosto, onde os tokens custarão apenas $2 por milhão de entradas e $10 por milhão de saídas. Isso significa que os usuários podem executar tarefas no Sonnet em vez de no Opus, sugerindo a empresa. A versão 5.0 do Sonnet oferece uma nova configuração para ajustar o esforço do modelo para completar tarefas. Tarefas simples podem ser concluídas com uma das configurações de “esforço” mais baixas, que usa menos tokens, enquanto tarefas baseadas em agente que duram mais tempo podem ser executadas com o esforço máximo (“xhigh” ou até “max”).
Por grande parte de 2026, o foco do desenvolvimento de produtos de IA tem sido equipar modelos de linguagem grande para completar o que se tornou conhecido como “tarefas de longo horizonte”. Pode ser fácil para um modelo consertar um bug ou criar algum código, mas manter sua atenção fixa em uma tarefa de múltiplas partes tem se mostrado mais difícil. A nova versão do Sonnet pode ir a distância, de acordo com a empresa, em comparação com as versões anteriores do Sonnet. “Em uma ampla gama de benchmarks internos e de terceiros, o Sonnet 5 mostra ganhos claros sobre o Claude Sonnet 4.6 em codificação, busca agente, raciocínio multimodal e desempenho de tarefas profissionais”, afirma o System Card.
No entanto, o desempenho nessas tarefas ainda está abaixo do desempenho dos modelos Opus e Mythos. Um depoimento de um engenheiro da Zapier descreveu um trabalho de duas partes que confundiu as versões anteriores do Sonnet: atualizar um banco de dados de contatos e enviar um aviso a todos os usuários. A versão 5 foi capaz de concluir a tarefa “do início ao fim”. A empresa com sede em San Francisco também se esforçou para não atrair mais atenção indevida dos formuladores de políticas de Washington, DC. “Não treinamos deliberadamente o Sonnet 5 em tarefas de cibersegurança”, afirma a empresa. Em junho, o Departamento de Comércio dos EUA, citando preocupações de segurança nacional, impôs uma diretriz de controle de exportação à Anthropic, restringindo temporariamente o acesso estrangeiro aos novos modelos Mythos 5 e Fable 5.
Se a Anthropic trouxe isso para si mesma – através do que pode ser considerado como afirmações hiperbólicas dos poderes de bug-sleuthing do Mythos – é certamente algo a ser discutido. No entanto, a Anthropic, como Pete Townshend, certamente não será enganada novamente. Embora possa realizar facilmente tarefas de cibersegurança rotineiras, o Sonnet 5 é protegido contra a geração de código de ataque ofensivo. Quando comandado a escrever uma exploração do Firefox, ele não conseguiu concluir a tarefa (embora tenha ido um pouco mais longe do que o Sonnet 4.6 na tentativa). “Essa mudança posterior é provavelmente devido a melhorias na inteligência geral, em vez de treinamento específico”, observa o post de blog da empresa.
Essa decisão da Anthropic de se manter longe das questões de cibersegurança pode ser vista como uma resposta às crescentes preocupações sobre a segurança nacional e a possibilidade de que as tecnologias de IA sejam usadas para fins mal-intencionados. No entanto, é importante notar que o Sonnet 5 ainda é capaz de realizar tarefas complexas e pode ser uma ferramenta valiosa para os desenvolvedores e as empresas que buscam automatizar processos e melhorar a eficiência. Com o lançamento do Sonnet 5, a Anthropic está se posicionando como uma líder no mercado de IA e está demonstrando seu compromisso em criar tecnologias seguras e confiáveis para os usuários.
Além disso, o Sonnet 5 também oferece uma nova configuração para ajustar o esforço do modelo para completar tarefas, o que pode ser útil para os desenvolvedores que precis