Anthropic apresenta Claude Opus 5.5, novo modelo que mira programação, uso de computador e trabalhos complexos
5. A empresa afirma que a nova versão melhora o desempenho em programação, uso de computadores e tarefas de conhecimento, com custo menor e maior velocidade. O modelo também chega com mecanismos de segurança mais rígidos.
Entre eles estão proteções para cibersegurança e biologia , defesas contra ataques de prompt injection e medidas para reduzir tentativas de contornar limites de ambientes de teste. 5 custa 40% menos para operar que o Opus 5 e gera respostas mais de 30% mais rápido em cargas de trabalho típicas. 5 apresentou o melhor resultado da empresa até agora em seu principal teste automatizado de alinhamento.
A companhia também registrou avanços em programação, uso de computadores e tarefas de conhecimento. Um dos primeiros avaliadores concluiu uma migração de código com 680 mil linhas em menos de um dia. Em outro teste, o modelo conseguiu reduzir o tempo de carregamento de páginas de um aplicativo em 39 de 40 tentativas.
O custo também caiu. 5 custa 40% menos para operar que o Opus 5 em cargas de trabalho típicas e gera respostas mais de 30% mais rápido. Os preços por 1 milhão de tokens são: US$ 4 (cerca de R$ 20,40) para tokens de entrada; US$ 20 (cerca de R$ 102,20) para tokens de saída; US$ 0,20 (cerca de R$ 1,02) para leituras de cache; US$ 5 (cerca de R$ 25,55) para gravações de cache.
5 é o primeiro lançamento da Anthropic depois de a empresa defender a ideia de “desacelerar a fronteira” do desenvolvimento de IA, mantendo as práticas de segurança próximas do avanço das capacidades dos modelos. 1. Todas as tentativas registradas foram consideradas de baixa gravidade e relatadas pelo próprio modelo.
5 é mais resistente a ataques de prompt injection. 8. Já pedidos relacionados à biologia poderão ser direcionados ao Opus 5.
A Anthropic reduziu em 85% as tentativas do modelo de burlar o ambiente isolado de testes durante as avaliações. – Imagem: bella1105/Shutterstock O que dizem os primeiros avaliadores Os primeiros testes também destacaram o desempenho em programação. Mario Rodriguez, diretor de produto do GitHub, afirmou que o modelo usou alguns dos menores números de tokens e etapas registrados pela empresa e resolveu mais tarefas de terminal que o Opus 5 no VS Code usando menos da metade das etapas.
Leia mais: Anthropic, OpenAI, SpaceXAI e Google são acusadas de fazer acordo ilegal para frear avanço da IA Anthropic coloca avaliadores externos dentro da empresa para testar a segurança dos seus modelos de IA IA fazendo IA: Anthropic revela que Claude já lidera parte do trabalho para criar tecnologias do futuro Na avaliação da Deloitte Consulting, o modelo também apresentou resultados superiores ao Opus 5 em determinadas tarefas. ” Comunicação e próximos lançamentos A Anthropic também modificou a forma como o modelo escreve. 5 coloca as informações mais importantes no início das respostas, usa menos jargões e segue melhor as regras de escrita fornecidas pelo usuário.
Um dos primeiros avaliadores resumiu a mudança dizendo: “ele escreve como eu escrevo”. 5 já está disponível nas plataformas da Anthropic, além de Amazon Web Services, Google Cloud e Microsoft Azure. Desenvolvedores podem acessá-lo na Claude Platform pelo identificador claude-opus-5-5 .
5 serão lançados nas próximas semanas. 5, novo modelo que mira programação, uso de computador e trabalhos complexos apareceu primeiro em Olhar Digital . ]]>
Resumo publicado pelo SJX NEWS. O conteúdo integral pertence ao veículo de origem.
Leia a matéria completa em Olhar Digital →
