Melhorias de preço e desempenho
A Anthropic anunciou o lançamento de seu novo modelo, Opus 5.5, na terça-feira, posicionando-o como o novo padrão para tarefas de programação e trabalho intelectual. O modelo está no topo da linha de três camadas da empresa, acima do intermediário Sonnet e do rápido e econômico Haiku. Segundo a Anthropic, o Opus 5.5 supera o modelo maior Fable em muitos testes de benchmark e tem sucesso em tarefas informais nas quais o Fable falhou.
Além dos ganhos de desempenho, o Opus 5.5 é significativamente mais barato. O custo por token de saída foi fixado em US$ 20 por milhão de tokens, uma redução em relação aos US$ 25 da versão anterior. A redução de preço se estende a outras métricas, e o modelo também requer menos capacidade de processamento, resultando em execução mais rápida.
A nova versão também aprimora seu estilo de comunicação. O Opus 5.5 tem menos probabilidade de usar jargões e tende a colocar as informações principais no início de suas respostas.
Posicionamento competitivo e salvaguardas
O lançamento ocorre dois meses após o lançamento do Opus 5, em 24 de julho. A Anthropic indicou que o Sonnet 5.5 e o Haiku 5.5 chegarão nas próximas semanas com melhorias de desempenho semelhantes.
As capacidades do Opus 5.5 em biologia e cibersegurança são comparáveis ao modelo Mythos, o que exige as mesmas salvaguardas aplicadas ao modelo Fable. Essas medidas restringem o uso do modelo para descobrir vulnerabilidades em programas compilados ou criar armas biológicas reconhecíveis, entre outras tarefas proibidas.
Compromissos de alinhamento e segurança
O CEO Dario Amodei adotou uma estratégia de controle do ritmo de progresso de fronteira. Em uma postagem deste mês, ele escreveu:
Estou convencido de que enfrentar completamente os riscos exige ainda mais prudência, não apenas investir na prevenção de riscos, mas controlar a velocidade do avanço das capacidades para que a prevenção de riscos tenha tempo de acompanhar.
O treinamento de segurança do Opus 5.5 segue o mesmo padrão de seus predecessores, incorporando testes de alinhamento e avaliação pré-lançamento por grupos externos como METR e Frontier Design. A Anthropic observou que sistemas de treinamento e avaliação mais avançados já estão em desenvolvimento para modelos futuros, incluindo ferramentas aprimoradas de segurança e monitoramento.
Refletindo sobre o papel mais amplo da política, a empresa afirmou:
À medida que a IA se torna mais capaz, a política pública deve desempenhar um papel maior para garantir que os sistemas dos quais as pessoas dependem sejam seguros. Essa capacidade leva tempo para ser construída, e já começamos a implementar a infraestrutura necessária para apoiá-la. Esperamos compartilhar mais detalhes sobre esses esforços em breve.
Estratégia da empresa e roadmap futuro
O Opus 5.5 marca o primeiro lançamento de modelo da Anthropic desde que o CEO Dario Amodei se comprometeu a reduzir deliberadamente o progresso das capacidades da IA para se alinhar aos esforços de alinhamento. Os próximos lançamentos do Sonnet 5.5 e do Haiku 5.5 continuarão essa trajetória, oferecendo melhorias de desempenho enquanto mantêm o quadro de segurança da empresa.







