A Anthropic divulgou nesta terça-feira, dia 1º de setembro, seus modelos de inteligência artificial mais recentes: Fable 5.1 e Mythos 5.1. O modelo Fable 5.1 já está disponível para assinantes e empresas, prometendo um desempenho superior, custos operacionais menores e mecanismos de segurança mais exatos.
Enquanto isso, o modelo Mythos 5.1 permanece restrito aos participantes do projeto Glasswing, que abrange organizações americanas consideradas confiáveis, embora ele também tenha passado por uma revisão em suas salvaguardas.
Um ponto de destaque do Fable 5.1 para o público em geral é a potencial redução de gastos. Embora o preço base permaneça inalterado — US$ 10 (R$ 51,64) por milhão de tokens de entrada e US$ 50 (R$ 258,19) por milhão de tokens de saída —, houve uma diminuição no custo das leituras de cache, que foi ajustado para US$ 0,25 (R$ 1,29) por milhão de tokens. Leituras de cache referem-se ao uso de dados de entrada que já foram processados e guardados pelo modelo.
A Anthropic prevê uma economia de 25% em tarefas comuns, podendo atingir até 45% em projetos que utilizam muitos agentes. Contudo, testes iniciais realizados por terceiros apresentaram resultados variados: em alguns casos, o Fable 5.1 custou 20% a mais que o Fable 5 devido à maior geração de tokens de saída; em outro teste com alta utilização de agentes, o valor cobrado caiu quase pela metade.
A companhia também assegura que o Fable 5.1 possui salvaguardas mais rigorosas. Anteriormente, seu predecessor era criticado por se negar a responder a perguntas elementares de biologia, situação que é menos provável de ocorrer na nova versão. Além disso, a empresa reporta uma redução de 60% nos falsos positivos relacionados à cibersegurança.
O Fable 5.1 agora pode ser empregado na detecção de falhas de software. No entanto, certas atividades de cibersegurança, como a criação de exploits e testes de invasão, continuam sendo direcionadas ao modelo Opus, que possui capacidades limitadas.
Outra novidade é a introdução de uma opção com política de retenção de dados nula, permitindo que corporações utilizem armazenamento em sua própria infraestrutura de nuvem, sem depender dos servidores da Anthropic.
Em termos de performance, a Anthropic destaca uma melhoria significativa em pesquisas científicas assistidas por agentes, onde o Fable 5.1 alcançou 52,6% no Terminal-Bench-Science 0.1, superando os 24,7% do Fable 5. Apesar disso, alguns avaliações independentes indicam uma queda nos resultados obtidos em benchmarks de raciocínio.
