Anthropic опубликовала во вторник, 1 сентября, свои новейшие модели искусственного интеллекта: Fable 5.1 и Mythos 5.1. Модель Fable 5.1 уже доступна подписчикам и компаниям, обещая превосходную производительность, более низкие эксплуатационные расходы и более точные механизмы безопасности.
Тем временем модель Mythos 5.1 остается ограниченной участниками проекта Glasswing, который охватывает доверенные американские организации, хотя она также прошла проверку на предмет мер безопасности.
Одной из особенностей Fable 5.1 для широкой публики является потенциальное снижение расходов. Хотя базовая цена остается неизменной — 10 долларов США (51,64 бразильских реала) за миллион входных токенов и 50 долларов США (258,19 бразильских реалов) за миллион выходных токенов, — стоимость чтения кэша была снижена до 0,25 доллара США (1,29 бразильского реала) за миллион токенов. Чтение кэша относится к использованию входных данных, которые уже были обработаны и сохранены моделью.
Anthropic прогнозирует экономию в 25% при выполнении стандартных задач и до 45% в проектах, использующих множество агентов. Однако первоначальные тесты сторонних организаций показали неоднозначные результаты: в некоторых случаях Fable 5.1 стоил на 20% дороже, чем Fable 5, из-за большего количества сгенерированных выходных токенов; в другом тесте с высокой загрузкой агентами стоимость упала почти вдвое.
Компания также гарантирует, что Fable 5.1 имеет более строгие меры безопасности. Ранее ее предшественник критиковался за отказ отвечать на элементарные вопросы биологии, что менее вероятно произойдет в новой версии. Кроме того, компания сообщает о снижении числа ложных срабатываний, связанных с кибербезопасностью, на 60%.
Fable 5.1 теперь может использоваться для обнаружения программных ошибок. Однако некоторые виды кибербезопасности, такие как создание эксплойтов и тестирование на проникновение, по-прежнему направлены на модель Opus, которая имеет ограниченные возможности.
Другой новостью является введение опции с нулевой политикой хранения данных, позволяющей корпорациям использовать хранилище в собственной облачной инфраструктуре, не полагаясь на серверы Anthropic.
С точки зрения производительности Anthropic подчеркивает значительное улучшение в научных исследованиях с помощью агентов, где Fable 5.1 достиг 52,6% в Terminal-Bench-Science 0.1, превзойдя 24,7% Fable 5. Тем не менее, некоторые независимые оценки указывают на снижение результатов, полученных в тестах на рассуждение.

