Anthropic выпустила Claude Sonnet 5.5 с большей скоростью и снижением затрат для повседневных задач
Подробнее
Olhar Digital
olhardigital.com.br

Anthropic выпустила Claude Sonnet 5.5 с большей скоростью и снижением затрат для повседневных задач

Anthropic представила Claude Sonnet 5.5 — новую промежуточную модель в своей линейке Claude 5.5. По данным компании, эта модель демонстрирует более высокую производительность, превосходя Sonnet 5 более чем на 30% по скорости, и может обеспечить экономию до 30% на задачу.

Цель этого выпуска — оптимизация выполнения четко определенных задач, таких как исправление кода, составление документов, создание презентаций и таблиц. Кроме того, Sonnet 5.5 получил улучшения в таких областях, как дизайн, совместная работа и безопасность, в то время как модель Opus 5.5 остается ориентированной на более сложные требования.

С точки зрения ценообразования, Sonnet 5.5 сохранил цены предыдущей версии: 2 доллара США за миллион входных токенов (что эквивалентно примерно 10,42 бразильских реалов), 10 долларов США за миллион выходных токенов (52,10 бразильских реалов) и 0,20 доллара США за миллион токенов кэша (1,04 бразильского реала).

Токены — это минимальные текстовые единицы, которые модели ИИ используют для интерпретации запроса и генерации ответа. Поскольку Sonnet 5.5 обычно требует меньше этих единиц для завершения задачи, Anthropic прогнозирует снижение затрат до 30% на работу. Кроме того, модель генерирует ответы более чем на 30% быстрее.

Этот прирост производительности был заметен в тестах программирования. В Terminal-Bench 4.0, оценке, измеряющей способность ИИ выполнять сложные задачи через командную строку — текстовую среду, используемую разработчиками, — Sonnet 5.5 показал 70,6% по сравнению с 10,3% у Sonnet 5.

Anthropic также поделилась другими сравнительными результатами между Sonnet 5.5 и Sonnet 5. Несмотря на прогресс, Anthropic подчеркивает, что Opus 5.5 по-прежнему демонстрирует большую силу в сложных и открытых задачах, требующих расширенного рассуждения. Однако в некоторых оценках Sonnet 5.5 достиг результатов, близких к результатам самой продвинутой модели при максимальной нагрузке.

Эволюция особенно очевидна в области программирования, где Sonnet 5.5 быстро усваивает кодовые базы и выполняет задачи за меньшее количество шагов. Тестировщики также отметили эффективность модели в использовании инструментов.

В предварительных тестах, проведенных Epic, Claude Sonnet 5.5 достиг ожидаемого стандарта качества для модели высшей категории. Дэниел Фогель, операционный директор Epic Games, прокомментировал это в заметке.

Улучшения не ограничиваются только кодом; Anthropic также подчеркивает производительность в задачах создания и знаний, охватывая интерфейсы и презентации. В внутреннем тесте модели предоставили квартальные материалы, стенограммы государственного учреждения и шаблон презентации. Результатом стала операционная вычитка десяти слайдов, которую два эксперта сочли готовой к отправке.

Кертис Аллен, ведущий инженер Slack, заявил: «Без изменения наших промптов Claude Sonnet 5.5 показал лучшую производительность, чем Sonnet 5, почти во всех наших внутренних оценках Slackbot».

Увеличение возможностей сопровождалось новыми уровнями защиты. Sonnet 5.5 — первая модель серии Sonnet, которая включает меры кибербезопасности и механизмы резервирования, аналогичные тем, которые Anthropic использует в Opus 5.5.

Эти меры безопасности служат устройствами, предназначенными для ограничения использования ИИ в сценариях, классифицированных как высокорискованные. В контексте кибербезопасности рутинные задачи разработки остаются доступными, в то время как более опасные запросы могут быть перенаправлены в Sonnet 5.

В биологической сфере защита остается идентичной Sonnet 5, фокусируясь на запросах, считающихся высокорискованными. Sonnet 5.5 уже доступен на различных платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure. Claude Haiku 5.5 будет выпущен в ближайшие недели, чтобы завершить новый модельный ряд. Оригинальная статья была первоначально опубликована в Olhar Digital.

Похожие сюжеты

Anthropic выпустила Claude Opus 5.5 с увеличенной мощностью и сниженными затратами
Подробнее
tecnoblog.net

Anthropic выпустила Claude Opus 5.5 с увеличенной мощностью и сниженными затратами

Anthropic представила свою новейшую модель искусственного интеллекта — Claude Opus 5.5. Эта новая модель представляет собой технологический пик компании на данный момент, достигая возможностей, сопоставимых с моделями Mythos 5.1 и Fable 5.1 в таких критически важных областях, как биология и кибербезопасность. Кроме того, были внедрены новые меры безопасности для предотвращения ненадлежащего использования.

По словам разработчика, Opus 5.5 демонстрирует большую скорость и точность, способный мигрировать коды объемом 680 тысяч строк всего за один день. Значительным преимуществом, отмеченным компанией, является операционные расходы, которые на 40% ниже по сравнению с Opus 5. Эта модель является наиболее подходящей для сложных задач программирования, разработки программного обеспечения и автоматизации.

В ближайшие недели две другие ИИ-модели компании, Sonnet 5.5 и Haiku 5.5, также получат обновления, направленные на повышение скорости и эффективности соответственно. Выпуск Opus 5.5 произошел после скандалов, вызванных сообщениями сотрудника Anthropic и заявлением генерального директора Dario Amodei о необходимости замедления темпов развития ИИ.

С этой новинкой Anthropic гарантирует, что Opus 5.5 обладает компетенциями, схожими с моделями Mythos 5.1 и Fable 5.1 в вопросах биологии и кибербезопасности. Механизмы защиты, присутствующие в Fable, были интегрированы в новый Opus 5.5, включая возможность точечного понижения до версий Opus 4.8 или Opus 5 в зависимости от ситуации.

Anthropic сообщила, что новая модель получила самые высокие оценки во внутренней поведенческой аудиторской проверке. Это указывает на то, что она имеет меньшую вероятность обойти защиту при попытках неправомерного использования и более устойчива к атакам инъекции промптов, чем ее предшественник, Opus 5.

С точки зрения производительности, компания отмечает значительный прогресс в выполнении сложных задач. В тестах Opus 5.5 решил 39 из 40 случаев восстановления программного обеспечения, превзойдя Opus 5, который выбрал менее эффективные решения. Также была оценена способность ИИ создавать игры с нуля, используя только одну команду, с заметным акцентом на результаты в области графики и оформления.

Финансовый аспект Opus 5.5 также выделяется, предлагая на 40% более низкую стоимость для общих операций. Anthropic устанавливает цену в размере от 4 до 20 долларов США (эквивалентно 20–100 бразильских реалов при прямом конвертировании) за миллион токенов, что составляет пятую часть стоимости стандартного Opus 5. Для чтения кэша, особенно в агентных задачах, стоимость составляет 0,20 доллара США (1 бразильский реал) за миллион, что представляет собой снижение на 60%.

Anthropic опубликовала графические сравнения, демонстрирующие преимущества Opus 5.5 перед новейшим GPT-6 Astra от OpenAI (модель, расшифровавшая зашифрованное сообщение Первой мировой войны) как с точки зрения соотношения цены и качества, так и в задачах кодирования и исследований. Компания также обещает более четкое и уверенное общение, уделяя приоритетное внимание основной информации и используя более доступный стиль письма.

Новый Opus 5.5 уже доступен на платформе Anthropic и может быть активирован с помощью кода «claude-opus-5-5». Компания сообщает, что существует ограничение в пять часов использования модели, доступное через подписки Pro, Max, Team и Enterprise, причем это время может быть скорректировано самими пользователями для фокусировки на конкретных задачах.

Популярное