OpenAI в четверг (13-е число) представила новую функцию обработки для GPT-5.6 Sol под названием Ultrafast. Этот новый режим потенциально может увеличить скорость отклика до четырнадцати раз по сравнению со стандартным уровнем, что идеально подходит для сценариев, требующих немедленного принятия решений и получения ответов.
Первоначально эта услуга доступна через API и использует инфраструктуру, предоставленную Cerebras, которая поддерживает скорость вывода до 750 токенов в секунду. В настоящее время доступ ограничен избранной группой клиентов, пока компания отслеживает его использование в реальных условиях и планирует постепенное расширение возможностей.
Стратегия OpenAI направлена на устранение необходимости выбирать между высокоинтеллектуальными моделями и быстрыми ответами. С помощью Ultrafast организация намерена применять GPT-5.6 Sol в различных областях, включая обслуживание клиентов, финансовый анализ, реагирование на инциденты, коммерцию и интерактивные исследования.
OpenAI характеризует Ultrafast как новый класс услуг, предназначенный для приложений, где время между формулированием вопроса и получением ответа может напрямую повлиять на полезность искусственного интеллекта. Компания утверждает, что достижения в эффективности GPT-5.6 позволили достичь более близкой конвергенции между способностью к рассуждению и операционной скоростью.
Одним из примеров применения является реагирование на сбои в системах. В этом контексте инструмент способен анализировать отчеты приложений, недавние изменения в коде и сообщения инженеров для помощи в выявлении причины проблемы и подготовке временного исправления во время продолжающегося сбоя.
Кроме того, упоминаются применения в финансовом секторе и сфере безопасности, охватывающие анализ рыночных индикаторов, оценку транзакций и обнаружение необычных закономерностей в условиях быстрой мутации.
В области обслуживания клиентов дополнительная скорость позволяет системам обрабатывать более сложные вопросы непосредственно во время взаимодействия. Предложение также включает голосовые функции, где задержка ответа может ухудшить плавность разговора.
В электронной коммерции модель может использоваться для ответа на вопросы о продуктах, подтверждения наличия на складе, предложения персонализированных товаров и поддержки в решении проблем в процессе покупки, чтобы действовать до того, как медлительность приведет к отказу потребителя.
Другая исследуемая область — это исследования и эксперименты. По словам компании, задачи, которые ранее требовали длительного времени выполнения, теперь могут превратиться в интерактивные циклы, позволяя исследователям тестировать гипотезу, наблюдать за результатами, вносить корректировки и повторять эксперимент в течение того же рабочего периода.
Начальный этап внедрения включает компании из сегментов программирования, торговли, финансов и поддержки. Среди клиентов, упомянутых OpenAI, — Jane Street, Podium, Basis и Rogo.
Jane Street, через Джона Крепецци, специалиста по помощникам искусственного интеллекта, оценил, что увеличение скорости, предлагаемое Cerebras, изменяет возможности использования моделей, способствуя более сфокусированным и продуктивным отношениям между разработчиками и ИИ.
OpenAI решила начать с корпоративных приложений, чтобы наблюдать за технологией в производственных операциях. Цель состоит в том, чтобы определить, в каких видах деятельности значительный скачок скорости приносит наибольшую пользу, и как продукты ведут себя при более тесном следовании темпу пользователей.
Сама OpenAI также подвергла Ultrafast внутреннему тестированию с особым акцентом на обработку инцидентов надежности, когда команды должны быстро интерпретировать информацию, которая постоянно меняется во время события.
В таких случаях система используется для консолидации данных журналов и отслеживания, организации диалогов, предложения проверок и помощи в разработке или проверке исправлений, хотя окончательная ответственность за решение и реализацию остается за инженерами.
В области исследований внутренние команды используют этот режим для обращения к базам знаний, доступа к данным и компиляции, структурирования и синтеза информации с помощью интегрированных инструментов. Различие заключается в темпе рабочего цикла: вместо того чтобы оставлять последовательности экспериментов для выполнения ночью и анализа на следующий день, Ultrafast позволяет проводить несколько раундов исследований в течение рабочего дня.
Инфраструктура, поддерживающая эту новую функцию, является результатом сотрудничества между OpenAI и Cerebras, ответственной за предоставление технологии инференса с низкой задержкой, используемой в сервисе. Благодаря этой архитектуре GPT-5.6 Sol может достичь заявленной скорости до 750 токенов в секунду, что OpenAI связывает со способностью создавать более отзывчивые продукты и интегрировать ИИ в процессы, где задержка между этапами является ограничением.
Компания подчеркивает, что Ultrafast является предварительной версией, доступной только ограниченному числу клиентов, и расширение доступа будет зависеть от увеличения мощностей. Те, кто заинтересован в отслеживании этого развития, могут подписаться, чтобы получать уведомления о доступности, поскольку информация, собранная во время фазы тестирования, будет направлять следующие этапы внедрения.

