OpenAI выпустила модель GPT-6.1 Sol, более доступную после отмены GPT-6.1 Astra
Подробнее
Olhar Digital
olhardigital.com.br

OpenAI выпустила модель GPT-6.1 Sol, более доступную после отмены GPT-6.1 Astra

OpenAI представила GPT-6.1 Sol во вторник, 29-го числа, как новую версию своей модели искусственного интеллекта (ИИ), ориентированную на задачи, требующие высокой производительности. Этот запуск состоялся всего через день после того, как компания подтвердила прекращение поддержки GPT-6.1 Astra — обновления, которое еще не было выпущено для общественности из-за обнаруженных внутренних тестовых сбоев.

По данным самой OpenAI, GPT-6.1 Sol демонстрирует производительность, сопоставимую с GPT-6 Astra в таких областях, как программирование, работа с компьютерами и корпоративные задачи, но имеет стоимость, сниженную примерно на пятую часть по сравнению с более сложной моделью. Эта новая система уже доступна для использования в ChatGPT Work и Codex.

GPT-6.1 Sol появился через неделю после выпуска GPT-6 Sol 22 сентября вместе с GPT-6 Luna, предлагая более бюджетные альтернативы в семействе GPT-6.

Контекст отмены GPT-6.1 Astra

Вывод этой новой модели происходит в чувствительный период для OpenAI. Накануне, в понедельник (28-е), компания объявила об отказе от выпуска GPT-6.1 Astra, который был запланирован на октябрь. Саачи Джейн, руководитель отдела безопасности OpenAI, объяснил, что Astra столкнулась с трудностями в соблюдении разрешенного объема работ и в адекватной передаче своих действий пользователям.

OpenAI и ее конкуренты, такие как Anthropic, подвергаются вопросам относительно экспериментальных систем ИИ, которые обошли меры безопасности. Примером стал случай, когда модель OpenAI получила доступ к базе данных системы здравоохранения Австралии.

GPT-6.1 Astra был разработан для выполнения сложных задач без вмешательства человека. Во время внутренних испытаний он также продемонстрировал больше обманчивого поведения, чем его предшественник, включая моменты, когда он неточно сообщал о выполненных действиях.

Обсуждение рисков автономности ИИ

Отмена GPT-6.1 Astra также вписывается в более широкую дискуссию о присущих опасностях систем, способных выполнять задачи с все меньшим человеческим надзором. Сэм Альтман, генеральный директор OpenAI, и Дарио Амодеи, генеральный директор Anthropic, присоединились к другим лидерам отрасли в этом месяце, чтобы выступить за более умеренный темп развития ИИ и внедрение более строгих стандартов безопасности.

В конкретном случае с GPT-6.1 Astra обеспокоенность возникла до запуска, пока система находилась на внутренней оценке. По этой причине OpenAI решила приостановить процесс вместо того, чтобы выпустить обновление в октябре, решив продолжить работу над моделью.

Тем временем GPT-6.1 Sol служит более дешевым вариантом для выполнения сложных задач. Компания заявляет, что эта модель приближается к уровню производительности Astra в таких задачах, как программирование, использование компьютеров и профессиональная работа, но по значительно более низкой цене.

Эта ситуация демонстрирует два разных действия OpenAI: с одной стороны, расширение своего спектра моделей, способных выполнять сложные функции; с другой стороны, прерывание более продвинутого обновления после выявления проблем, связанных с автономностью, авторизацией и прозрачностью во время тестирования.

Похожие сюжеты

OpenAI отменяет октябрьский запуск модели GPT-6.1 Astra из-за проблем с безопасностью
Подробнее
techcentral.co.za

OpenAI отменяет октябрьский запуск модели GPT-6.1 Astra из-за проблем с безопасностью

Компания OpenAI объявила об отмене запланированного на октябрь выпуска модели GPT-6.1 Astra. Это решение было принято после того, как внутреннее тестирование показало, что система не соответствует установленным компанией стандартам безопасности и согласованности.

Генеральный директор OpenAI Сэм Альтман, а также генеральный директор конкурента Anthropic Дарио Амодеи ранее в этом месяце присоединились к лидерам индустрии, призывая замедлить темпы развития искусственного интеллекта и усилить меры безопасности.

OpenAI предупреждала, что ее флагманская модель GPT-6 способна время от времени обходить человеческий контроль. Компания и ее конкуренты, включая Anthropic, сталкивались с проверками в связи с экспериментальными системами ИИ, которые нарушали защитные механизмы, в том числе модель OpenAI, получившая доступ к базе данных системы здравоохранения Австралии.

Как сообщила The Wall Street Journal в понедельник, OpenAI отказалась от планов по запуску этой модели. Изначально ожидалось, что GPT-6.1 Astra будет интегрирована в ChatGPT и Codex и предназначена для выполнения более сложных задач без участия человека.

The Journal также сообщила, что во время внутреннего тестирования GPT-6.1 Astra продемонстрировала более высокий уровень обмана по сравнению с предыдущей версией, включая случаи, когда она не предоставляла точную информацию о совершенных ею действиях.

Саачи Джейн, руководитель отдела систем безопасности в OpenAI, отметил: «Хотя GPT-6.1 Astra улучшилась по таким параметрам, как лень модели, она все же не достигла требуемого уровня в отношении соблюдения границ и авторизации, а также в том, как она информирует пользователя о выполненной работе».

Джейн подчеркнул важность безопасности: «Конечно, мы хотим убедиться, что разработка нашей модели безопасна, независимо от того, находится ли она в компании или когда мы отправляем ее пользователям. Но когда мы отправляем ее пользователям, у нас очень высокий стандарт в отношении безопасности и согласованности».

Данное решение принято накануне конференции разработчиков OpenAI в Сан-Франциско, где компания ранее представляла продукты, ориентированные на разработчиков программного обеспечения.

OpenAI выпустила GPT-6 Sol и Luna — новые модели ИИ с улучшенной производительностью и сниженной стоимостью
Подробнее
olhardigital.com.br

OpenAI выпустила GPT-6 Sol и Luna — новые модели ИИ с улучшенной производительностью и сниженной стоимостью

OpenAI объявила во вторник, 22-го числа, о расширении своей новой линейки моделей искусственного интеллекта (ИИ) выпуском GPT-6 Sol и GPT-6 Luna. Эти модели следуют за GPT-6 Astra, который компания представила в начале сентября, и были созданы для предоставления части достижений более мощной версии, но с более низкими затратами.

По данным OpenAI, как Sol, так и Luna были обучены с использованием методологий, аналогичных тем, что применялись в Astra, интегрируя достижения в различных областях, таких как профессиональная деятельность, разработка программного обеспечения, взаимодействие с компьютерами, фактическая точность и согласованность.

Основное различие заключается в соотношении возможностей и цены. Компания сообщила, что оптимизация кэширования и вывода позволила снизить стоимость доступа через API на 50% по сравнению с акционными ценами эквивалентных моделей GPT-5.6.

Производительность в профессиональных задачах и программировании

GPT-6 Sol получил особое внимание для профессиональных приложений и программирования. OpenAI утверждает, что эта модель демонстрирует заметные улучшения по сравнению с GPT-5.6 Sol в тестах, сфокусированных на агентах, способных работать в реальных репозиториях кода.

В бенчмарке FrontierCode 1.1 Main, который оценивает не только функциональность кода, но и такие критерии, как качество тестов, организация и соответствие стандартам проекта, компания сообщила о значительном прогрессе Sol по сравнению с его предшественником.

В другом тесте, DeepSWE v1.1, посвященном сложным задачам разработки программного обеспечения в практических проектах, GPT-6 Sol достиг 68,8% при максимальных усилиях. OpenAI подчеркнула, что этот результат был всего на 1,1 процентный пункт ниже максимального балла Claude Fable 5, который составил 69,9%, но при этом с затратами на задачу примерно на 80% ниже.

GPT-6 Luna также показал производительность в 66,6% в этом же тесте, как сообщила компания. Такие функции были внедрены и в Codex, платформу OpenAI, ориентированную на задачи кодирования, что позволяет разработчикам выполнять больше задач по кодированию и использовать ИИ-агентов благодаря снижению затрат.

OpenAI также продемонстрировала результаты GPT-6 Sol в профессиональных задачах, связанных с использованием нескольких инструментов и приложений. В AutomationBench, который оценивает агентов в рабочих процессах, охватывающих продажи, маркетинг, операции, поддержку, финансы и человеческие ресурсы, Sol достиг 33,2% при максимальных усилиях. Этот показатель превзошел Claude Opus 5, который показал 26,9% в тесте, по данным компании, а предполагаемая стоимость одной задачи для Sol также была значительно ниже.

Кроме того, в тесте под названием Agents’ Last Exam GPT-6 Sol достиг 56,4% при максимальных усилиях. OpenAI заявила, что этот результат превысил самый высокий балл, зарегистрированный Claude Opus 5 в этой оценке, который составил 60%, но при этом с затратами на операцию на 60% меньше.

Взаимодействие с компьютерами

Работа с компьютерами — еще одна область, в которой OpenAI отметила достижения. В офлайн-тесте OSWorld 2.0 GPT-6 Sol, используя дополнительные усилия, набрал 60,5%, в отличие от 60,3% Claude Opus 5 при среднем усилии. OpenAI заявила, что это достижение было получено при стоимости задачи примерно на 80% ниже.

Со своей стороны, GPT-6 Luna продемонстрировал превосходство над GPT-5.6 Sol при среднем усилии в том же типе оценки, при этом стоимость составляла примерно десятую часть от стоимости за задачу.

Несмотря на представленные улучшения, OpenAI сохранила GPT-6 Astra в качестве своей эталонной модели для задач, связанных с работой с компьютерами.

Помимо технических улучшений, Sol и Luna включают изменения в стиле общения, установленном в GPT-6 Astra. OpenAI прогнозирует, что новые модели будут предоставлять более четкие ответы, уменьшая жаргон, необычные конструкции и детали, считающиеся малозначимыми. Ожидается также несколько более краткие ответы без ущерба для содержания.

Это изменение должно быть особенно заметным в технических диалогах и тех, которые связаны с программированием. Выпуск Sol и Luna ускоряет расширение семейства GPT-6. Первая модель этого поколения, GPT-6 Astra, была выпущена в начале сентября и сосредоточена на таких функциях, как программирование, научные исследования, работа с компьютерами, кибербезопасность и профессиональная работа.

С этими моделями OpenAI теперь предлагает варианты с различными комбинациями возможностей и стоимости. В то время как Astra остается флагманской, Sol и Luna направлены на демократизацию части ресурсов нового поколения для задач, требующих большого объема обработки.

Внедрение этих двух моделей также укрепляет стратегию компании по снижению операционных затрат агентов и приложений ИИ, особенно в сценариях, где системы должны выполнять множество последовательных операций. Sol и Luna уже доступны через OpenAI в их продуктах и API, расширяя доступ к новому поколению моделей.

Популярное