Модели искусственного интеллекта от компаний Huawei и Xiaohongshu достигли идеального результата, решив все задачи на Международной математической олимпиаде (IMO) в июле, опередив человеческих участников. Этот случай знаменует собой первый зарегистрированный пример, когда технология искусственного интеллекта набирает сто процентов баллов в подобных соревнованиях.
Условия проведения и результаты
Тестирование проводилось без какого-либо вмешательства человека, а сами задания были доступны для моделей ИИ только после завершения экзамена учащимися. Модель Celia от Huawei и dots-node-3.0 от Xiaohongshu полностью решили тест IMO. Стоит отметить, что в прошлом году Google и OpenAI также публиковали положительные, но не безупречные результаты.
Сложность испытания
По данным Xiaohongshu, достижение сто процентов является крайне сложной задачей. Это подтверждается результатами среди людей: из 666 участников в Шанхае лишь семь смогли решить все задачи. Компания заявила, что это первый раз, когда ее модель проходила тестирование по заданиям IMO.
Дополнительные тесты и предыдущие достижения
Согласно Taipei Times, задания были предоставлены моделям ИИ только после того, как они были выполнены реальными студентами, и во время решения не допускалось никакого человеческого вмешательства. Кроме того, венчурная компания Menlo Ventures из США провела собственные испытания с помощью партнера для проверки процента попаданий американских ИИ, поскольку они не принимали официального участия в конкурсе. В этих тестах также успешно справились ChatGPT в версии GPT-5.6 Sol от OpenAI, Claude Fable 5 от Anthropic и инструмент Axiom Math.
История тестирования ИИ
Несмотря на текущий успех, модели ИИ ранее уже тестировались на IMO. В 2024 году модель DeepMind от Google «получила» серебряную медаль, решив четыре из шести задач, хотя процесс решения занял около трех дней. А в 2025 году та же модель получила достаточно высокий балл для золота, как и ChatGPT, но не достигла максимального результата. При этом не раскрывались точные модели, использовавшиеся в прошлых испытаниях.