Компания Zhipu AI представила модель GLM-5.3-Flash, которая, по утверждению компании, функционирует исключительно на внутренних чипах искусственного интеллекта. Для обработки всего онлайн-трафика модели используется 100 000 локально произведенных ускорителей.
Модель заняла десятое место в рейтинге AAII от аналитической фирмы Artificial Analysis, опередив DeepSeek's V4 Pro Max. Zhipu AI подчеркнула, что весь объем запросов к GLM-5.3-Flash обслуживается этими 100 000 чипами, произведенными внутри страны.
Первоначально GLM-5.3-Flash была выпущена под кодовым названием «Ox Alpha» 20 августа и в течение недели возглавила списки популярности на платформе маршрутизации ИИ-моделей OpenRouter. Компания позиционирует эту модель как высокопроизводительную, достаточно эффективную для работы в масштабе на внутренней вычислительной инфраструктуре Китая.
Zhipu AI не раскрыла публично, какой именно поставщик чипов использовался. Однако, по сообщениям CNBC, аналитики предполагают, что оборудование принадлежит серии Ascend от Huawei. Иван Лин, аналитик исследовательской фирмы Counterpoint, отметил, что разработчики китайских моделей ИИ все чаще направляют инвестиции в серверы ИИ и вычислительную инфраструктуру, построенную на отечественных чипах.
Этот запуск является наиболее явным сигналом о том, что как минимум одна ведущая лаборатория по разработке моделей в Китае считает, что внутренняя цепочка поставок готова поддерживать флагманские рабочие нагрузки. Zhipu AI входит в число самых активных среди «китайских тигров» в расширении вычислительных мощностей, и ежедневная эксплуатация модели класса «фронтир» на собственных ускорителях является заявлением как о производительности, так и о доступности чипов.
Этот шаг также соответствует более широкому тренду в отрасли. Поскольку экспортный контроль ограничивает доступ к зарубежным передовым чипам, создатели китайских моделей спешат оптимизировать свое программное обеспечение под то оборудование, которое они могут реально приобрести. Модель, демонстрирующая высокие результаты в бенчмарках при работе на отечественных чипах, служит доказательством того, что эффективность программного обеспечения может компенсировать пробелы в аппаратном обеспечении.
Для Zhipu AI линейка Flash представляет собой стратегию сочетания качества модели с практической масштабируемостью. Благодаря поддержке 100 000 чипов, GLM-5.3-Flash призвана продемонстрировать, что лаборатория из Китая способна обеспечить конкурентоспособную производительность уровня «фронтир» без зависимости от импортных ускорителей.
