XPeng обновила модель VLA второго поколения, добавив понимание времени и перейдя к модели 4D пространства-времени
Подробнее
Pandaily
pandaily.com

XPeng обновила модель VLA второго поколения, добавив понимание времени и перейдя к модели 4D пространства-времени

Компания XPeng представила самое значительное обновление своей модели Vision-Language-Action (VLA) второго поколения, ключевым изменением которого является способность искусственного интеллекта понимать временные аспекты. На презентации, посвященной физическому ИИ с темой «ВРЕМЯ», компания сообщила, что ее базовая модель эволюционировала от статического трехмерного пространственного восприятия к динамическому четырехмерному пониманию пространства-времени с выпуском нового программного обеспечения XOS 6.3.0 на автомобиле G9L.

Этот прорыв основан на трех технологиях. Во-первых, Infini-VLA, архитектура с большим горизонтом, способна запоминать дорожную сцену в течение 30 секунд, объединяя непрерывные события вождения в единое временное понимание. Во-вторых, технология Streaming Inference трансформирует работу модели от дискретного рассуждения к непрерывному параллельному процессингу, что сокращает задержку от начала до конца на 300%. В-третьих, модель прогнозирования мира X-Foresight предвидит поведение участников движения вокруг на срок до шести секунд, тем самым улучшая реакцию на внезапные перестроения и резкое торможение.

Параметры, работающие непосредственно на устройстве, увеличились в 3,5 раза — это более чем в 15 раз больше, чем у основных моделей VLA, а комплексная многомерная безопасность улучшилась в 20 раз. Кроме того, XPeng представила Master Agent — универсальный «мозг», который не привязан к конкретному транспортному средству и построен на мультимодальной модели Omni. Этот агент объединяет восприятие VLA с кабиной VLM, автоматически разбирая намерения пользователя и координируя системы автономного вождения, шасси и салона.

Новые функции, активируемые голосом, такие как запрос на остановку, фактически выводят возможности уровня L4, присущие роботакси, в массовое производство. Данное обновление происходит на фоне того, как XPeng усиливает фокус на физическом ИИ. Недавно ее бизнес в области робототехники закрыл первый частный раунд финансирования на сумму свыше 900 миллионов долларов при оценке выше 6,3 миллиардов долларов — это рекорд для одного раунда в секторе воплощенного интеллекта Китая. Инвесторами выступили IDG, Gaorong, Tencent и Alibaba.

Для XPeng конечной целью является создание единой модели физического мира, которая рассматривает вождение, роботов и интеллект салона как одну непрерывную задачу рассуждения, учитывающую время, а не как отдельные изолированные задачи. Внедряя время в модель, компания делает ставку на то, что следующий этап развития автономности будет меньше напоминать простое восприятие, а больше — понимание мира в процессе его развития.

Популярное