XPeng тратит 500 млн долларов в год исключительно на вычислительные мощности для тренировки моделей автопилота. На конференции CVPR 2026 компания представила архитектуру VLA 2.0, в которой устранено промежуточное звено обработки дорожной сцены в языковые токены.

Create a landscape editorial hero image for this Studio Global article: How much does Xpeng spend annually on AI model training for autonomous driving, what new VLA 2.0 architecture did it introduce at CVPR 2026. Article summary: Here are the answers to your three questions, based on recent reporting by Electrek and XPeng's official announcements.. Topic tags: general, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "Xpeng’s head of autonomous driving told Electrek that the company is spending roughly 300 million RMB (~$41 million) per month on AI training alone and believes it has already reac" source context "Xpeng spends $500M/year on AI training to beat Tesla FSD | Electrek" Reference image 2: visual subject "Xpeng’s head of autonomous driving told Electrek that the company is spending roughly 300 million RMB (~$41 millio
В эскалации спора слов и технологий китайский производитель электромобилей XPeng определил собственный план наступления на доминирование Tesla в области автономного вождения. Компания на конференции CVPR в июне 2026 года детально раскрыла радикальную архитектуру своего ИИ, которая отказывается от ключевого элемента большинства роботизированных систем — промежуточной обработки дорожной сцены через язык. Вкупе с обнародованием колоссальных ежегодных затрат на тренировку ИИ, XPeng утверждает, что её подход не просто иной, а принципиально более быстрый и надёжный.
Глава отдела ИИ компании, доктор Сяньмин Лю, руководящий Центром общего интеллекта XPeng, сообщил в интервью Electrek, что компания тратит около 300 миллионов юаней в месяц — или приблизительно 500 миллионов долларов в год — только на вычисления для тренировки моделей автопилота . Эта сумма не включает весь исследовательский бюджет XPeng, связанный с ИИ. Общие расходы компании на R&D в области AI в 2025 году составили около 652 миллионов долларов, а в 2026 году их планируется нарастить до приблизительно 970 миллионов долларов
.
Центральным событием участия XPeng в CVPR 2026 стала презентация модели второго поколения VLA 2.0. Архитектура основана на фундаментальном отходе от того, как многие ИИ-системы, включая первое поколение модели XPeng, решают задачу управления автомобилем .
В традиционном конвейере VLA (Vision-Language-Action, т.е. «зрение-язык-действие») система работает пошагово: машина «видит» дорогу, переводит визуальное восприятие в токены, подобные языковым, а затем уже рассуждает об этих языковых токенах, чтобы сгенерировать управляющее действие. Доктор Лю назвал этот промежуточный шаг критической уязвимостью, прямо заявив, что «язык — это яд» для вождения в реальном времени . Аргумент Лю в том, что языковые токены вносят свойственную им задержку и инъецируют нерелевантный семантический шум в процесс, требующий миллисекундной реакции.
Новая модель VLA 2.0 полностью убирает это узкое место. Использован путь, который в компании называют «зрение — неявный токен — действие». Он позволяет сквозную, end-to-end генерацию водительских команд прямо из сырых визуальных входных данных без всякого промежуточного представления в языке . При этом система всё ещё может принимать язык как входящий сигнал: например, навигационную команду водителя или голосовую инструкцию. Но она никогда не порождает собственные языковые токены как внутренний результат в ходе самого процесса езды
. На стенде CVPR компания демонстрировала работу системы совместно с физической моделью мира. Исследовательская работа DrivePTS была принята для публикации на конференции
.
Руководство XPeng не стесняется проводить прямые параллели с Tesla. Их заявления весной и летом 2026 года — это резкий скачок уверенности. Доктор Лю сообщил в июньском интервью, что XPeng уже достигла паритета с FSD v13 от Tesla в Китае и что сравнение с производительностью более новой FSD v14 «в пределах досягаемости ещё до конца лета» .
Эти технические утверждения подкреплены необычно личным обязательством сверху. В декабре 2025 года CEO Хэ Сяопэн заключил публичное пари: он заявил, что система VLA от XPeng должна сравняться по ощущениям от вождения на дороге с Tesla FSD v14.2 в Кремниевой долине к 30 августа 2026 года . Ставки были предельно ясны: если команда провалит задачу, ответственный за направление «побежит голым»
.
Чтобы подкрепить свою нарративную линию, XPeng выпустила в мае 2026 года видеосравнение, куда пригласила двух активных сторонников Tesla из США в Китай. Постановочное сравнение столкнуло седан XPeng P7 с VLA 2.0 против Tesla Model 3 с FSD на идентичных пекинских маршрутах. Согласно собственной версии видеоролика XPeng, их машине потребовалось лишь 2 вмешательства водителя против 7 у Tesla . Хотя Хэ Сяопэн неоднократно повторял на мероприятиях, включая Auto China 2026, что цель — полностью превзойти FSD Tesla на китайском рынке к августу, независимые обзоры призывают к осторожности. Редактор Electrek, тестировавший VLA 2.0 в Пекине, назвал производительность системы «сопоставимой» с FSD v14, но заметил, что обе всё ещё требуют постоянного внимания водителя и далеки от полностью автономного вождения
.
Пока эта гонка остаётся высокоскоростной погоней, определяемой смелыми архитектурными ставками и ещё более смелыми заявлениями. Решение XPeng исключить язык из «мозга» автомобиля — это рассчитанная игра на то, что самый быстрый путь от зрения к действию — это прямая линия. Даже если для этого придётся выбросить словарь.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
XPeng тратит 500 млн долларов в год исключительно на вычислительные мощности для тренировки моделей автопилота.
XPeng тратит 500 млн долларов в год исключительно на вычислительные мощности для тренировки моделей автопилота. На конференции CVPR 2026 компания представила архитектуру VLA 2.0, в которой устранено промежуточное звено обработки дорожной сцены в языковые токены.
XPeng заявляет, что сравнялась с Tesla FSD v13 и к концу лета 2026 года должна догнать FSD v14.2.