Робот Moz1 від Spirit AI вже має конкретну роботу на виробництві акумуляторів. Та між успішним виконанням повторюваної операції на заводі й роботом, якому можна доручити незнайому справу вдома, — велика відстань. Саме так варто читати і виробничі результати компанії, і її прогноз на 2027 рік.
6
43
Що відомо про роботу Moz1
За повідомленням Spirit AI, десятки колісних гуманоїдних роботів Moz1 розгорнуто в CATL та JD.com. Найдокладніше описана їхня робота на майданчику CATL у Чжунчжоу: на лінії PACK, де збирають батарейні блоки, роботи вставляють і виймають тестові з’єднувачі. Працюючи з гнучкими проводами, вони коригують рухи та прикладене зусилля. Які саме завдання Moz1 виконує в JD.com, доступні повідомлення не уточнюють.
43
Spirit AI заявляє про понад 99% успішних вставлень з’єднувачів на лінії CATL і про час виконання операції, порівнянний із показником досвідчених працівників. Це результат, про який повідомила сама компанія, для конкретної дії. Він не доводить ані надійності всієї виробничої лінії, ані здатності Moz1 так само добре виконувати нові завдання.
6
Іншу цифру не слід змішувати з виробничою: співзасновник Spirit AI Ґао Ян говорив про приблизно 90% успіху в простих завданнях у впорядкованому середовищі, схожому на житлову кімнату. Це не показник підключення з’єднувачів на CATL.
2
4
Чому даних із реального світу недостатньо
Spirit AI навчає «мозок» робота на даних про фізичні дії. За повідомленнями, близько 1000 підрядників збирають для компанії дані в реальних умовах; Ґао називає нестачу придатних навчальних даних одним із головних обмежень. Робота на заводі показує, що роботу можна доручити повторювану операцію, але сама собою не доводить, що набуті навички надійно перенесуться в інше середовище.
1
3
Проблемними залишаються точні рухи та реакція на незнайомі ситуації. До цього додаються вимоги безпеки під час роботи поряд із людьми. Тому результат у передбачуваних умовах не можна автоматично поширювати на інші завдання.
1
Що означає прогноз на середину 2027 року
Ґао прогнозує до середини 2027 року «рубіж GPT-3.0» для роботів: людина зможе дати вказівку звичайною мовою, а робот — спробувати виконати для цього послідовність фізичних дій. Це прогноз розвитку роботного інтелекту, а не обіцянка, що Moz1 на той час безвідмовно впорається з будь-яким дорученням.
3
43
За оцінкою Ґао, найближчі один-два роки стануть початковим етапом промислового застосування. Далі він очікує простіших завдань у сфері комерційних послуг, а корисне застосування роботів удома відносить на щонайменше вісім років. Отже, нинішній результат CATL і прогноз на 2027 рік описують різні речі: заявлену успішність однієї заводської операції сьогодні та можливий крок до гнучкішої поведінки роботів у майбутньому.
1
43