Nie dowodzi to istnienia jednej, ogólnobranżowej stopy awarii. Pokazuje jednak powtarzający się schemat: możliwości konwersacyjne rosną, podczas gdy codzienne wykonywanie poleceń pozostaje niestabilne.
Starsze asystenty głosowe były bardziej ograniczone, ale ich ścieżki sterowania były stosunkowo proste. Rozpoznane polecenie można było przypisać do znanej intencji i wcześniej sprawdzonej operacji, na przykład:
setBrightness(device = kuchnia, level = 50)Użytkownik musiał stosować węższy zestaw komend. W zamian system miał mniej możliwych interpretacji, a droga od wypowiedzi do działania urządzenia była bardziej przewidywalna.
Asystent oparty na dużym modelu językowym musi wykonać znacznie więcej kroków. Powinien:
Błąd na dowolnym etapie może doprowadzić do nieprawidłowego wyniku. Asystent może wybrać niewłaściwe urządzenie, źle zrozumieć nazwę pomieszczenia, użyć funkcji, której sprzęt nie obsługuje, wysłać nieprawidłowy parametr, oprzeć się na nieaktualnym stanie albo ogłosić sukces bez sprawdzenia, czy urządzenie rzeczywiście zareagowało.
Badania nad sterowaniem inteligentnym domem za pomocą modeli językowych wskazują na niedeterministyczność, opóźnienia i koszty wnioskowania oraz ograniczoną personalizację jako przeszkody dla niezawodnego sterowania. Systemy radzą sobie lepiej, gdy polecenia są jednoznaczne i uporządkowane, niż wtedy, gdy muszą samodzielnie odtworzyć szerszy kontekst.
Możliwości reklamowane przez Amazon i Google są realnie przydatne. Alexa+ ma mapować opis wypowiedziany przez użytkownika na właściwe urządzenie i jego funkcję, a Google podkreśla obsługę poleceń wieloczęściowych, wyjątków oraz poprawek wprowadzanych w połowie zdania.
Takie funkcje dobrze sprawdzają się przy zadaniach, takich jak:
Interpretacja polecenia to jednak nie to samo co jego wykonanie. Zdanie „przygotuj przytulną atmosferę na kolację” rzeczywiście wymaga pewnej dozy uznania. Polecenie „ustaw światła w kuchni na 50 procent” ma natomiast jednoznaczny, sprawdzalny rezultat. Pierwsze skorzysta na elastyczności modelu, drugie — na wąskiej i kontrolowanej ścieżce sterowania.
To rozróżnienie wyjaśnia, dlaczego asystent może imponująco poradzić sobie ze złożonym zdaniem, a jednocześnie nie wykonać prostego polecenia dotyczącego lampy. Złożoność języka nie jest tym samym co złożoność działania. Wielourządzeniowa komenda może się udać, jeśli model wybierze właściwe narzędzia i parametry. Krótkie polecenie może natomiast zawieść, gdy problem pojawi się przy identyfikacji urządzenia lub jego możliwości.
Poprawność to tylko część niezawodnego sterowania. Polecenie smart home powinno być także realizowane w rozsądnie przewidywalnym czasie. Światło, które włącza się po długiej chwili — albo dopiero po powtórzeniu komendy — sprawia wrażenie niesprawnego, nawet jeśli ostatecznie osiągnie właściwy stan.
W recenzji Alexa+ odnotowano, że niektóre odpowiedzi zajmowały nawet 15 sekund, choć podstawowe działania, takie jak włączanie świateł czy regulacja termostatu, w pewnych sytuacjach były szybsze. Osobne doniesienia dotyczące Gemini for Home wskazywały na aktualizacje ukierunkowane na szybsze odpowiedzi i krótsze komunikaty przy codziennych poleceniach, co sugeruje, że opóźnienia wciąż są istotnym problemem inżynieryjnym.
Przetwarzanie w chmurze, wybór modelu, wyszukiwanie urządzenia i wywołania narzędzi mogą dokładać kolejne sekundy. W efekcie system może być teoretycznie bardziej zaawansowany, ale w praktyce mniej przewidywalny.
Ciągłe wdrażanie aktualizacji jest dziś standardem w oprogramowaniu. Iteracyjne ulepszanie może być uzasadnione w przypadku funkcji konwersacyjnych o niskim ryzyku. Sterowanie domem to jednak inna kategoria, bo błędy wpływają na fizyczne urządzenia i ustalone rutyny. Jeśli aktualizacja zmienia działanie świateł, alarmów lub automatyzacji, użytkownik odczuwa to we własnym domu, a nie w abstrakcyjnym interfejsie chatbota.
Powtarzający się cykl skarg po wdrożeniu, a następnie poprawek i aktualizacji zwiększających niezawodność nie dowodzi, że firmy celowo wypuszczają niedokończone produkty. Pokazuje jednak, że klienci napotykają problemy, gdy systemy wciąż są dostrajane. Doniesienia o pomijanych automatyzacjach, niedziałających rutynach, niespójnych odpowiedziach i utrzymującej się frustracji użytkowników sprawiają, że model „wypuść, zbierz dane, popraw” jest szczególnie kosztowny, gdy dotyczy codziennego sterowania domem.
Bezpieczniejsze wdrażanie zachowałoby niezawodną, deterministyczną ścieżkę dla rutynowych poleceń, a generatywne funkcje wprowadzało wokół niej. Użytkownicy zyskaliby naturalną rozmowę bez utraty podstawowej obietnicy automatyki domowej: gdy wydają znaną komendę, właściwe urządzenie powinno osiągnąć zamierzony stan.
Najpraktyczniejszym wyjściem nie jest usunięcie modeli językowych z inteligentnego domu. Należy raczej ograniczyć ich rolę w punkcie, w którym pomyłki mają najbardziej bezpośrednie konsekwencje.
Solidny system mógłby wykorzystywać LLM do rozumienia języka i planowania, a następnie przekazywać wynik do warstwy sterowania wyposażonej w:
Jedna z prac badawczych opisuje pokrewne podejście, w którym LLM tworzy wykonywalne artefakty na etapie kompilacji, natomiast orkiestracja przepływu obsługuje rozgałęzienia, wybór narzędzi, ponowienia i błędy w sposób deterministyczny podczas działania systemu.
W przypadku inteligentnego domu oznacza to, że model może pomóc wyrazić intencję, ale nie powinien za każdym razem samodzielnie decydować o fizycznym działaniu. Im bliżej polecenie znajduje się określonej transakcji z urządzeniem, tym bardziej ograniczona, testowalna i przewidywalna powinna być ścieżka jego wykonania.
Alexa+ i Gemini for Home pokazują szerszą prawdę o generatywnej AI: większa biegłość w rozmowie nie oznacza automatycznie większej skuteczności w działaniu. Relacje recenzentów, użytkowników i serwisów technologicznych opisują asystentów, którzy lepiej rozumieją kontekst i potrafią układać ambitniejsze polecenia, ale nadal potykają się o światła, ściemniacze, alarmy i rutyny.
Trwały model inteligentnego domu prawdopodobnie połączy oba podejścia. Generatywna AI może uczynić konfigurację i rozmowę bardziej elastycznymi, natomiast deterministyczne oprogramowanie powinno zagwarantować, że końcowe działanie będzie dokładne, szybkie i możliwe do zweryfikowania. Dopóki ta granica nie zostanie dobrze zaprojektowana, bardziej rozmowny asystent może sprawiać wrażenie inteligentniejszego, a jednocześnie mniej niezawodnie wykonywać najbardziej podstawowe zadania w domu.