Det grundläggande problemet är en krock mellan två olika sätt att fungera: en sannolikhetsbaserad språkmodell och ett styrsystem som användaren förväntar sig ska vara exakt. Generativa assistenter kan förstå friare formuleringar och bygga rutiner i flera steg, men deras varierande tolkningar, extra fördröjning och osäkra val av verktyg eller API:er gör dem mindre pålitliga för de enkla uppgifter – lampor, musik, timers och rutiner – som smarta högtalare faktiskt ska klara. 16
Misslyckandena är vardagliga – inte extrema undantag
I ett test ignorerade Gemini for Home musikönskemål, bytte plötsligt samtalsämne, hävdade att det var tisdag trots att det var onsdag och vägrade släcka smarta lampor. Assistenten uppgav då att den inte kunde styra eller kommunicera med hemmets belysning och andra fysiska enheter – trots att just sådan styrning är en av smarta högtalares mest grundläggande funktioner. 1
Alexa+ har på liknande sätt rapporterats misslyckas med en tidigare fungerande rutin för att sätta på en kaffemaskin. Vissa användare har dessutom uppgett att deras befintliga rutiner försvann efter uppgraderingen. 67 Samtidigt har tester visat att Alexa+ också kan skapa fungerande automatiseringar med rösten, till exempel en rutin som tänder utebelysningen när en person upptäcks av en kamera under vissa tider. Det pekar på inkonsekvens snarare än på att tekniken helt saknar förmåga. 2
Den gamla assistenten följde regler – den nya tolkar
Traditionell röststyrning brukar koppla igenkända fraser och namngivna enheter till ett bestämt kommando och ett fördefinierat API-anrop. Säg ”släck kökslamporna”, så ska samma åtgärd normalt utföras varje gång.
En stor språkmodell tolkar i stället sammanhanget och genererar ett förslag på vilket verktyg eller API som ska användas utifrån sannolikheter. Google har själv beskrivit Gemini som ”icke-deterministisk”, vilket innebär att den inte enbart följer ett fast skript. 15 Den flexibiliteten gör samtalen naturligare, men innebär också att till synes identiska instruktioner kan tolkas eller dirigeras olika mellan olika tillfällen. Det är svårt att acceptera när ”släck” alltid måste betyda samma fysiska handling. 315
Det som saknas är inte samtalsförmåga – utan driftsäkerhet
Återkommande rapporter pekar på att tillförlitlighet, svarstid och värde är de verkliga produktutmaningarna. Användare har beskrivit långsamma svar, felaktiga uppgifter, kommandon som tappas bort, problem med att välja rätt musik och rutiner som försvinner. 5712
Den tekniska slutsatsen är därför att en språkmodell inte bör vara ensam beslutsfattare när hemmet ska styras. Den behöver omges av deterministiska lager som kontrollerar kommandot, verifierar att rätt enhet har valts och ser till att åtgärden verkligen genomförs. AI:n kan tolka naturligt språk – men den slutliga exekveringen måste vara betydligt mer förutsägbar.
Apple har inte heller löst problemet
Apple är inte ett undantag. Företaget har skjutit upp flera av Siris mer personliga AI-funktioner efter tekniska problem och buggar. Förseningen har även påverkat företagets planer för smarta hem: den länge ryktade smarta hemskärmen har senarelagts medan Apple arbetat vidare med den nya Siri-versionen. 348
Rapporter tyder dessutom på att befintlig HomePod-hårdvara inte har tillräcklig beräkningskapacitet för Apples nyare AI-ambitioner. Det kan bidra till att nya modeller dröjer och att Siri fortfarande fungerar ojämnt i vissa sammanhang. 914
En imponerande demo är inte samma sak som en färdig produkt
Den större lärdomen är att en övertygande demonstration av konversations-AI inte bevisar att tekniken är redo för vardagsbruk. När en produkt ska styra ett hem – eller hantera kalendrar, inköp och meddelanden – måste kraven vara högre: beteendet ska vara förutsägbart, fel ska förklaras tydligt, svaren ska komma snabbt och det ska finnas säkra reservlösningar.
Om systemen släpps innan de egenskaperna är på plats hamnar testningen i praktiken hos kunderna. De får upptäcka integrationsfel, hitta buggar och själva bära kostnaden när tekniken misslyckas. Med andra ord riskerar konsumenterna att bli den betalande betatestgruppen.