その後、およそ1年で開発と統合が進み、2026年5月にはLGのフラッグシップOLEDテレビに商用導入されたことが報じられました。
この展開は、コンシューマー向けAI製品によく見られる流れです。
LGの場合、この技術は2026年に数百万台規模のテレビに搭載される可能性があるとされています。
KardomeのSpatial Hearing AIは、人間の聴覚に近い形で音環境を理解することを目指した技術です。
従来の音声認識システムは、部屋の音を「ひとつの混ざった音声信号」として処理することが多くありました。
一方、この技術は部屋の音響空間を3Dマップとして解析します。
その結果、デバイスは次のようなことが可能になります。
つまりテレビは、部屋の中で誰が話しているのかを判断し、その人の声だけを優先して理解できるようになります。
一般的な音声アシスタントは、マイクの指向性制御(ビームフォーミング)とクラウド側の音声認識に大きく依存しています。
しかし多くの場合、システムは
という前提で設計されています。
実際の家庭では、子どもが話していたり、テレビの音が流れていたり、複数人が同時に会話していたりするため、誤認識が起きやすくなります。
Spatial Hearing AIは、音を**「3次元空間に存在する別々の音源」**として扱うことでこの問題に対応します。
これによりテレビは、混ざった音声ではなく特定の声にフォーカスできるようになります。
Kardomeの技術のもう一つの特徴が、エッジ(デバイス内)処理を重視した設計です。
多くの音声システムでは、音声データをクラウドへ送信して解析しますが、Spatial Hearing AIは処理の多くをテレビ本体で行います。
この方式には主に2つのメリットがあります。
1. 応答速度の向上
音声データを遠隔サーバーに送る必要が減るため、テレビの反応が速くなります。
2. プライバシーの強化
生の音声データをクラウドに送信する量を減らせるため、常時リスニング型デバイスにおけるプライバシーリスクを抑えられます。
スマート家電や車載システムなどでは、このエッジ優先型AIが業界トレンドになりつつあります。
LGとKardomeは、Spatial Hearing AIをテレビだけの技術とは位置付けていません。
2025年の発表では、今後の展開先として次のカテゴリーが挙げられています。
特に車載分野では、複数の乗員が同時に話す環境が一般的です。KardomeはCESなどで、どの乗員が話しているかを識別して応答する車載音声システムのデモも公開しています。
今回のLGテレビへの導入は、音声インターフェースの進化を象徴しています。
従来のシステムは「何を言ったか」を認識するだけでした。
次世代の音声AIは、
といった文脈や空間情報まで理解する方向に進んでいます。
LGのOLEDテレビにとっては、その結果として「騒がしい部屋でも正しい人の声を聞き分けるテレビ」という、これまで難しかった体験が実現しつつあります。