Interhuman AIによると、Inter 2はためらい、懐疑、ストレスなど10種類の会話中のサインと、全体的なエンゲージメント状態を検出します。 2023年にコペンハーゲンで設立された同社は、会話型AIや面接練習、インタビュー調査などへの応用を想定しています。
公開者GPT-6 Luna で編集GPT Image 2 で画像を生成
研究の答え

Create a landscape editorial hero image for this Studio Global article: How is Copenhagen-based Interhuman AI developing artificial social intelligence through its proprietary Inter-2 model, and what does the mod. Article summary: Interhuman AI is building a “social intelligence” layer that other AI systems can use to interpret not just what someone says, but how they say it. Its proprietary Inter-2 model combines text, audio and video to identify. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Interhuman AIが開発する「Inter-2」は、会話の文字起こしだけでなく、声の調子や表情、身ぶりといった手がかりもAIに読み取らせようとするモデルです。コペンハーゲンを拠点とする同社は、会話中の社会的なサインをリアルタイムで分析する技術を開発しています。ただし、ここで示されるのは観察可能な振る舞いについての推定であり、本人の本心や感情を確定的に読み取るものではありません。2
5
モデル情報によると、Inter-2は「同意」「不同意」「懐疑」「自信」「ためらい」「いら立ち」「関心」「不確かさ」「混乱」「ストレス」の10種類のサインに加え、全体的なエンゲージメントの状態を出力します。18
考え方のポイントは、発言内容だけでなく、声の出し方や表情、ボディーランゲージなども手がかりにすることです。Tech.euは、Inter-2がテキスト・音声・映像を横断して分析すると報じています。一方、モデルの紹介では、音声付き動画からサインを検出すると説明されています。公開情報から複数の入力を扱うことはうかがえますが、製品ごとに各入力をどう処理するのかまでは明らかになっていません。2
5
18
Interhuman AIは2023年にコペンハーゲンで設立されました。共同創業者として、パウラ・ペトク、フレデリク・サリー、リーネ・クレメンセンが紹介されています。1
7
9
同社が目指すのは、既存のAIシステムに「社会的知性」の層を加えることです。たとえば、相手が混乱している、あるいは会話への関心を失っている可能性を示すサインに応じて、AIアシスタントが説明の仕方を変える、といった活用を想定しています。Tech.euは、大規模言語モデルに音声・映像の分析を組み合わせる同社の構想を伝えています。2
ただし、これは製品の狙いであって、どんな状況でも人の意図を正確に読み取れるという証明ではありません。沈黙や表情、声の変化にはさまざまな理由があり、ひとつのサインを診断や普遍的な意味づけとして扱うべきではありません。
Interhumanは、会話型AIや面接コーチングなどを応用先として挙げています。同社のウェブサイトでは、模擬面接で話し方や伝え方を練習する用途が紹介されています。また、研究インタビューに関する同社の資料では、回答の該当箇所にサインを紐づける例が示されています。ただし、このインタビューの例は旧モデルのInter-1に関するもので、Inter-2でも同じ機能がすべて提供されることを示すものではありません。5
24
こうした例からは、面接の練習やインタビューの振り返りを支援する使い方が考えられます。一方で、異なる人や文化、状況に対する認識精度が実証されたわけではありません。公開資料だけでは、その性能を独立して評価するための情報は十分ではありません。
Interhumanによると、旧モデルのInter-1は、サインの判定にどの行動上の手がかりが関係したかを説明できます。同社は、インタビュー回答の特定のフレーズにサインを紐づける方法も紹介しています。こうした機能があれば結果を検討する助けになりますが、Inter-2のすべての出力で同じ説明や追跡が可能かどうかは、公開情報からは確認できません。25
24
同社の利用規約では、職場や教育機関で個人の感情を推定することなど、一部の利用が制限対象として挙げられています。ただし、データの保存期間、同意の取得方法、利用制限が実際にどう運用されるかについては、資料から十分に把握できません。19
顔や声、会話を分析する技術である以上、こうした点は重要です。社会的なサインは誤って解釈される可能性があり、監視に使われる懸念もあります。公開情報だけでは、同社の対策があらゆるリスクにどう対応するかまでは判断できません。
参照できる報道や同社資料は、Inter-2が複数の情報を扱う現在のアプローチを説明しています。一方、音声のみの分析、複数人の会話、次期モデル、欧州以外への展開について、具体的な日程や技術上の確約は確認できません。現時点では、発表済みの機能や予定ではなく、今後の課題として捉えるのが適切です。2
5
Studio Global AI
このページにはソースに裏付けされた回答が含まれており、Studio Global 内で続行できます。
Interhuman AIによると、Inter 2はためらい、懐疑、ストレスなど10種類の会話中のサインと、全体的なエンゲージメント状態を検出します。
Interhuman AIによると、Inter 2はためらい、懐疑、ストレスなど10種類の会話中のサインと、全体的なエンゲージメント状態を検出します。 2023年にコペンハーゲンで設立された同社は、会話型AIや面接練習、インタビュー調査などへの応用を想定しています。
利用規約には一部の用途制限がありますが、データ保存や同意取得の詳細、音声のみ・複数人の会話への対応予定は、公開情報からは確認できません。