Interhuman AI podaje, że Inter 2 wykrywa 10 sygnałów rozmowy — m.in. wahanie, sceptycyzm i stres — oraz ogólny poziom zaangażowania.
Opublikowane przezEdytowane za pomocą GPT-6 LunaObrazy wygenerowane za pomocą GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How is Copenhagen-based Interhuman AI developing artificial social intelligence through its proprietary Inter-2 model, and what does the mod. Article summary: Interhuman AI is building a “social intelligence” layer that other AI systems can use to interpret not just what someone says, but how they say it. Its proprietary Inter-2 model combines text, audio and video to identify. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Interhuman AI chce, by systemy sztucznej inteligencji zwracały uwagę nie tylko na to, co ktoś mówi, lecz także na sposób, w jaki to robi. Kopenhaska firma rozwija w tym celu model Inter-2, który — według opublikowanych opisów — analizuje sygnały społeczne w czasie rzeczywistym, korzystając z tekstu, dźwięku i obrazu. Wyniki należy jednak traktować jako ocenę obserwowalnych zachowań, a nie pewny odczyt czyichś myśli lub uczuć. 2
5
Według opisu modelu Inter-2 ma wykrywać 10 sygnałów: zgodę, niezgodę, sceptycyzm, pewność siebie, wahanie, frustrację, zainteresowanie, niepewność, dezorientację i stres. Zwraca też ogólną ocenę zaangażowania. 18
Pomysł polega na łączeniu treści wypowiedzi ze wskazówkami takimi jak ton głosu, mimika i mowa ciała. Serwis Tech.eu opisuje analizę tekstu, dźwięku i obrazu, a katalog modeli — wykrywanie sygnałów na podstawie wideo z dźwiękiem. Dostępne opisy wskazują więc na podejście multimodalne, ale nie wyjaśniają dokładnie, jak każde z tych wejść jest wykorzystywane w poszczególnych konfiguracjach produktu. 2
5
18
Ważne zastrzeżenie: model może sklasyfikować zauważone sygnały, ale to nie znaczy, że zna ich przyczynę. Pauza, wyraz twarzy czy zmiana tonu mogą mieć różne wyjaśnienia — nie są uniwersalnym dowodem na określony stan psychiczny.
Interhuman AI powstała w Kopenhadze w 2023 roku. Wśród współzałożycieli wymieniani są Paula Petcu, Frederik Sally i Line Clemmensen. 1
7
9
Firma zakłada, że asystent AI może potrzebować czegoś więcej niż transkrypcji, by odpowiednio poprowadzić rozmowę. Jeśli system zauważy na przykład oznaki dezorientacji lub spadku zaangażowania, mógłby dostosować swoją odpowiedź. Tech.eu opisuje podejście Interhuman jako uzupełnianie dużych modeli językowych o analizę dźwięku i obrazu. 2
To jednak założenie dotyczące produktu, a nie dowód, że model niezawodnie rozpoznaje intencje każdej osoby w każdej sytuacji. Ten sam sygnał może znaczyć coś innego zależnie od człowieka i kontekstu.
Interhuman wskazuje m.in. na konwersacyjną AI i trening rozmów kwalifikacyjnych. Na swojej stronie opisuje ćwiczenia, które mają pomagać w pracy nad sposobem wypowiadania się. Firma przedstawia też scenariusz analizy wywiadów badawczych, w którym sygnały są przypisywane do odpowiednich fragmentów odpowiedzi. Ten przykład dotyczy wcześniejszego modelu Inter-1, więc nie dowodzi, że wszystkie funkcje są dostępne w Inter-2. 5
24
Takie przykłady pokazują, jak warstwa analizy sygnałów społecznych mogłaby wspierać coaching lub ułatwiać przeglądanie wywiadów. Same w sobie nie potwierdzają jednak skuteczności modelu w pracy z różnymi osobami, kulturami i sytuacjami. Dostępne źródła nie zawierają wystarczających szczegółów, by niezależnie ocenić tę skuteczność.
Interhuman deklaruje, że wcześniejszy model Inter-1 potrafi wskazać, które obserwowalne sygnały wpłynęły na daną ocenę. Firma opisuje też przypisywanie sygnałów do konkretnych fragmentów odpowiedzi w wywiadzie. Takie wyjaśnienia mogą ułatwiać weryfikację wyników, ale dostępne materiały nie potwierdzają, że każda ocena Inter-2 jest w ten sam sposób objaśniana i możliwa do prześledzenia. 25
24
Warunki korzystania z usług firmy wymieniają zastosowania objęte ograniczeniami, w tym wnioskowanie o emocjach danej osoby w miejscu pracy lub placówkach edukacyjnych. Publiczne materiały nie podają jednak wystarczających informacji o zasadach przechowywania danych, uzyskiwania zgody ani praktycznym egzekwowaniu tych ograniczeń. 19
To istotne, bo technologia analizuje twarze, głosy i przebieg rozmowy. Sygnały społeczne można błędnie odczytać albo wykorzystać do monitorowania ludzi. Dostępne informacje nie pozwalają ocenić, jak zabezpieczenia Interhuman odpowiadają na wszystkie te zagrożenia.
Materiały firmy i opisy medialne przedstawiają obecne, multimodalne podejście Inter-2, ale nie potwierdzają harmonogramu ani konkretnych zobowiązań technicznych dotyczących analizy wyłącznie głosu, rozmów wielu osób, kolejnych modeli czy ekspansji poza Europę. Na razie są to otwarte pytania, a nie ogłoszone funkcje ani daty. 2
5
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Interhuman AI podaje, że Inter 2 wykrywa 10 sygnałów rozmowy — m.in. wahanie, sceptycyzm i stres — oraz ogólny poziom zaangażowania.
Interhuman AI podaje, że Inter 2 wykrywa 10 sygnałów rozmowy — m.in. wahanie, sceptycyzm i stres — oraz ogólny poziom zaangażowania. Założona w Kopenhadze w 2023 roku firma rozwija warstwę „inteligencji społecznej” dla systemów AI.
Firma opisuje ograniczenia niektórych zastosowań, ale publiczne materiały nie wyjaśniają szczegółowo zasad przechowywania danych ani nie potwierdzają planów dotyczących rozmów wyłącznie głosowych czy wieloosobowych.