Secondo le descrizioni disponibili, Inter 2 rileva 10 segnali conversazionali, tra cui esitazione, scetticismo e stress, oltre a un indicatore generale di coinvolgimento. Fondata a Copenaghen nel 2023, Interhuman AI sviluppa uno strato di intelligenza sociale per altri sistemi di IA, con possibili applicazioni nella...
Pubblicato daModificato con GPT-6 LunaImmagini generate con GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How is Copenhagen-based Interhuman AI developing artificial social intelligence through its proprietary Inter-2 model, and what does the mod. Article summary: Interhuman AI is building a “social intelligence” layer that other AI systems can use to interpret not just what someone says, but how they say it. Its proprietary Inter-2 model combines text, audio and video to identify. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Interhuman AI sta sviluppando uno strato di «intelligenza sociale» pensato per aiutare i sistemi di IA a cogliere, oltre alle parole, alcuni segnali che accompagnano una conversazione. La società di Copenaghen afferma che il modello Inter-2 analizza questi indizi in tempo reale; le descrizioni pubbliche parlano di testo, audio e video. I risultati vanno intesi come valutazioni di comportamenti osservabili, non come letture certe dei pensieri o dei sentimenti di una persona. 2
5
Secondo le informazioni disponibili, il modello individua 10 segnali: accordo, disaccordo, scetticismo, sicurezza, esitazione, frustrazione, interesse, incertezza, confusione e stress. Fornisce anche un’indicazione generale sul livello di coinvolgimento. 18
L’obiettivo è affiancare alle parole indizi come il tono della voce, le espressioni del viso e il linguaggio del corpo. Tech.eu descrive Inter-2 come un sistema che analizza segnali provenienti da testo, audio e video; una scheda del modello parla invece di rilevamento a partire da video con audio. Le fonti pubbliche indicano quindi un approccio multimodale, ma non spiegano completamente come venga gestito ciascun input in ogni configurazione del prodotto. 2
5
18
Interhuman AI è stata fondata a Copenaghen nel 2023. Tra i cofondatori figurano Paula Petcu, Frederik Sally e Line Clemmensen. 1
7
9
L’idea alla base del progetto è che, per rispondere in modo adeguato, a un assistente di IA possa servire più della trascrizione di una conversazione. Per esempio, rilevare segnali di confusione o scarso coinvolgimento potrebbe aiutarlo ad adattare l’interazione. Tech.eu descrive l’approccio dell’azienda come un’integrazione dell’analisi di audio e video con i modelli linguistici di grandi dimensioni. 2
Si tratta però di un obiettivo di prodotto, non della prova che il modello possa dedurre con affidabilità le intenzioni di chiunque e in qualsiasi situazione. Una pausa, un’espressione o un cambiamento nel tono di voce possono avere spiegazioni diverse: non vanno interpretati come una diagnosi né come segnali dal significato universale.
Interhuman indica tra le possibili applicazioni l’IA conversazionale e il coaching per i colloqui. Sul proprio sito descrive esercitazioni di colloquio focalizzate sul modo di esprimersi; il materiale aziendale sulle interviste di ricerca illustra invece come associare i segnali alle parti pertinenti di una risposta. Quest’ultimo esempio riguarda Inter-1, un modello precedente: non dimostra che tutte le funzioni siano identiche per Inter-2. 5
24
Questi casi mostrano come uno strato di analisi dei segnali sociali potrebbe essere usato nel coaching o aiutare i ricercatori a rivedere le interviste. Da soli, però, non dimostrano che il sistema sia accurato con persone, culture o situazioni diverse. Le fonti disponibili non offrono dettagli sufficienti per valutarne in modo indipendente le prestazioni.
Interhuman afferma che il precedente modello Inter-1 può spiegare quali indizi comportamentali abbiano contribuito a una valutazione. L’azienda descrive anche la possibilità di collegare i segnali a frasi specifiche nelle risposte raccolte durante un’intervista. Sono elementi utili per la trasparenza, quando disponibili, ma le fonti non confermano che ogni risultato di Inter-2 offra le stesse spiegazioni o lo stesso livello di tracciabilità. 25
24
Nei propri termini di servizio, l’azienda elenca alcuni impieghi soggetti a restrizioni, tra cui dedurre le emozioni di una persona in ambito lavorativo o educativo. Le informazioni pubbliche non sono sufficienti per descrivere le pratiche di conservazione dei dati, le procedure di consenso o le modalità concrete di applicazione di tali restrizioni. 19
Sono questioni importanti, perché la tecnologia analizza volti, voci e conversazioni. I segnali sociali possono essere interpretati male o utilizzati per sorvegliare le persone; le evidenze disponibili non permettono di stabilire come le tutele di Interhuman affrontino ogni possibile rischio.
Le notizie e i materiali aziendali citati descrivono l’attuale approccio multimodale di Inter-2, ma non confermano una tempistica o impegni tecnici specifici per l’analisi della sola voce, le conversazioni tra più persone, i modelli successivi o un’espansione oltre l’Europa. Per ora sono questioni aperte, non funzionalità o date annunciate. 2
5
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Secondo le descrizioni disponibili, Inter 2 rileva 10 segnali conversazionali, tra cui esitazione, scetticismo e stress, oltre a un indicatore generale di coinvolgimento.
Secondo le descrizioni disponibili, Inter 2 rileva 10 segnali conversazionali, tra cui esitazione, scetticismo e stress, oltre a un indicatore generale di coinvolgimento. Fondata a Copenaghen nel 2023, Interhuman AI sviluppa uno strato di intelligenza sociale per altri sistemi di IA, con possibili applicazioni nella conversazione, nel coaching per colloqui e nella ricerca.
Le informazioni pubbliche indicano alcune restrizioni d’uso, ma non chiariscono nel dettaglio la conservazione dei dati né confermano una tabella di marcia per conversazioni solo vocali o con più persone.