Inter 2 detecta, según la información disponible, 10 señales conversacionales —como duda, escepticismo y frustración— y un nivel general de participación. Fundada en Copenhague en 2023, Interhuman AI desarrolla una capa de inteligencia social para otros sistemas de IA, con posibles usos en conversación, entrenamient...
Publicado porEditado con GPT-6 LunaImágenes generadas con GPT Image 2
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: How is Copenhagen-based Interhuman AI developing artificial social intelligence through its proprietary Inter-2 model, and what does the mod. Article summary: Interhuman AI is building a “social intelligence” layer that other AI systems can use to interpret not just what someone says, but how they say it. Its proprietary Inter-2 model combines text, audio and video to identify. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Interhuman AI quiere que los sistemas de inteligencia artificial atiendan no solo a las palabras, sino también a la forma de decirlas. La empresa de Copenhague afirma que su modelo Inter-2 analiza señales sociales en tiempo real a partir de texto, audio y video. Lo que produce debe entenderse como una valoración de comportamientos observables, no como una lectura concluyente de los pensamientos o sentimientos de una persona. 2
5
Según la información publicada, el modelo identifica 10 señales: acuerdo, desacuerdo, escepticismo, confianza, vacilación, frustración, interés, incertidumbre, confusión y estrés. También indica un estado general de participación. 18
La propuesta es combinar las palabras con señales como el tono de voz, la expresión facial y el lenguaje corporal. Tech.eu describe el análisis de Inter-2 como multimodal —es decir, basado en más de un tipo de información— y señala que abarca texto, audio y video. Una ficha del modelo, en cambio, describe la detección a partir de video con audio. Las descripciones públicas respaldan que se utilizan varias modalidades, pero no explican por completo cómo se procesa cada entrada en todas las configuraciones del producto. 2
5
18
Interhuman AI se fundó en Copenhague en 2023. Entre sus cofundadores figuran Paula Petcu, Frederik Sally y Line Clemmensen. 1
7
9
La premisa de la empresa es que, para responder de manera adecuada, un asistente de IA podría necesitar algo más que una transcripción. Por ejemplo, una señal de confusión o falta de participación podría servir para adaptar la interacción. Tech.eu describe el enfoque de Interhuman como una combinación de modelos de lenguaje grandes con análisis de audio y video. 2
Ese es un objetivo de producto, no una prueba de que el modelo pueda inferir de forma fiable la intención de cualquier persona en cualquier situación. Una pausa, un gesto o un cambio en el tono pueden tener distintas explicaciones; por eso, una señal no equivale a un diagnóstico ni tiene una interpretación universal.
Interhuman presenta la IA conversacional y la preparación para entrevistas como posibles aplicaciones. En su sitio web describe sesiones de práctica de entrevistas centradas en la forma de expresarse. También ha explicado un uso para investigación en el que se vinculan señales a partes pertinentes de una respuesta. Ese ejemplo corresponde a Inter-1, un modelo anterior, y no demuestra que todas las funciones estén disponibles de la misma manera en Inter-2. 5
24
Estos casos muestran cómo una capa de análisis de señales sociales podría apoyar el entrenamiento o ayudar a revisar entrevistas. Por sí solos, no prueban que el modelo funcione con precisión en personas, culturas o contextos distintos. Las fuentes disponibles no ofrecen suficiente información para evaluar de forma independiente su desempeño.
Interhuman afirma que su modelo anterior, Inter-1, puede explicar qué señales de comportamiento contribuyeron a una valoración. La empresa también describe la posibilidad de asociar señales con frases específicas de respuestas en entrevistas. Son funciones de transparencia útiles cuando están disponibles, pero las fuentes no confirman que todas las respuestas de Inter-2 incluyan las mismas explicaciones o el mismo nivel de trazabilidad. 25
24
Las condiciones de uso de la empresa enumeran ciertos usos restringidos, entre ellos inferir emociones de una persona en entornos laborales o educativos. Sin embargo, la información disponible no basta para describir sus prácticas de conservación de datos, sus procesos de consentimiento ni cómo se aplican esas restricciones en la práctica. 19
Estas preguntas importan porque la tecnología analiza rostros, voces y conversaciones. Las señales sociales pueden interpretarse mal o utilizarse para vigilar; la evidencia disponible no permite determinar cómo las salvaguardas de Interhuman abordan todos esos riesgos.
Los materiales de la empresa y la cobertura citada describen el enfoque multimodal actual de Inter-2, pero no confirman un calendario ni compromisos técnicos específicos para el análisis solo de voz, las conversaciones entre varias personas, futuros modelos o una expansión fuera de Europa. Por ahora, son preguntas abiertas, no capacidades o fechas anunciadas. 2
5
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
Inter 2 detecta, según la información disponible, 10 señales conversacionales —como duda, escepticismo y frustración— y un nivel general de participación.
Inter 2 detecta, según la información disponible, 10 señales conversacionales —como duda, escepticismo y frustración— y un nivel general de participación. Fundada en Copenhague en 2023, Interhuman AI desarrolla una capa de inteligencia social para otros sistemas de IA, con posibles usos en conversación, entrenamiento para entrevistas e investigación.
La empresa publica algunas restricciones de uso, pero las fuentes no detallan prácticas de conservación de datos ni confirman planes para conversaciones solo de voz o con varias personas.