Solaris es un modelo experimental de Runway que genera interfaces interactivas fotograma a fotograma, en lugar de ensamblar HTML, CSS, JavaScript y pantallas prediseñadas. El sistema combina un modelo de lenguaje que interpreta la intención del usuario con un modelo visual basado en Gen 4.5 para decidir y representa...
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What is Runway’s Solaris, announced on August 31 as an experimental “Interface World Model,” how does it generate fully interactive apps and. Article summary: Runway’s Solaris is an experimental “Interface World Model” announced on August 31 that treats an app or website as a continuously generated visual environment, rather than code—HTML, CSS, JavaScript, a DOM, and prebuilt. Topic tags: general, documentation, general web, academic, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, w
Runway Solaris plantea una idea radical: que una aplicación no tenga que cargar pantallas programadas de antemano, sino que genere su propia interfaz continuamente. En lugar de mostrar un sitio web construido con código, el sistema crea una secuencia de estados visuales que cambia cuando el usuario hace clic, arrastra un elemento, escribe o describe lo que quiere que ocurra. 38
Por eso Solaris es más que un creador de aplicaciones sin código. Runway intenta aplicar a las interfaces el enfoque de los modelos del mundo: la pantalla no se dibuja a partir de una implementación fija, sino que se genera como un entorno visual vivo que evoluciona con cada interacción.
Runway presentó Solaris el 31 de agosto como un «Interface World Model» o modelo del mundo para interfaces. Su propuesta sustituye el flujo habitual —escribir HTML, CSS y JavaScript para que el navegador renderice el resultado— por la generación directa de aquello que el usuario ve.
La experiencia puede comenzar con una imagen de referencia, como una escena de producto o un entorno de marca. A partir de ahí, el modelo genera la interfaz y la modifica en respuesta a las acciones del usuario. No hay una colección convencional de pantallas prediseñadas que el desarrollador deba anticipar una por una: Solaris intenta sintetizar cuál debería ser el siguiente estado.
La diferencia es importante porque una imagen o una escena visual contiene detalles que pueden perderse cuando un modelo debe traducir primero ese concepto a código. Solaris mantiene la escena visual como resultado principal, una estrategia que Runway presenta como una forma de conservar la coherencia y un comportamiento más natural durante la interacción.
Solaris separa la interpretación de la acción de la representación visual de sus consecuencias:
El componente visual se apoya en la tecnología de generación de vídeo Gen-4.5 de Runway. La documentación de la compañía describe Gen-4.5 como un modelo para generar vídeo a partir de texto o imágenes; Solaris utiliza esa base visual en un sistema interactivo y autorregresivo. 4
6
Generar un nuevo estado visual después de cada acción es muy distinto de producir un clip de vídeo breve. Por eso Solaris incorpora varias técnicas para reducir la latencia y mantener la calidad durante sesiones prolongadas.
El modelo genera los fotogramas de forma autorregresiva: cada uno se condiciona por lo que ocurrió antes. Así puede responder a una acción continuando la escena actual, en lugar de iniciar una generación completamente desconectada.
Runway afirma que destila un modelo de difusión más lento —el «profesor»— en otro más veloz que necesita solo unos pocos pasos de eliminación de ruido. El objetivo es reducir el cálculo necesario para cada respuesta sin perder la calidad visual suficiente para una experiencia interactiva.
La compañía también asegura que entrenó el modelo rápido con imágenes generadas por él mismo. La intención es limitar la degradación de calidad durante las cadenas largas de fotogramas, en las que pequeños errores podrían acumularse con el tiempo.
Los objetivos declarados por Runway incluyen una latencia de interacción inferior a aproximadamente medio segundo, coherencia durante toda la sesión y una calidad visual de 720p. Son metas de investigación, no una garantía de que cada interacción alcance esos valores.
Runway informa de un estudio con 250 participantes y aproximadamente 7.500 juicios por pares en 30 ejemplos de interacción. Los participantes compararon interfaces generadas por Solaris con otras producidas como código por Claude Opus 5.
Según los resultados comunicados, los participantes prefirieron Solaris en:
Los datos sugieren que una interfaz generada puede sentirse más coherente visualmente o más intuitiva en determinados escenarios. Pero no demuestran que Solaris sea, en términos generales, mejor que el software convencional. El estudio se centra en valoraciones subjetivas de interacción, no en fiabilidad, corrección, seguridad, mantenimiento, coste, rendimiento o accesibilidad. Además, la información disponible aquí no permite comprobar de forma independiente toda la metodología ni el análisis estadístico del estudio.
La misma flexibilidad que hace atractivo al sistema también plantea problemas de ingeniería y de producto.
El texto legible y exacto continúa siendo un desafío para la generación de imágenes y vídeo en tiempo real. Una interfaz puede resultar visualmente atractiva y, aun así, mostrar mal sus etiquetas, números, menús o instrucciones. Runway reconoce que la generación de texto es un problema abierto y apunta a una posible solución híbrida: usar modelos de imagen para momentos estáticos con mucho texto y modelos de vídeo para la interacción continua.
Una interfaz visualmente creíble no es necesariamente fiable. Solaris se apoya principalmente en las imágenes iniciales y en las referencias proporcionadas, por lo que podría presentar con seguridad una respuesta, un dato de producto o una representación visual incorrectos. Runway señala como línea de investigación la incorporación de datos verificados, documentos y materiales de referencia más completos.
Cada estado depende de una cadena de estados generados y de las decisiones del modelo. Por ello, los errores pueden acumularse durante un uso abierto y prolongado. Mantener consistentes la escena, las propiedades de los objetos, las instrucciones y el historial de interacción sigue siendo un problema de investigación.
En una web convencional, el dispositivo del usuario recibe código y recursos que después renderiza. Solaris, en cambio, necesita realizar trabajo generativo continuo para producir lo que aparece en pantalla. Runway afirma que sus optimizaciones hacen el proceso mucho más barato que la difusión de vídeo estándar, pero generar fotogramas uno a uno sigue siendo más exigente que servir una página codificada y fija. El objetivo de calidad visual declarado para el prototipo es 720p.
Una imagen renderizada no expone automáticamente los significados estructurados que necesitan los lectores de pantalla y otras tecnologías de asistencia. Tampoco ofrece por sí sola el estado inspeccionable, la estructura de eventos y las interfaces predecibles que requieren muchos sistemas de software. Analistas han identificado la ausencia de un DOM convencional y de una capa de accesibilidad como un obstáculo importante para desplegar este enfoque en entornos que exigen accesibilidad o auditoría.
Solaris se presentó como una investigación experimental, no como una plataforma de producción disponible para todo el público. Los informes lo describen como una vista previa de investigación con acceso anticipado o mediante solicitud, no como un producto general para crear aplicaciones.
Por ahora, su importancia es principalmente conceptual y científica. Muestra una posible dirección para las interfaces de software, pero todavía no demuestra que los equipos puedan utilizarlo como sustituto directo de aplicaciones desarrolladas con código.
Solaris forma parte de la investigación más amplia de Runway sobre modelos del mundo, aunque tiene un objetivo distinto. Runway describe GWM-1 como un simulador generalista y en tiempo real de entornos, avatares y manipulación robótica. Solaris concentra esa idea en las interfaces: el «mundo» que se simula es una aplicación o un sitio web, y las acciones del usuario impulsan su evolución. 12
En ese sentido, Solaris amplía el foco de Runway: ya no se trata solo de generar medios, sino de crear entornos visuales interactivos. La interfaz no es simplemente un vídeo para mirar; es una escena que responde a las acciones y se vuelve a generar mientras continúa la sesión.
Si el enfoque llega a ser fiable, los creadores podrían describir en lenguaje natural un entorno visual, sus productos, objetivos y comportamientos, en vez de programar por adelantado cada estado posible. Esto podría resultar especialmente interesante para experiencias espaciales, visuales o exploratorias en las que las estructuras tradicionales de una interfaz se quedan cortas.
El intercambio es claro: la flexibilidad provendría de la generación, no de una lógica de programa explícita. En software de producción seguirían siendo imprescindibles el comportamiento predecible, las pruebas, la integridad de los datos, la accesibilidad y la integración con otros sistemas. Solaris aún no ha demostrado que pueda sustituir esas prácticas de ingeniería.
Solaris también apunta a una forma de permitir que los agentes de IA operen en entornos visuales desconocidos. En vez de depender exclusivamente de API fijas o flujos programados, un agente podría interpretar la interfaz como un mundo dinámico, ejecutar una acción, observar el estado resultante y continuar a partir de ahí.
La ambición es relevante para agentes que deben desenvolverse en interfaces que no fueron diseñadas con un esquema de automatización conocido. Pero sigue siendo una línea de investigación. Las API estructuradas y el software convencional accesible mantienen ventajas importantes cuando se necesitan auditoría, precisión y ejecuciones repetibles.
Solaris se entiende mejor como una vista previa de investigación sobre interfaces generativas, no como el final del desarrollo basado en código. Su idea central es que la interfaz sea el resultado directo del modelo: una sucesión de fotogramas generados por IA, guiada por un modelo de lenguaje y moldeada por las acciones del usuario.
El estudio comunicado por Runway indica que, en algunos casos, las personas prefieren este enfoque para seguir instrucciones y comportarse de manera natural. Sin embargo, sus problemas pendientes —la precisión del texto, la veracidad de la información, la coherencia en sesiones largas, el coste de generación, la accesibilidad y la integración— son requisitos esenciales de cualquier producto, no simples detalles de acabado. Solaris muestra cómo podría ser un modelo del mundo para interfaces, pero también deja claro por qué el código convencional sigue siendo difícil de reemplazar.
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
Solaris es un modelo experimental de Runway que genera interfaces interactivas fotograma a fotograma, en lugar de ensamblar HTML, CSS, JavaScript y pantallas prediseñadas.
Solaris es un modelo experimental de Runway que genera interfaces interactivas fotograma a fotograma, en lugar de ensamblar HTML, CSS, JavaScript y pantallas prediseñadas. El sistema combina un modelo de lenguaje que interpreta la intención del usuario con un modelo visual basado en Gen 4.5 para decidir y representar el siguiente estado de la interfaz.
Solaris es todavía una vista previa de investigación, no un sustituto demostrado para el software convencional, las API estructuradas o las interfaces accesibles de producción.