✨︎ Resumen (TL;DR):
- Keyu Tian consiguió casi 30 millones de dólares para un laboratorio de IA enfocado en representar y simular entornos físicos.
- 5Y Capital e IDG Capital participaron en una inversión que valuó la compañía en 200 millones de dólares después de la operación.
- El equipo construyó un diccionario de 200,000 símbolos y planea mostrar sus capacidades antes del lanzamiento previsto para 2027.
Keyu Tian, exbecario de ByteDance, recaudó casi 30 millones de dólares para un laboratorio de IA que busca desarrollar modelos de mundo, sistemas orientados a representar y simular entornos físicos. 5Y Capital e IDG Capital participaron en la inversión, que valuó la compañía en 200 millones de dólares después de la operación; el laboratorio todavía no tiene nombre ni producto públicos.
Un modelo de mundo es un sistema de IA que representa y simula un entorno físico. Bloomberg reportó la operación en un informe publicado el 7 de octubre de 2026. Representantes de ambos fondos confirmaron su participación a Bloomberg, aunque no ofrecieron más comentarios.
El laboratorio reúne a 10 personas, incluidos otros exempleados de ByteDance. Su investigación se concentra en cómo representar información visual para que una IA la procese con mayor eficiencia. La propuesta parte del trabajo de Tian en generación de imágenes y ahora apunta al video, con posibles aplicaciones en robótica, entornos interactivos y conducción autónoma.

Un diccionario visual para procesar video
Tian dijo a Bloomberg que su equipo construyó un sistema parecido a un diccionario para IA, compuesto por 200,000 símbolos que las personas no reconocerían. El objetivo es codificar información visual difícil de capturar mediante descripciones escritas.
“Nunca puedes describir perfectamente un video usando lenguaje humano”, dijo Tian a Bloomberg.
El investigador describió una estrategia que primero crea ese lenguaje para la IA y después alimenta a la IA con 100 millones de horas de video. Según Tian, la técnica permitiría reducir a una décima parte, o menos, el costo de generar 1 segundo de video.
Esa reducción es una afirmación del fundador. El reporte no detalla las condiciones de la comparación ni presenta una evaluación independiente del ahorro.
Por ahora, el equipo concentra su trabajo en la tecnología. Tian dijo que no está dedicando tiempo a un producto de consumo ni a definir un modelo de negocio.
De la generación de imágenes a los entornos físicos
Tian figura como primer autor de Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction, conocido como VAR. El trabajo recibió uno de los premios a mejor artículo de NeurIPS 2024, según el anuncio oficial de la conferencia.
El artículo propone generar imágenes de menor a mayor resolución. El modelo comienza con una representación general y predice versiones cada vez más detalladas, en lugar de recorrer una secuencia de fragmentos de imagen.
La evidencia experimental del artículo corresponde a la generación de imágenes. El laboratorio plantea extender esa experiencia al video y a los modelos de mundo, pero las aplicaciones robóticas todavía requieren evidencia sobre cómo se comportan los entornos y los agentes que interactúan con ellos.
Qué debe representar un modelo de mundo
En una explicación técnica publicada por World Labs el 3 de junio de 2026, la compañía distingue entre modelos que producen imágenes, simuladores que representan la estructura y la dinámica de un entorno, y sistemas que planifican acciones.
Para un generador visual, importa lo que ve una persona. Un simulador utilizado para entrenar un robot también necesita que la geometría y las consecuencias de sus movimientos sean consistentes. Un planificador debe elegir acciones a partir de lo que observa y de un objetivo.
Bajo esa distinción, el ahorro en generación de video que anuncia Tian y la fidelidad física de un modelo son resultados distintos. Ambos tendrían que evaluarse por separado.
World Labs y el acuerdo pendiente con AMD
El laboratorio de Tian entra en un campo donde también participa World Labs, cofundada por Fei-Fei Li. La compañía presentó Atlas en septiembre, un modelo orientado a generar y reconstruir espacios tridimensionales.
World Labs anunció el 28 de septiembre de 2026 que firmó un acuerdo definitivo para incorporarse a AMD. Aunque Bloomberg describe la operación como una adquisición realizada, el comunicado oficial sitúa el cierre esperado antes de terminar 2026, sujeto a aprobaciones regulatorias y otras condiciones habituales.
World Labs explica que busca acercar su investigación al hardware después de trabajar con AMD en el entrenamiento y la optimización de modelos con sus GPU. La representación visual no es el único frente: también cuenta la infraestructura necesaria para entrenar y ejecutar estos sistemas.
Tian planea mostrar las capacidades de su laboratorio en eventos presenciales antes de lanzar el modelo completo en 2027. El capital conseguido financiará una etapa dedicada a desarrollar la tecnología, mientras el producto comercial sigue por definirse.
