Inteligencia artificial

World Labs presenta Atlas como modelo mundial para comprender entornos tridimensionales

World Labs, cofundada por Fei-Fei Li, presentó Atlas, un modelo multimodal que procesa texto, imágenes, vídeo y datos 3D dentro de un único contexto espacial. El modelo puede crear entornos virtuales, reconstruir escenas reales y producir simulaciones para entrenar robots, pero todavía solo está disponible para socios seleccionados y no se han anunciado detalles sobre su precio ni sobre la fecha de disponibilidad general.

2026-09-02
4 min de lectura
6 visitas
certi.news
World Labs presenta Atlas como modelo mundial para comprender entornos tridimensionales

World Labs anunció Atlas, un nuevo modelo que la empresa describe como un «modelo mundial» para la inteligencia espacial. Atlas combina texto, imágenes, vídeo y datos tridimensionales dentro de una única arquitectura, con el objetivo de comprender las relaciones espaciales entre los elementos en lugar de limitarse a producir imágenes o vídeos independientes.

Fei-Fei Li, investigadora en inteligencia artificial, participa en la fundación de World Labs, creada en 2024 para centrarse en permitir que los sistemas de inteligencia artificial comprendan el mundo físico y las relaciones tridimensionales. La empresa afirma que Atlas fue preentrenado desde cero y que técnicamente se basa en una arquitectura que combina un modelo de difusión autorregresivo y multimodal con un transformador (Transformer).

¿Qué ofrece Atlas?

El modelo puede integrar distintos tipos de entradas en un contexto espacial común, lo que le permite estimar las partes no visibles de una escena basándose en la estructura tridimensional de los objetos y los entornos. Entre sus características principales está el uso de la posición de la cámara y de su trayectoria de movimiento como entradas directas, en lugar de limitarse a describir el movimiento de la cámara mediante instrucciones de texto.

A partir de entre una y seis imágenes de referencia y trayectorias de cámara predefinidas, Atlas puede crear vídeo con una resolución de 1440p y una duración de hasta un minuto. También puede estimar la forma de un objeto o entorno desde distintos ángulos a partir de una sola imagen y ampliar la escena para incluir partes que no aparecen en la imagen original. La herramienta permite asimismo colocar imágenes no relacionadas en sus posiciones dentro de un espacio tridimensional y crear transiciones entre ellas dentro de un único entorno.

Reconstrucción del mundo real

World Labs afirma que Atlas puede utilizarse para reconstruir espacios reales en formato tridimensional. Dos o tres imágenes pueden bastar para recrear muchas escenas, mientras que proporcionar decenas de imágenes o más de cien imágenes reduce la necesidad de estimar las zonas no visibles y aumenta la similitud del resultado con el entorno original.

Las salidas no se limitan a imágenes y vídeo; el modelo también puede producir nubes de puntos tridimensionales y archivos en formato «3D Gaussian splat», resultados que pueden emplearse en videojuegos, diseño, efectos visuales y robótica.

Simulación robótica y limitaciones actuales

También pueden utilizarse grabaciones realizadas con un teléfono de un entorno real para crear una simulación tridimensional y, posteriormente, generar los datos que podrían captar las cámaras y los sensores de profundidad de un robot virtual durante su movimiento. La simulación permite cambiar la posición de los objetos, la iluminación, el fondo y el movimiento del robot para crear múltiples escenarios de entrenamiento y prueba.

¿Por qué importa este anuncio? Atlas conecta la generación de contenido con la comprensión del espacio y la simulación, lo que lo acerca más a una herramienta para construir entornos explorables y utilizables en sistemas robóticos que a un simple modelo de generación de vídeo. World Labs afirma que el modelo constituirá la base de la plataforma Marble para crear mundos tridimensionales y de otros productos de la empresa.

Sin embargo, Atlas todavía se encuentra en una fase de acceso temprano para socios seleccionados. La empresa no ha revelado el precio, la fecha de disponibilidad general, el tamaño del modelo ni la capacidad computacional utilizada para entrenarlo. Asimismo, la afirmación de que supera a algunos modelos especializados de código abierto en la reconstrucción tridimensional a partir de imágenes dispersas se basa en pruebas de la empresa y aún no ha sido verificada por investigadores independientes.

World Labs había recaudado en febrero de 2026 una financiación de 1.000 millones de dólares con la participación de AMD, Autodesk, Nvidia, Fidelity y otros inversores, lo que elevó su financiación total a aproximadamente 1.230 millones de dólares.

Fuente de la noticia
c
Autor

certi.news

De la misma categoría

También te puede interesar

Ver todas las noticias