{"id":131262,"date":"2026-09-02T17:51:10","date_gmt":"2026-09-02T15:51:10","guid":{"rendered":"https:\/\/quondos.com\/mag\/?p=131262"},"modified":"2026-09-02T17:51:12","modified_gmt":"2026-09-02T15:51:12","slug":"atlas-el-modelo-de-ia-que-quiere-ensenar-a-los-robots-a-entender-el-mundo-fisico-en-3d","status":"publish","type":"post","link":"https:\/\/quondos.com\/mag\/atlas-el-modelo-de-ia-que-quiere-ensenar-a-los-robots-a-entender-el-mundo-fisico-en-3d\/","title":{"rendered":"Atlas, el modelo de IA que quiere ense\u00f1ar a los robots a entender el mundo f\u00edsico en 3D"},"content":{"rendered":"\n<figure class=\"wp-block-image size-large\"><img loading=\"lazy\" decoding=\"async\" width=\"1024\" height=\"576\" src=\"https:\/\/quondos.com\/mag\/wp-content\/uploads\/2026\/09\/image-6-1024x576.png\" alt=\"\" class=\"wp-image-131265\" title=\"\" srcset=\"https:\/\/quondos.com\/mag\/wp-content\/uploads\/2026\/09\/image-6-1024x576.png 1024w, https:\/\/quondos.com\/mag\/wp-content\/uploads\/2026\/09\/image-6-300x169.png 300w, https:\/\/quondos.com\/mag\/wp-content\/uploads\/2026\/09\/image-6-768x432.png 768w, https:\/\/quondos.com\/mag\/wp-content\/uploads\/2026\/09\/image-6.png 1456w\" sizes=\"auto, (max-width: 1024px) 100vw, 1024px\" \/><\/figure>\n\n\n\n<p>La inteligencia artificial empieza a mirar m\u00e1s all\u00e1 de las palabras y las im\u00e1genes. <strong>World Labs ha presentado Atlas, un modelo dise\u00f1ado para entender y generar espacios en 3D<\/strong> a partir de informaci\u00f3n como fotograf\u00edas, v\u00eddeo, mapas de profundidad y posiciones de c\u00e1mara. Seg\u00fan la compa\u00f1\u00eda, el objetivo es avanzar hacia una IA capaz de comprender c\u00f3mo funciona el mundo f\u00edsico y utilizar ese conocimiento en \u00e1mbitos como la rob\u00f3tica, la simulaci\u00f3n o la creaci\u00f3n audiovisual.<\/p> <div id=\"ez-toc-container\" class=\"ez-toc-v2_0_76 counter-hierarchy ez-toc-counter ez-toc-grey ez-toc-container-direction\">\n<div class=\"ez-toc-title-container\">\n<p class=\"ez-toc-title\" style=\"cursor:inherit\">\u00cdndice de contenidos<\/p>\n<span class=\"ez-toc-title-toggle\"><a href=\"#\" class=\"ez-toc-pull-right ez-toc-btn ez-toc-btn-xs ez-toc-btn-default ez-toc-toggle\" aria-label=\"Alternar tabla de contenidos\"><span class=\"ez-toc-js-icon-con\"><span class=\"\"><span class=\"eztoc-hide\" style=\"display:none;\">Toggle<\/span><span class=\"ez-toc-icon-toggle-span\"><svg style=\"fill: #999;color:#999\" xmlns=\"http:\/\/www.w3.org\/2000\/svg\" class=\"list-377408\" width=\"20px\" height=\"20px\" viewBox=\"0 0 24 24\" fill=\"none\"><path d=\"M6 6H4v2h2V6zm14 0H8v2h12V6zM4 11h2v2H4v-2zm16 0H8v2h12v-2zM4 16h2v2H4v-2zm16 0H8v2h12v-2z\" fill=\"currentColor\"><\/path><\/svg><svg style=\"fill: #999;color:#999\" class=\"arrow-unsorted-368013\" xmlns=\"http:\/\/www.w3.org\/2000\/svg\" width=\"10px\" height=\"10px\" viewBox=\"0 0 24 24\" version=\"1.2\" baseProfile=\"tiny\"><path d=\"M18.2 9.3l-6.2-6.3-6.2 6.3c-.2.2-.3.4-.3.7s.1.5.3.7c.2.2.4.3.7.3h11c.3 0 .5-.1.7-.3.2-.2.3-.5.3-.7s-.1-.5-.3-.7zM5.8 14.7l6.2 6.3 6.2-6.3c.2-.2.3-.5.3-.7s-.1-.5-.3-.7c-.2-.2-.4-.3-.7-.3h-11c-.3 0-.5.1-.7.3-.2.2-.3.5-.3.7s.1.5.3.7z\"\/><\/svg><\/span><\/span><\/span><\/a><\/span><\/div>\n<nav><ul class='ez-toc-list ez-toc-list-level-1 ' ><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-1\" href=\"https:\/\/quondos.com\/mag\/atlas-el-modelo-de-ia-que-quiere-ensenar-a-los-robots-a-entender-el-mundo-fisico-en-3d\/#Atlas_quiere_que_la_inteligencia_artificial_entienda_el_espacio\" >Atlas quiere que la inteligencia artificial entienda el espacio<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-2\" href=\"https:\/\/quondos.com\/mag\/atlas-el-modelo-de-ia-que-quiere-ensenar-a-los-robots-a-entender-el-mundo-fisico-en-3d\/#De_unas_pocas_imagenes_a_un_escenario_que_se_puede_explorar\" >De unas pocas im\u00e1genes a un escenario que se puede explorar<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-3\" href=\"https:\/\/quondos.com\/mag\/atlas-el-modelo-de-ia-que-quiere-ensenar-a-los-robots-a-entender-el-mundo-fisico-en-3d\/#El_salto_de_los_modelos_del_mundo_a_la_robotica\" >El salto de los modelos del mundo a la rob\u00f3tica<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-4\" href=\"https:\/\/quondos.com\/mag\/atlas-el-modelo-de-ia-que-quiere-ensenar-a-los-robots-a-entender-el-mundo-fisico-en-3d\/#Una_especie_de_internet_para_entrenar_robots\" >Una especie de internet para entrenar robots<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-5\" href=\"https:\/\/quondos.com\/mag\/atlas-el-modelo-de-ia-que-quiere-ensenar-a-los-robots-a-entender-el-mundo-fisico-en-3d\/#La_idea_no_es_solo_generar_imagenes_bonitas\" >La idea no es solo generar im\u00e1genes bonitas<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-6\" href=\"https:\/\/quondos.com\/mag\/atlas-el-modelo-de-ia-que-quiere-ensenar-a-los-robots-a-entender-el-mundo-fisico-en-3d\/#Atlas_todavia_esta_en_una_fase_temprana\" >Atlas todav\u00eda est\u00e1 en una fase temprana<\/a><\/li><\/ul><\/nav><\/div>\n<h2><span class=\"ez-toc-section\" id=\"Atlas_quiere_que_la_inteligencia_artificial_entienda_el_espacio\"><\/span>Atlas quiere que la inteligencia artificial entienda el espacio<span class=\"ez-toc-section-end\"><\/span><\/h2> <p>Hasta ahora, buena parte del desarrollo de la IA generativa se ha centrado en trabajar con lenguaje, im\u00e1genes, audio o v\u00eddeo. Atlas plantea un enfoque diferente: <strong>no intenta limitarse a generar contenido visual<\/strong>, sino construir una representaci\u00f3n espacial que le permita predecir qu\u00e9 deber\u00eda aparecer desde diferentes puntos de vista.<\/p> <p>World Labs, la empresa fundada entre otros por <strong>Fei-Fei Li, una de las figuras m\u00e1s conocidas del campo de la inteligencia artificial<\/strong>, presenta Atlas como un modelo multimodal entrenado desde cero. El sistema puede combinar texto, im\u00e1genes, v\u00eddeo, mapas de profundidad y datos relacionados con la posici\u00f3n de las c\u00e1maras.<\/p> <p>La diferencia puede parecer peque\u00f1a, pero tiene bastante importancia. Un generador de v\u00eddeo tradicional puede crear una secuencia visual a partir de una descripci\u00f3n, mientras que Atlas busca mantener <strong>una coherencia espacial entre diferentes observaciones del mismo entorno<\/strong>. Es decir, que una habitaci\u00f3n siga siendo la misma aunque la c\u00e1mara cambie de posici\u00f3n.<\/p> <h2><span class=\"ez-toc-section\" id=\"De_unas_pocas_imagenes_a_un_escenario_que_se_puede_explorar\"><\/span>De unas pocas im\u00e1genes a un escenario que se puede explorar<span class=\"ez-toc-section-end\"><\/span><\/h2> <p>Una de las demostraciones descritas muestra c\u00f3mo Atlas puede recibir im\u00e1genes captadas desde diferentes posiciones y utilizar esa informaci\u00f3n para generar perspectivas que <strong>no fueron grabadas originalmente por ninguna c\u00e1mara<\/strong>. El modelo reconstruye una representaci\u00f3n plausible del espacio y permite observarlo desde nuevos \u00e1ngulos.<\/p> <p>Seg\u00fan los datos facilitados por World Labs, el sistema puede trabajar incluso con grabaciones realizadas utilizando solo dos o tres smartphones. A partir de esas im\u00e1genes, <strong>Atlas genera nuevas perspectivas manteniendo una relaci\u00f3n coherente con los elementos que s\u00ed estaban presentes en los datos originales<\/strong>.<\/p> <p>Esto tambi\u00e9n permite plantear instrucciones relacionadas con el movimiento de una c\u00e1mara. Un creador podr\u00eda especificar una trayectoria y el modelo generar\u00eda una visualizaci\u00f3n de lo que se ver\u00eda siguiendo ese recorrido, incluso cuando <strong>esa perspectiva concreta nunca hubiera sido registrada f\u00edsicamente<\/strong>.<\/p> <p>Hay, eso s\u00ed, una limitaci\u00f3n importante. Atlas no puede saber con certeza qu\u00e9 existe detr\u00e1s de un objeto que ninguna c\u00e1mara ha captado. En esos casos, el sistema tiene que generar una soluci\u00f3n plausible. La propia explicaci\u00f3n de World Labs resume el principio de forma sencilla: <strong>cuantas m\u00e1s im\u00e1genes recibe el modelo, menos contenido tiene que imaginar<\/strong>.<\/p> <h2><span class=\"ez-toc-section\" id=\"El_salto_de_los_modelos_del_mundo_a_la_robotica\"><\/span>El salto de los modelos del mundo a la rob\u00f3tica<span class=\"ez-toc-section-end\"><\/span><\/h2> <p>La aplicaci\u00f3n que puede resultar m\u00e1s interesante est\u00e1 lejos del cine. World Labs plantea que esta tecnolog\u00eda podr\u00eda utilizarse para crear <strong>entornos virtuales basados en lugares reales<\/strong> en los que los robots puedan entrenarse antes de enfrentarse a esos espacios en el mundo f\u00edsico.<\/p> <p>La compa\u00f1\u00eda denomina a este proceso <strong>real-to-sim<\/strong>: primero se captura un espacio real y despu\u00e9s se transforma en una simulaci\u00f3n. El resultado puede servir para que un robot virtual recorra el entorno y genere datos sobre lo que ver\u00edan sus sensores desde diferentes posiciones.<\/p> <p>El problema que intenta resolver no es menor. Ense\u00f1ar a un robot a realizar una tarea sencilla, como recoger una taza de una mesa, requiere normalmente <strong>un robot f\u00edsico, c\u00e1maras, sensores, objetos y muchas repeticiones<\/strong>. Cada intento consume tiempo y recursos, y adem\u00e1s el entorno real nunca permanece completamente estable.<\/p> <p>La iluminaci\u00f3n puede cambiar, los objetos pueden moverse y un error puede terminar da\u00f1ando tanto al robot como al propio entorno. Seg\u00fan World Labs, las simulaciones permitir\u00edan <strong>repetir pruebas y cometer errores sin asumir el coste de hacerlo f\u00edsicamente<\/strong>, algo especialmente \u00fatil para entrenar sistemas rob\u00f3ticos.<\/p> <h2><span class=\"ez-toc-section\" id=\"Una_especie_de_internet_para_entrenar_robots\"><\/span>Una especie de internet para entrenar robots<span class=\"ez-toc-section-end\"><\/span><\/h2> <p>La visi\u00f3n de World Labs va incluso un paso m\u00e1s all\u00e1. La empresa plantea que los futuros modelos del mundo podr\u00edan dar lugar a una especie de <strong>\u201cinternet de los robots\u201d<\/strong>, aunque Atlas todav\u00eda no sea un producto que ofrezca por s\u00ed solo esa infraestructura completa.<\/p> <p>En lugar de p\u00e1ginas web y documentos, esa hipot\u00e9tica plataforma estar\u00eda formada por grandes cantidades de <strong>espacios tridimensionales con los que los sistemas de IA podr\u00edan experimentar<\/strong>. La idea ser\u00eda disponer de entornos virtuales suficientemente ricos como para que los robots pudieran aprender, probar comportamientos y evaluar distintas situaciones.<\/p> <p>Los videojuegos podr\u00edan tener un papel relevante en esta estrategia. Un escenario tridimensional ya contiene informaci\u00f3n sobre <strong>geometr\u00eda, objetos, texturas, c\u00e1maras, f\u00edsicas y diferentes posiciones desde las que observar el mundo<\/strong>. Ese conjunto de datos podr\u00eda resultar \u00fatil para desarrollar modelos capaces de comprender espacios.<\/p> <p>Adem\u00e1s de los videojuegos, este tipo de informaci\u00f3n puede encontrarse en simuladores, herramientas de arquitectura y otros entornos digitales. Seg\u00fan el planteamiento de World Labs, <strong>los mundos virtuales ya construidos pueden convertirse en una fuente de datos para entrenar modelos espaciales<\/strong>, de una manera comparable a c\u00f3mo los grandes modelos de lenguaje aprovechan enormes cantidades de texto.<\/p> <h2><span class=\"ez-toc-section\" id=\"La_idea_no_es_solo_generar_imagenes_bonitas\"><\/span>La idea no es solo generar im\u00e1genes bonitas<span class=\"ez-toc-section-end\"><\/span><\/h2> <p>Atlas se distancia as\u00ed de la evoluci\u00f3n habitual de los generadores de im\u00e1genes y v\u00eddeo. La cuesti\u00f3n que intenta resolver es menos visual y m\u00e1s relacionada con la comprensi\u00f3n: <strong>qu\u00e9 ocurre cuando una inteligencia artificial se mueve dentro de un espacio<\/strong> y tiene que anticipar lo que encontrar\u00e1 desde otra posici\u00f3n.<\/p> <p>Fei-Fei Li ha resumido esta diferencia se\u00f1alando que fuera del lenguaje no encontramos palabras que nos expliquen lo que ocurre. Seg\u00fan la idea recogida en la presentaci\u00f3n, <strong>el mundo f\u00edsico no est\u00e1 organizado como una frase<\/strong>: los objetos tienen posiciones, relaciones, dimensiones y comportamientos que deben entenderse espacialmente.<\/p> <p>En ese sentido, los llamados modelos del mundo buscan complementar a los modelos de lenguaje. Mientras un LLM puede aprender patrones sobre qu\u00e9 palabra deber\u00eda aparecer despu\u00e9s, <strong>un modelo espacial intenta predecir qu\u00e9 deber\u00eda verse despu\u00e9s cuando cambia la posici\u00f3n dentro de un entorno<\/strong>.<\/p> <h2><span class=\"ez-toc-section\" id=\"Atlas_todavia_esta_en_una_fase_temprana\"><\/span>Atlas todav\u00eda est\u00e1 en una fase temprana<span class=\"ez-toc-section-end\"><\/span><\/h2> <p>Pese a las posibilidades que plantea, conviene poner el lanzamiento en contexto. <strong>Atlas todav\u00eda no est\u00e1 disponible como producto abierto para cualquier usuario<\/strong>. Seg\u00fan la informaci\u00f3n publicada por World Labs, el acceso se encuentra actualmente limitado a una fase anticipada con determinados socios seleccionados.<\/p> <p>Eso significa que todav\u00eda queda camino antes de saber hasta d\u00f3nde puede llegar esta tecnolog\u00eda en aplicaciones reales. La propuesta resulta especialmente relevante para la rob\u00f3tica porque permite imaginar un entrenamiento mucho m\u00e1s basado en simulaciones, pero <strong>la utilidad pr\u00e1ctica depender\u00e1 de la precisi\u00f3n con la que los modelos representen los entornos y sus comportamientos<\/strong>.<\/p> <p>Por ahora, Atlas representa una apuesta por una nueva generaci\u00f3n de inteligencia artificial que no se limite a producir texto, im\u00e1genes o v\u00eddeo. Seg\u00fan World Labs, el objetivo a largo plazo es desarrollar modelos capaces de <strong>percibir, generar, razonar e interactuar con mundos virtuales y f\u00edsicos<\/strong>, acercando la IA a un tipo de comprensi\u00f3n espacial que resulta fundamental para que los robots puedan desenvolverse fuera de los laboratorios.<\/p>\n\n\n\n<p>Fuente: https:\/\/www.worldlabs.ai\/blog\/atlas<\/p>\n","protected":false},"excerpt":{"rendered":"<p>La inteligencia artificial empieza a mirar m\u00e1s all\u00e1 de las palabras y las im\u00e1genes. World Labs ha presentado Atlas, un &#8230; <\/p>\n<p class=\"read-more-container\"><a title=\"Atlas, el modelo de IA que quiere ense\u00f1ar a los robots a entender el mundo f\u00edsico en 3D\" class=\"read-more button\" href=\"https:\/\/quondos.com\/mag\/atlas-el-modelo-de-ia-que-quiere-ensenar-a-los-robots-a-entender-el-mundo-fisico-en-3d\/#more-131262\" aria-label=\"Leer m\u00e1s sobre Atlas, el modelo de IA que quiere ense\u00f1ar a los robots a entender el mundo f\u00edsico en 3D\">Leer m\u00e1s<\/a><\/p>\n","protected":false},"author":850,"featured_media":131265,"comment_status":"open","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[1474],"tags":[],"class_list":["post-131262","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-inteligencia-artificial","generate-columns","tablet-grid-50","mobile-grid-100","grid-parent","grid-50","no-featured-image-padding"],"_links":{"self":[{"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/posts\/131262","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/users\/850"}],"replies":[{"embeddable":true,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/comments?post=131262"}],"version-history":[{"count":1,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/posts\/131262\/revisions"}],"predecessor-version":[{"id":131266,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/posts\/131262\/revisions\/131266"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/media\/131265"}],"wp:attachment":[{"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/media?parent=131262"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/categories?post=131262"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/tags?post=131262"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}