Google DeepMind lanza tres modelos de IA física para robots colaborativos
Por Redacción Automatización LatAm · 30 de julio de 2026 · Fuente original: MarkTechPost
Foto: Nicodemus♐ · Openverse · Dominio público
Google DeepMind presenta Gemini Robotics 2, una suite de tres modelos de IA entrenados para control corporal completo, razonamiento encarnado y adaptación rápida a nuevas plataformas robóticas. Solo uno está disponible públicamente.
El anuncio de Google DeepMind: tres modelos para la próxima generación robótica
Google DeepMind ha liberado Gemini Robotics 2, presentada como la capa de inteligencia central para robots de nueva generación. La suite consta de tres componentes complementarios: un modelo visión-lenguaje-acción (VLA) capaz de controlar humanoides completos, Gemini Robotics ER 2 dedicado a razonamiento encarnado y orquestación de tareas, y un VLA compacto que se ejecuta directamente en el dispositivo del robot. La estrategia de lanzamiento es gradual: solo ER 2 está disponible públicamente hoy, mientras que los otros dos modelos permanecen bajo custodia de Google, con demostración de funcionamiento en brazos Apptronik Apollo 2 y Franka Duo.
Arquitectura técnica: visión-lenguaje-acción descentralizada
Los VLAs representan una evolución respecto a sistemas anteriores de control robótico. Estos modelos entrenan con millones de trayectorias de demostración humana o simulada, aprendiendo a mapear observaciones visuales directas (cámaras del robot) y comandos en lenguaje natural hacia secuencias de acciones motoras. La novedad técnica aquí es que Gemini Robotics 2 separa la inferencia pesada (razonamiento en la nube) de la ejecución ligera (en el robot). El componente on-device ejecuta microacciones con latencia baja, crítico para tareas de manipulación fina donde el tiempo de respuesta a perturbaciones determinan el éxito o fracaso. Esto contrasta con generaciones previas donde todo el razonamiento ocurría en servidores centrales, introduciendo retardos de cientos de milisegundos inaceptables en pick-and-place o ensamblaje.
Gemini Robotics ER 2 funciona como orquestador: recibe instrucciones de alto nivel (“ensambla esta válvula”), descompone la tarea en subtareas coordinadas entre múltiples robots, y monitorea el progreso mediante retroalimentación visual en tiempo real. Esta separación entre razonamiento estratégico (en la nube) y control táctico (en dispositivo) permite que un Franka Duo y un Apptronik Apollo 2 —arquitecturas completamente diferentes en términos de grados de libertad, velocidad y capacidad de carga— colaboren sin que ingenieros reescriban controladores personalizados.
Adaptación rápida: la promesa de horas a minutos
Un diferenciador clave es que el VLA on-device se adapta a nuevas morfologías robóticas en horas, no semanas. Tradicionalmente, integrar un nuevo brazo en una célula requiere reentrenamiento del modelo de control con datos específicos de ese hardware, calibración de parámetros dinámicos (fricción articular, elasticidad), y validación exhaustiva. Google afirma que Gemini Robotics 2 logra esto mediante few-shot adaptation: captura brevemente demostraciones con el nuevo robot (típicamente 30-100 ejemplos), extrae invariantes perceptuales del modelo preentrenado, y ajusta solo las capas de salida. Esto es posible porque el modelo base ha sido entrenado con suficiente diversidad de plataformas que generaliza características compartidas entre robots.
Lectura para la industria latinoamericana
En México, Brasil y Colombia, la adopción de robótica colaborativa crece en sectores como automotriz (Stellantis en Toluca, Volkswagen en Puebla), alimentos (Bimbo, Kraft Heinz), y minería (cobre en Chile). Sin embargo, la brecha actual es profunda: integrar un nuevo brazo en una planta típicamente requiere meses y especialistas externos costosos. La mayoría de integradores regionales —como proveedores en Monterrey o São Paulo— trabajan sobre plataformas Yaskawa, ABB o KUKA con licencias de software propietarias; escasos tienen experiencia con modelos de aprendizaje dinámico.
Gemini Robotics 2 es especialmente relevante para plantas medianas de LatAm que operan líneas mixtas: una sección ensambla componentes con Franka Emika (popular en Latinoamérica por bajo costo de entrada), otra realiza tareas de manipulación pesada con ABB IRB6700, y se requiere coordinación. Hoy esto obliga a programar orquestación manual con PLC y sistemas de visión desacoplados. El modelo ER 2 podría consolidar esta lógica en un único agente de razonamiento.
Dos limitaciones prácticas a vigilar: (1) Los modelos de Google Robotics aún requieren conectividad a servidores Google Cloud para la capa de razonamiento pesado. Plantas en zonas con internet inestable (común en regiones mineras de Perú o zonas rurales de Brasil) sufrirán latencia o desconexiones. (2) Solo ER 2 es accesible públicamente; los VLAs de control corporal y whole-body humanoid siguen cerrados, lo que limita el análisis independiente sobre cómo la compañía maneja datos de entrenamiento y privacidad operacional.
Para ingenieros en plantas existentes: esta noticia significa que los proyectos de «modernización multi-robot» que hoy son financieramente inviables (por integración costosa) podrían replantearse en 18-24 meses cuando estos modelos maduren y compitan con soluciones de Siemens (MindSphere), ABB (Collaborative Robots Cloud), o integradores locales. Se recomienda comenzar pilotos pequeños con Franka o plataformas abiertas para validar flujos antes de comprometer presupuesto grande.
Qué vigilar en los próximos 12 meses
Dos desarrollos críticos merecen atención: primero, cuándo Google abre acceso a los VLAs de humanoides y adaptación on-device. Las restricciones actuales sugieren que aún hay preocupaciones sobre robustez o seguridad en escenarios productivos reales; esperar disclosure técnico detallado o publicación en conferencias como RSS (Robotics: Science and Systems) o ICRA. Segundo, cómo responden competidores. Boston Dynamics (propiedad de Hyundai) opera en un modelo de soluciones verticales y cerradas; OpenAI/Figure AI están explorando modelos VLA abiertos; Meta lanzó recibirá atención sobre arquitecturas de difusión para control robótico. La próxima generación de sistemas de control industrial podría fragmentarse entre soluciones cloud-centric (Google, Azure Robotics) y edge-first (Nvidia Isaac, iniciativas de código abierto).
Este resumen es un análisis original. Para leer la noticia completa visita la fuente original: MarkTechPost →
Sigue leyendo
Robots humanoides en manufactura: desempeño real en 2026
Robots humanoides como el G2 de AGIBOT y Digit de Agility Robotics demuestran viabilidad operativa en plantas de electrónica y componentes industriales, acumulando decenas de miles de horas con tasas de éxito superiores al 99%, respaldadas por pedidos multimillonarios.
Fuente: IIoT World
Entrenamiento robótico integrado: flujo completo desde captura a despliegue
Strands Agents, LeRobot y Hugging Face Storage Buckets conforman un pipeline unificado para capturar datos de robots, entrenarlos y desplegarlos sin cambiar de plataforma. Reduce fragmentación de herramientas en equipos de robótica.
Fuente: Hugging Face Blog
Conector híbrido integra potencia y Ethernet para robots
Molex lanza conectores híbridos que unifican alimentación de 15A y comunicación Ethernet 1Gbps en un perfil compacto de 5.65mm, reduciendo complejidad de cableado en robots humanoides y sistemas de automatización.
Fuente: Design World Online
HII acuerda producción basada en desempeño con Path y GrayMatter Robotics
Huntington Ingalls Industries firma contratos plurianuales por hasta $900 millones con fabricantes de robótica para transformar la manufactura de estructuras navales mediante automatización de fabricación, ensamblaje y equipamiento.
Fuente: Manufacturing Tomorrow
Cadena energética igus permite 600° de rotación sin enredos
igus lanzó una cadena energética autoportante capaz de gestionar cables en robots industriales compactos con ángulos de rotación superiores a 600°. El módulo rotatorio se adapta automáticamente al movimiento del robot, eliminando contacto con placas conectoras y facilitando giros continuos de 360°.
Fuente: Design World Online
Daniela Rus reconocida por innovación en robótica y sistemas autónomos
La directora del laboratorio CSAIL del MIT recibe distinción bávara por sus aportes en robótica, inteligencia artificial y sistemas autónomos de impacto industrial.
Fuente: MIT News — AI