Gemini ya puede usar apps por ti en Android — y funciona de verdad
La nueva función de automatización de tareas de Gemini en Pixel 10 Pro y Galaxy S26 Ultra permite al modelo operar aplicaciones en nombre del usuario. En fase beta es lenta y torpe, pero es la demostración más convincente de un asistente de IA real que hemos visto en un teléfono.
Gemini ahora puede pedirte un Uber. Puede navegar por Uber Eats, armar tu carrito y entregártelo justo antes de confirmar el pedido. Está en beta, limitada a un puñado de apps de comida a domicilio y transporte, y dista mucho de ser eficiente. Pero tras cinco días de pruebas en el Pixel 10 Pro y el Galaxy S26 Ultra, Allison Johnson de The Verge la llama “un anticipo del futuro”, y es difícil llevarle la contraria.
El mecanismo central: le das a Gemini una tarea en lenguaje natural, la ejecuta en segundo plano mientras haces otras cosas y te muestra una pantalla de confirmación cuando está lista para que des el visto bueno. El modo de fondo es la opción predeterminada por una razón. Ver a Gemini desplazarse por un menú buscando una guarnición de verduras —cuando está justo ahí, en la parte superior de la pantalla— es desesperante. Un pedido de teriyaki que tarda nueve minutos no es el futuro de la telefonía móvil. Pero sí es lo más avanzado que existe hoy.
Dónde impresiona de verdad
La prueba de planificación de vuelo fue reveladora. Un evento en el calendario para volar a San Francisco al día siguiente. Un prompt vago: “Resérvame un Uber para llegar al aeropuerto a tiempo para mi vuelo de mañana.” Gemini revisó el calendario, encontró la hora de salida, propuso las 11:30 o 11:45 para un vuelo a la 1:45PM, esperó confirmación y luego reservó el viaje: unos tres minutos, sin más interacción. Eso no es una demo. Es algo útil que un ordenador hizo por ti.
La diferencia cualitativa respecto a la década de asistentes anteriores: Gemini no te exige conocer la jerga de Uber. No tienes que decir “reservar un viaje” en lugar de “programar un trayecto”. El lenguaje natural que realmente funciona con expresiones ambiguas es un salto cuantitativo.
El cuello de botella no es Gemini
Observar a una IA navegar por una app diseñada para humanos deja algo claro: esas apps no fueron construidas para esto. Los anuncios, las fotos y los menús saturados son fricción para un modelo que solo necesita una base de datos estructurada. Sameer Samat, responsable de Android en Google, confirmó que Gemini usa el enfoque de “razonamiento sobre la interfaz” únicamente a falta de alternativas mejores: el Model Context Protocol (MCP) o la API de funciones de app de Android. La automatización de tareas es, explícitamente, una solución provisional.
La conclusión: los desarrolladores que adopten MCP o las funciones de app de Android ofrecerán a Gemini un camino mucho más rápido y fiable para completar tareas. Esta beta es en parte un producto, en parte un aviso al ecosistema.
Qué significa ahora mismo
Esto no es Siri poniendo un temporizador. Ni Google Assistant reproduciendo una canción. Es una IA que lee tu calendario, infiere tu intención, navega por una app de terceros y completa una tarea de varios pasos mientras tú haces otra cosa. Los fallos son reales: se atasca, no siempre explica por qué y necesita rescate ocasional. Pero la precisión en los pedidos finales ha sido lo suficientemente alta como para que apenas haya necesitado correcciones antes de confirmar.
La automatización de tareas de Gemini es torpe, lenta y limitada a un conjunto reducido de apps. También es la versión más funcional de la promesa del asistente de IA que ha llegado a un teléfono real.
Lecturas relacionadas
- Grandes Tecnológicas Android 17 llega con Gemini Omni, Lyria 3 y una nueva capa de multitarea
- Modelos de IA Google lanza Gemini 3.1 Flash Live: voz en tiempo real para agentes de IA en más de 90 idiomas
- Herramientas de IA Google reconstruye su buscador sobre Gemini 3.5 Flash: AI Mode ya es el modo por defecto para todos