La palabra «ejecutar» abarca funciones distintas
Decir que un asistente de IA «ejecuta tareas» puede referirse a cosas muy diferentes: preparar una respuesta, repetir una instrucción a una hora fijada o interactuar con una página web. Sin especificar qué acción realiza el sistema, en qué entorno y con qué intervención humana, la frase dice poco sobre su autonomía real. También puede convertir una descripción comercial amplia en una expectativa que el producto no cumple. Responder, programar y actuar en una web no son capacidades intercambiables: cada una implica un alcance y un tipo de resultado distintos.
La documentación disponible permite hablar de dos funciones concretas, pero no de una novedad común a varios asistentes. La ayuda de Chrome describe una opción para pedir a Gemini que complete tareas mediante navegación automática; el centro de ayuda de OpenAI documenta la creación y administración de tareas programadas en ChatGPT. Son ejemplos de capacidades diferentes, no pruebas de que ambos puedan operar de forma autónoma sobre aplicaciones o cuentas. La unidad de análisis útil es cada acción documentada, no la etiqueta «agente» o «asistente».
Navegar por la web no equivale a controlar cualquier servicio
La página de ayuda de Google se refiere específicamente a pedir a Gemini en Chrome que complete tareas mediante navegación automática en un ordenador. Esto respalda una afirmación delimitada: existe documentación oficial sobre una función de navegación asistida para completar tareas en ese contexto. No permite concluir, por sí sola, que la función esté disponible para todas las personas, en todos los países o en cualquier dispositivo, ni que pueda actuar en cualquier sitio web o servicio conectado.
Tampoco se debe rellenar lo que la documentación examinada no confirma. La fuente aportada no ofrece aquí un inventario verificable de acciones admitidas, requisitos de cuenta, permisos necesarios, puntos en los que se solicita aprobación ni excepciones operativas. Sin esos detalles no es riguroso afirmar que Gemini puede realizar compras, enviar mensajes, modificar datos o completar operaciones sensibles. Para evaluar una función concreta hay que comprobar su ayuda vigente y sus condiciones de uso, no extrapolar desde el nombre «navegación automática». La capacidad descrita depende del contexto documentado; no demuestra control general del ordenador.
Esta distinción también ayuda a formular preguntas precisas. No basta con preguntar si el sistema «puede navegar»: hay que averiguar qué tarea contempla la documentación, en qué entorno se realiza y qué aspectos siguen sin especificarse. Si esos límites no están claros, lo responsable es mantenerlos como incógnitas en lugar de inferir capacidades a partir de una descripción general.
Programar una tarea es distinto de delegar una operación
La documentación de OpenAI incluida en la investigación trata de crear, administrar y eliminar tareas programadas de ChatGPT, así como de compartir algunas de ellas mediante enlaces. Eso acredita una función de programación y gestión dentro del servicio. No demuestra que una tarea programada pueda operar por cuenta del usuario en aplicaciones externas, ni que la IA pueda tomar decisiones indefinidamente sin nuevas instrucciones.
La diferencia importa en el uso cotidiano. Una tarea que se ejecuta en un horario puede consistir en una petición recurrente al asistente; una acción en una web puede implicar navegar por páginas y producir efectos fuera de la conversación. El registro de una programación no prueba que se haya completado un trámite, actualizado un archivo o enviado una comunicación. Antes de delegar, conviene distinguir entre generar una respuesta en un momento previsto y provocar un cambio en otro servicio, y buscar documentación específica para ese segundo paso.
Por tanto, la programación describe cuándo se solicita o administra una tarea, pero no basta para determinar qué efectos tiene fuera del servicio. Para entender el alcance real hay que separar la existencia de una tarea programada de la confirmación de que se produjo una acción externa. Esa comprobación evita confundir la configuración de una instrucción con la realización de un trámite.
Qué comprobar antes de confiar una tarea
Una ficha de evaluación práctica debería responder, como mínimo, a estas preguntas: qué acción exacta ejecuta el asistente, dónde la ejecuta, qué datos necesita, qué permisos recibe y cómo se detiene o revisa el resultado. También es importante saber si hay una confirmación antes de una acción con consecuencias y qué ocurre cuando la página cambia, la petición es ambigua o la operación falla. Si la documentación no responde, ese punto debe quedar como desconocido, no convertirse en una capacidad supuesta.
Para una evaluación prudente, el usuario puede seguir este orden:
- Definir el resultado: separar una recomendación o borrador de una acción que modifica una cuenta o envía información.
- Comprobar el alcance: verificar en la ayuda del proveedor el navegador, dispositivo, región y tipo de tarea cubiertos.
- Revisar permisos y controles: identificar qué acceso se concede, qué aprobación puede requerirse y cómo interrumpir el proceso.
- Validar el resultado: confirmar en el servicio de destino que la acción se completó correctamente, en vez de asumirlo por la respuesta del asistente.
- Limitar los datos: no proporcionar información sensible si no se entiende cómo se utilizará o qué controles la protegen.
Lo documentado no confirma un cambio reciente
El material disponible no permite establecer cuál sería el anuncio reciente que motivaría una noticia sobre una nueva capacidad, cuándo se habría producido ni a qué usuarios habría llegado. La guía de Chrome acredita que Google documenta navegación automática en Gemini para Chrome; la página de OpenAI acredita que ChatGPT permite gestionar tareas programadas y compartir determinadas tareas. Ninguna de esas referencias, por sí sola, confirma una fecha de lanzamiento reciente o una ampliación nueva de funciones.
Por eso, la conclusión debe ser acotada: hay funciones con documentación oficial que pueden describirse de manera concreta, pero «ejecutar tareas» no es una promesa uniforme ni una medida suficiente de autonomía. La información disponible tampoco aporta un contraste independiente que verifique cómo se comportan estas funciones en uso real. Este artículo no presenta pruebas propias ni sustituye la documentación completa del proveedor. Para una decisión de compra o una cobertura de lanzamiento, faltan detalles de disponibilidad, controles y acciones admitidas que habría que verificar en fuentes específicas y actualizadas.
La conclusión no cambia por llamar «agente» al producto ni por describir una tarea como automática: lo decisivo es la acción que las fuentes confirman y el contexto en el que la sitúan. Hasta contar con más detalles verificables, conviene tratar por separado la navegación documentada de Gemini en Chrome y la programación documentada en ChatGPT, sin atribuirles un alcance común.