

ChatGPT Agent es el agente autónomo unificado de OpenAI, lanzado el 17 de julio de 2025, que reemplaza tanto a Operator como a Deep Research. Navega por la web, ejecuta código, completa formularios y sintetiza investigaciones dentro de ChatGPT en los planes Plus ($20/mo) y Pro ($200/mo).
ChatGPT Agent es el agente autónomo unificado integrado en ChatGPT, lanzado por OpenAI el 17 de julio de 2025. Reemplazó a dos productos independientes anteriores: Operator, que se encargaba de la navegación web y de completar formularios, y Deep Research, que sintetizaba investigaciones de múltiples fuentes en informes. El resultado es un único "modo agente" que se puede seleccionar desde el editor de ChatGPT, disponible para los suscriptores de los planes Plus, Pro, Team y Enterprise. Al activarse, el agente se ejecuta en una máquina virtual en la nube con su propio navegador, terminal y entorno de ejecución de código, lo que le permite realizar tareas de varios pasos con una mínima intervención del usuario.
Sus capacidades principales incluyen la navegación web en vivo con clics y llenado de formularios, ejecución de código basada en terminal, generación de calendarios y documentos (incluidas presentaciones editables), síntesis de investigación de múltiples fuentes y la integración con ChatGPT Connectors como Gmail y GitHub. El agente obtuvo una puntuación del 41.6% en Humanity's Last Exam con herramientas en su lanzamiento (hasta un 44.4% con razonamiento paralelo) y lideró el banco de pruebas BrowseComp con un 68.9%, situándose entre los agentes de navegación web más potentes disponibles al público. En el plan Plus, los usuarios obtienen 40 tareas de agente al mes; los usuarios de Pro reciben 400.
Lo que ChatGPT Agent realmente hace en julio de 2025
OpenAI lanzó ChatGPT Agent el 17 de julio de 2025, el mismo día que descontinuó el producto independiente Operator en operator.chatgpt.com. Sam Altman lo describió en X como una combinación del "espíritu de Deep Research y Operator, pero más potente que eso". Esta consolidación resolvió una queja frecuente de los usuarios: Operator podía hacer clic y desplazarse, pero no podía redactar informes detallados; Deep Research podía sintetizar contenido web, pero no podía interactuar con páginas autenticadas ni procesos de pago. ChatGPT Agent maneja ambas funciones dentro del mismo hilo de conversación.
En términos prácticos, el agente acepta instrucciones en lenguaje natural como "analiza a tres competidores y crea una presentación" o "planifica y compra los ingredientes para hacer un desayuno japonés para cuatro personas". A continuación, abre pestañas en el navegador, lee el contenido de las páginas, navega por menús desplegables y formularios, ejecuta Python cuando se necesita computación y devuelve tanto un resumen como un resultado descargable. Las transiciones del chat estándar al modo agente ocurren a mitad de la conversación, por lo que puedes hacer una pregunta de seguimiento o corregir el rumbo del agente sin tener que reiniciar. El agente también se integra con ChatGPT Connectors, lo que significa que puede extraer eventos del calendario, leer hilos de Gmail o enviar código a repositorios de GitHub cuando esas conexiones están configuradas. La memoria está intencionalmente desactivada en el modo agente para bloquear vectores de filtración de datos, un compromiso que OpenAI dejó claro en su lanzamiento.
"Hoy lanzamos un nuevo producto llamado ChatGPT Agent. Agent representa un nuevo nivel de capacidad para los sistemas de IA y puede realizar algunas tareas notables y complejas por ti utilizando su propia computadora. Combina el espíritu de Deep Research y Operator, pero es más potente que eso". - Sam Altman (@sama), X/Twitter, 17 de julio de 2025
Dónde se sitúa ChatGPT Agent frente a Manus y Anthropic Computer Use
Tres productos definen la categoría de agentes de propósito general a mediados de 2026: ChatGPT Agent, Manus y Anthropic Computer Use. Las diferencias son arquitectónicas, no solo cosméticas.
Manus (de Monica/Butterfly Effect AI, lanzado el 6 de marzo de 2025) utiliza un sistema de orquestación multiagente. Divide una solicitud compleja en subtareas y asigna cada una a un subagente especializado que se ejecuta en su propio entorno aislado (sandbox), procesándolas en paralelo. Para tareas de investigación amplias, esto significa que cientos de fuentes se manejan de forma simultánea en lugar de secuencial. Manus también selecciona entre los modelos Claude y Qwen para cada subtarea dependiendo de los requisitos de capacidad, lo que le otorga una flexibilidad de modelos de la que carece ChatGPT Agent. En una prueba directa de cuatro tareas publicada por Nitika Sharma en Analytics Vidhya en julio de 2025, Manus ganó en dos tareas (creación de PPT, búsqueda de compras), ChatGPT Agent ganó en una (análisis de datos) y ambos fallaron en la programación de eventos. Manus cuesta $16/mes en su nivel Basic frente a los $20/mes de ChatGPT Plus. La contrapartida es que Manus es un producto independiente que requiere una cuenta nueva, mientras que ChatGPT Agent ya está dentro de la plataforma que utilizan 500 millones de personas al mes.
Anthropic Computer Use (API, lanzada en octubre de 2024 con Claude 3.5 Sonnet) adopta un enfoque fundamentalmente distinto: es puramente una API sin un producto alojado para el consumidor. El sistema funciona tomando capturas de pantalla y utilizando interacción basada en coordenadas, lo que significa que Claude identifica las coordenadas visuales de los píxeles de un botón, calcula dónde hacer clic y emite el comando. Esta arquitectura le permite operar en cualquier aplicación de escritorio local o remota, no solo en páginas web. Los desarrolladores lo integran por sí mismos, gestionando la captura de pantalla, la ejecución de acciones y la lógica de recuperación en su propio código. ChatGPT Agent maneja toda esa infraestructura para los usuarios finales de forma automática, pero está limitado a una máquina virtual en la nube sin acceso a archivos locales. Anthropic Computer Use obtuvo un 14.9% en OSWorld (modo de captura de pantalla) frente al mejor resultado anterior del 7.8%, y a diferencia de ChatGPT Agent, cobra por token a través de la API sin un límite de suscripción mensual. Para los desarrolladores que construyen flujos de automatización repetibles, el modelo de API ofrece más flexibilidad; para los trabajadores del conocimiento individuales que desean una experiencia sin configuración, ChatGPT Agent gana en conveniencia.
Puedes comparar el ecosistema más amplio en Vantaige leyendo la ficha de Manus, la ficha de Claude 4 y la ficha de Devin para conocer la variante de ingeniería de software de los agentes autónomos.
Cómo es la realidad del ciclo del agente en el día a día
Las pruebas independientes realizadas por Evan Sunwall en Nielsen Norman Group (julio de 2025) documentan una de las evaluaciones más claras de la experiencia. La prueba: hacer una reserva de restaurante en Brennan's of Houston para cuatro personas al mediodía, indicando una alergia a los mariscos para uno de los invitados. ChatGPT Agent completó la tarea correctamente, incluyendo la identificación y transmisión de la restricción dietética que el usuario no había asignado explícitamente a un invitado en particular. El inconveniente: el proceso tardó aproximadamente 17 minutos. Un humano realizando la misma tarea terminó en unos 2 minutos. El agente sufrió un retraso de 55 segundos debido a una redirección inesperada de Google Maps y se equivocó al hacer clic en un selector de franja horaria antes de autocorregirse. Sunwall concluyó que el agente "se asienta sobre un terreno inestable" y advirtió que "las experiencias más complejas serían más propensas a errores y más lentas".
Las tareas de reserva de hoteles en otras reseñas duraron hasta 25 minutos con frecuentes interrupciones a mitad de la tarea para pedir al usuario que proporcionara información. Cualquier sitio web que utilice CAPTCHA o la protección contra bots de Cloudflare detiene al agente por completo, lo que elimina una gran proporción de objetivos de comercio electrónico, venta de entradas y sitios con muchos formularios. Las confirmaciones falsas son un patrón reportado: el agente afirma haber completado una acción (añadir artículos a un carrito de Etsy, por ejemplo) cuando la acción falló silenciosamente.
"El proceso fue muy lento. ChatGPT Agent se asienta sobre un terreno inestable, y las experiencias más complejas serían más propensas a errores y más lentas". - Evan Sunwall, Nielsen Norman Group, julio de 2025
En el plan Plus, el límite mensual de 40 tareas es la mayor restricción práctica. Un análisis de más de 5,000 sesiones de agentes reveló que el 73% de los usuarios de Plus agotan su asignación durante la primera semana, creando lo que los revisores llaman "ansiedad de mensajes" en torno a la conservación de las ejecuciones. Aakash Gupta, un evaluador de IA que publicó un análisis en julio de 2025, calificó al agente con un 6/10, señalando que "se queda corto respecto a las capacidades transformadoras que sugería el marketing inicial". Cada tarea puede abarcar muchos pasos del agente internamente, pero solo el activador iniciado por el usuario cuenta para la asignación mensual, no las pausas de aclaración a mitad de la tarea.
La calidad de salida de los documentos generados es otro punto de fricción. Varios revisores notaron que las presentaciones e informes producidos por el agente estaban "mal formateados" en comparación con lo que ofrece el ChatGPT estándar cuando se le hace la misma solicitud como un prompt directo. El agente prioriza la finalización de la tarea por encima del refinamiento.
Para quién está diseñado ChatGPT Agent
Los casos de uso más claros son: trabajadores del conocimiento que ya pasan su día a día en ChatGPT y desean una automatización ocasional de varios pasos sin adoptar una nueva herramienta; investigadores que necesitan análisis competitivos, logística de viajes o síntesis documentada a través de docenas de páginas; y equipos de negocios en planes Team o Enterprise que desean conectar integraciones de Gmail, GitHub o calendarios en sus flujos de trabajo existentes de ChatGPT. Las aplicaciones móviles para iOS y Android dan acceso al mismo modo agente, lo que lo hace viable para la delegación de tareas sobre la marcha de una manera que la mayoría de los competidores no ofrecen. El hecho de que el modo agente se active dentro de una conversación existente, sin cambiar de aplicación o cuenta, reduce sustancialmente la barrera de entrada en comparación con las herramientas que requieren un proceso de incorporación dedicado.
Los equipos de comercio electrónico y los vendedores independientes pueden utilizar el agente para investigar tendencias de precios, redactar descripciones de productos y navegar por sitios de proveedores para obtener cotizaciones. Los estudiantes e investigadores que lo utilizan para flujos de trabajo de aprendizaje encuentran útil la combinación de búsqueda en vivo y síntesis estructurada para revisiones bibliográficas y análisis competitivos. En el plan Pro, los usuarios avanzados informan que utilizan el agente para automatizar los ciclos de informes semanales: extrae datos de fuentes conectadas, redacta el resumen y lo formatea para su distribución, un flujo de trabajo que encaja perfectamente en el rango operativo del agente.
Para flujos de trabajo de investigación específicos, ChatGPT Agent complementa herramientas como Browserbase (que maneja la infraestructura de navegadores headless para desarrolladores que desean construir sobre la navegación automatizada) y Lindy (que se centra en la automatización de flujos de trabajo con estrechas integraciones de aplicaciones). Vale la pena comparar con Lindy si tu objetivo principal es la automatización sin código entre herramientas SaaS en lugar de la navegación web abierta.
Lo que ChatGPT Agent no es
ChatGPT Agent no es un reemplazo para las plataformas de automatización dedicadas cuando necesitas una ejecución de tareas de alto volumen, repetible o programática. Con 40 tareas al mes en el plan Plus, no escala para flujos de trabajo de producción. No es un agente informático local: no tiene acceso a tu sistema de archivos, aplicaciones locales o entorno de escritorio. No es adecuado para ningún objetivo protegido por CAPTCHA o Cloudflare (un gran porcentaje de los sitios web transaccionales). No es un agente de codificación en el sentido en que lo es Devin: Devin mantiene un entorno de ingeniería de software persistente con su propio repositorio, IDE y capa de planificación a través de proyectos de múltiples sesiones, mientras que ChatGPT Agent restablece el contexto entre sesiones.
Si necesitas un agente que pueda operar con archivos locales y aplicaciones de escritorio, Anthropic Computer Use (API) es arquitectónicamente más capaz. Si necesitas la ejecución paralela de múltiples tareas a través de cientos de fuentes simultáneamente, la arquitectura multiagente de Manus supera a un único ciclo secuencial. Si tu objetivo es la entrega autónoma de código en proyectos de software completos, Devin está diseñado específicamente para ese alcance. ChatGPT Agent es una capa de conveniencia de propósito general para los usuarios que ya están inmersos en el ecosistema de ChatGPT. Ese posicionamiento es genuinamente útil para decenas de millones de personas, pero su límite es real.
Reseñas de usuarios
Aún no hay reseñas. ¡Sé el primero en compartir tu experiencia!
Inicia sesión para escribir una reseña.
Artículos relacionados
Guías y artículos relacionados con ChatGPT Agent.

Turn Any AI Agent Into a Superagent: The 12-Integration Stack (2026)

What Are AI Agents? Complete Beginner’s Guide (2025)

AI Agents for Business: What They Actually Are and 12 Things You Can Automate Today

How AI Agents Work: Architecture & Implementation Guide (2025)

Google vs OpenAI vs Anthropic Agents: The May 2026 Platform Showdown
