OpenAI lanza GPT-5.4, el modelo que maneja tu ordenador de forma autónoma

  • GPT-5.4 es el nuevo modelo de OpenAI capaz de controlar un ordenador de forma autónoma y ejecutar aplicaciones como un usuario humano.
  • El sistema integra mejoras en razonamiento, programación y automatización, con una ventana de hasta un millón de tokens de contexto.
  • La función Thinking permite ver y ajustar el plan de razonamiento del modelo a mitad de tarea, mejorando el control del flujo de trabajo.
  • GPT-5.4 y GPT-5.4 Pro ya están disponibles en ChatGPT (Plus, Pro, Team) y vía API para integraciones profesionales.

Modelo de IA capaz de operar ordenadores de forma autonoma

OpenAI ha dado un paso relevante en la evolución de la inteligencia artificial con la presentación de GPT-5.4, su primer modelo diseñado para manejar ordenadores de manera autónoma. Lejos de limitarse a generar texto o código, este sistema está pensado para desenvolverse dentro de aplicaciones reales y llevar a cabo procesos completos casi como si fuera una persona delante del teclado y el ratón.

La empresa dirigida por Sam Altman sitúa este lanzamiento como su propuesta más avanzada para entornos de trabajo profesionales, con especial foco en automatización de flujos, programación y tareas largas que requieren planificación por fases. Sin grandes estridencias, OpenAI plantea con GPT-5.4 un cambio de rol para la IA: de asistente conversacional a operador digital capaz de intervenir directamente en el software corporativo.

Un modelo enfocado en controlar el ordenador

La principal novedad de GPT-5.4 es su capacidad para interactuar con el sistema operativo y las aplicaciones sin supervisión constante. El modelo puede abrir programas, navegar por sitios web, moverse por menús e introducir comandos mediante acciones equivalentes al uso de teclado y ratón, lo que le permite completar flujos de trabajo complejos dentro de entornos de escritorio.

Esta habilidad estaba hasta ahora condicionada a integraciones externas o a scripts específicos, pero con GPT-5.4 el control del ordenador pasa a ser una función nativa del modelo. De este modo, los agentes de IA pueden ejecutar tareas de principio a fin en herramientas de ofimática, plataformas de desarrollo, aplicaciones empresariales o paneles web, sin que el usuario tenga que intervenir en cada paso.

Para que esto sea viable, el sistema incorpora una ventana de contexto que soporta hasta un millón de tokens. En la práctica, esto le permite manejar documentación extensa, procesos de varios pasos y proyectos de larga duración sin perder el hilo entre una fase y la siguiente, algo especialmente relevante en ámbitos técnicos o administrativos donde se manejan gran cantidad de datos.

Además, OpenAI ha añadido una función de búsqueda automática de herramientas que ayuda al modelo a localizar qué aplicación o recurso necesita en cada momento. Así, el agente puede decidir por sí mismo si debe abrir un editor de código, una hoja de cálculo, un gestor de proyectos o un navegador, y encadenar acciones en distintas plataformas para completar una misma tarea.

Este enfoque está alineado con la estrategia de la compañía de impulsar los llamados agentes de IA, sistemas que no solo responden a preguntas, sino que actúan como una especie de “empleado digital” dentro de la infraestructura de software de una organización.

Razonamiento reforzado y más capacidad para programar

En paralelo a las capacidades de control del ordenador, OpenAI ha introducido mejoras sustanciales en razonamiento y programación. Según la empresa, GPT-5.4 supera a su predecesor especializado en código, GPT-5.3-Codez, tanto en precisión como en rendimiento en entornos de desarrollo y herramientas profesionales.

Esto se traduce en una mayor solvencia para escribir, revisar y depurar código en diferentes lenguajes, así como para integrarse en flujos de integración continua, automatización de pruebas o análisis de repositorios. El modelo está pensado para desenvolverse en escenarios exigentes, como proyectos de ingeniería de software, análisis de datos avanzados o automatización de scripts en sistemas corporativos.

Junto a la versión estándar, OpenAI ha lanzado GPT-5.4 Pro, orientado a quienes necesitan un plus de capacidad y estabilidad para cargas de trabajo intensivas. Esta variante está disponible tanto en ChatGPT como vía API y apunta a sectores como las finanzas, la ingeniería, la consultoría tecnológica o la analítica de negocio, donde se requieren respuestas consistentes y manejo de grandes volúmenes de información.

En la práctica, GPT-5.4 Pro ofrece un mejor comportamiento en tareas complejas, con más margen para procesos extensos y un rendimiento más predecible en operaciones que exigen altos niveles de cálculo o de gestión de contexto.

Función Thinking: ver el plan de la IA y cambiarlo sobre la marcha

Uno de los elementos más llamativos de esta generación es la integración de la función Thinking, heredada de GPT-4.5 pero ampliada para trabajar con GPT-5.4. En la interfaz de ChatGPT, este modo permite visualizar de forma anticipada el esquema de razonamiento que el modelo pretende seguir para resolver una tarea, especialmente útil en procesos largos o delicados.

En lugar de limitarse a recibir un resultado final, el usuario puede ir viendo cómo la IA descompone el problema, qué pasos tiene previsto ejecutar y qué herramientas planea utilizar en cada fase. De esta manera, es posible detener la ejecución a mitad del flujo, corregir instrucciones, matizar objetivos o cambiar prioridades antes de que el sistema complete todo el proceso.

Esta capacidad de “abrir” el razonamiento resulta especialmente relevante en consultas complejas o investigaciones técnicas, por ejemplo en búsquedas avanzadas, análisis de grandes bases de datos o revisiones de documentación jurídica y científica. El usuario gana margen de maniobra para orientar el resultado hacia lo que realmente necesita, sin tener que repetir la petición desde cero.

OpenAI señala además que el modo Thinking incorpora mejoras en labores de investigación y búsqueda en profundidad, manteniendo el contexto entre distintas consultas relacionadas. Esto ayuda a construir procesos de trabajo más continuos, donde la IA no pierde la referencia de lo que se ha hecho en pasos anteriores.

Más eficiencia, menos errores y mejor navegación que la media humana

Otro de los puntos en los que OpenAI hace hincapié es la eficiencia de GPT-5.4 a la hora de consumir tokens. El modelo, según la compañía, necesita menos contexto textual para llegar a una solución válida en comparación con versiones anteriores como GPT-5.2, lo que se traduce en un uso más ajustado de recursos, algo relevante para empresas que dependen de la API a gran escala.

En términos de calidad de respuesta, OpenAI afirma que GPT-5.4 es un 33% menos propenso a generar afirmaciones incorrectas y que las respuestas completas muestran un 18% menos de errores frente a la generación anterior. Aunque estas cifras proceden de pruebas internas, apuntan a una reducción significativa de las alucinaciones y fallos de precisión, un aspecto clave en usos profesionales.

La compañía ha destacado también que GPT-5.4 ha superado por primera vez el rendimiento medio humano en tareas de navegación de escritorios. En el benchmark OSWorld, el modelo logró una tasa de éxito del 75% al ejecutar acciones en entornos de sistema operativo, por encima del 72,4% asignado a la media humana y muy por delante del 47,3% que registraba GPT-5.2.

Este tipo de pruebas miden la capacidad de la IA para manejar ventanas, buscar opciones en menús, completar formularios, abrir y cerrar aplicaciones o realizar cambios en la configuración del sistema, entre otras acciones habituales en el día a día de un ordenador.

De cara a las organizaciones, estos avances suponen mayor fiabilidad a la hora de delegar tareas críticas en agentes de IA, tanto en programación como en manipulación de hojas de cálculo, gestión documental o administración de sistemas, reduciendo el riesgo de errores costosos.

Planes, variantes y acceso en Europa

GPT-5.4 se integra en la oferta de productos de OpenAI como su modelo de referencia para trabajo profesional. Está disponible para quienes cuentan con suscripción a ChatGPT en los planes Plus, Pro y Team, lo que abre la puerta a su uso por parte de autónomos, pymes y equipos de trabajo distribuidos en España y el resto de Europa.

Además, tanto GPT-5.4 como GPT-5.4 Pro pueden utilizarse a través de la API de OpenAI para integraciones directas en aplicaciones y servicios. Esto permite a empresas europeas incorporar agentes capaces de controlar ordenadores, automatizar flujos internos o asistir a empleados dentro de sus propias herramientas de negocio, sin necesidad de desarrollar un modelo desde cero.

La compañía sitúa este lanzamiento como la pieza central de su estrategia para automatizar procesos de trabajo complejos, desde la gestión de proyectos de software hasta operaciones financieras, pasando por la administración de sistemas y la elaboración de informes. La combinación de control de escritorio, gran ventana de contexto y mejoras en razonamiento busca cubrir una amplia gama de casos de uso en el tejido empresarial europeo.

Con GPT-5.4, OpenAI consolida la idea de agentes que no solo responden a lo que se les pregunta, sino que toman la iniciativa dentro del entorno digital, se coordinan con múltiples herramientas y completan tareas de principio a fin. Para organizaciones y profesionales que trabajan a diario con ordenadores, esto supone la posibilidad de delegar en la IA buena parte de las tareas repetitivas o de baja complejidad, manteniendo el control sobre las decisiones clave.

Aunque todavía queda recorrido para ver cómo se regulan y se integran este tipo de sistemas en todos los sectores, el nuevo modelo marca un punto de inflexión: la inteligencia artificial deja de ser únicamente un generador de contenido y se afianza como operador autónomo dentro del escritorio, con implicaciones directas en la forma de trabajar de empresas y profesionales en España y en el resto de Europa.

ChatGPT Agent de OpenAI
Artículo relacionado:
ChatGPT Agent de OpenAI: así funciona el nuevo agente autónomo de IA

Add as preferred source