- GPT-5.4 se presenta como el modelo profesional más potente y eficiente de OpenAI, con capacidades nativas para operar ordenadores y automatizar flujos de trabajo complejos.
- El sistema introduce un modo de uso de ordenador (Computer Use), ventana de contexto de hasta 1 millón de tokens y un nuevo sistema de gestión de herramientas (Tool Search) que reduce costes de cómputo.
- Las variantes GPT-5.4 Thinking y GPT-5.4 Pro mejoran el razonamiento, la programación y la fiabilidad factual, con menos errores y mejores resultados en benchmarks profesionales.
- El modelo ya está disponible en ChatGPT (planes de pago), API y entornos de desarrollo, con impacto directo en tareas profesionales como finanzas, desarrollo de software y automatización de procesos.

OpenAI ha dado un nuevo paso en la carrera de la inteligencia artificial con la llegada de GPT-5.4, su modelo más avanzado para trabajo profesional hasta la fecha. La gran novedad no es solo su potencia bruta, sino el hecho de que , ejecutando tareas en aplicaciones reales sin que el usuario tenga que guiar cada paso.
Este modelo, ya disponible a través de ChatGPT (planes de pago), la API y los entornos de desarrollo de OpenAI, combina mejoras en razonamiento, programación, uso de herramientas y fiabilidad factual. La compañía lo describe como su modelo de vanguardia más eficiente, pensado para automatizar flujos de trabajo completos en contextos profesionales y reducir la intervención humana a la supervisión y el ajuste puntual.
Qué es GPT-5.4 y por qué es relevante para el trabajo profesional

OpenAI define GPT-5.4 como su modelo más potente y eficiente para tareas de trabajo del conocimiento. Integra en una sola arquitectura los avances de razonamiento introducidos en generaciones anteriores, las capacidades de programación de GPT-5.3-Codex y nuevas funciones diseñadas para operar con aplicaciones, servicios en la nube y ecosistemas de herramientas complejos.
La empresa subraya que el objetivo de este modelo es que la IA no se limite a responder preguntas, sino que sea capaz de completar trabajos de principio a fin, permitiendo además automatizar parte de sus procesos internos: preparar hojas de cálculo, redactar documentos extensos, crear presentaciones, desarrollar código o coordinar tareas entre diferentes programas. En este sentido, GPT-5.4 se posiciona como una pieza central para quienes quieren automatizar parte de sus procesos internos, tanto en pymes como en grandes corporaciones europeas.
Según datos internos de OpenAI, GPT-5.4 supera en codificación a GPT-5.3-Codez y muestra mejoras claras en entornos profesionales, con menos errores en las respuestas finales y menor necesidad de correcciones manuales. Estas características lo sitúan como una herramienta atractiva para departamentos de finanzas, equipos legales, desarrolladores y consultoras que dependen de documentación y análisis de alta precisión.
Junto al modelo base, la compañía ha lanzado GPT-5.4 Pro para los escenarios más exigentes y ha incorporado la variante GPT-5.4 Thinking en ChatGPT, orientada a tareas de razonamiento profundo y planificación detallada. El despliegue afecta tanto a usuarios individuales de pago como a equipos empresariales que ya utilizan la API en Europa y otros mercados.
Uso nativo de ordenadores: la gran novedad de GPT-5.4
La característica que más titulares está generando es el nuevo modo de uso nativo de ordenadores (Computer Use). OpenAI señala que GPT-5.4 permite a los agentes basados en este modelo navegar por escritorios, manejar aplicaciones, interactuar con páginas web y ejecutar comandos de teclado y ratón sin supervisión constante por parte del usuario.
En la práctica, esto significa que un agente puede, por ejemplo, abrir un programa de hojas de cálculo, cargar un archivo, cruzar datos, generar un informe y enviarlo por correo, todo ello guiado por una instrucción de alto nivel. El modelo utiliza capturas de pantalla, información visual del entorno y bibliotecas como Playwright para decidir qué acciones realizar en cada momento.
Para validar estas capacidades, OpenAI cita su desempeño en OSWorld-Verified, un benchmark que mide la habilidad de los modelos para operar un entorno de escritorio a partir de imágenes y acciones simuladas. GPT-5.4 alcanza un 75% de éxito, frente al 47,3% de GPT-5.2, y se sitúa por encima del rendimiento humano medio, estimado en un 72,4% en ese mismo entorno.
Además de OSWorld, el modelo muestra mejoras en otros conjuntos de pruebas centrados en navegación web persistente y uso de interfaces complejas, como BrowseComp o WebArena-Verified. En algunos de estos casos, la variante GPT-5.4 Pro marca cifras cercanas al 90% de éxito, consolidando a la familia GPT-5.4 como referencia en el ámbito de agentes que trabajan sobre ordenadores reales.
Para las empresas europeas, desde despachos profesionales hasta compañías industriales, estas capacidades abren la puerta a automatizaciones que van más allá de los chatbots y se acercan a asistentes virtuales capaces de utilizar las mismas herramientas que un empleado humano, desde CRMs hasta ERPs, pasando por suites ofimáticas estándar, y facilitan la colaboración con el centro de inteligencia artificial de Andalucía.
Razonamiento profundo y modo Thinking: más control sobre cómo trabaja la IA
La variante GPT-5.4 Thinking, disponible en ChatGPT para usuarios de pago, está pensada para tareas donde el razonamiento paso a paso es clave: elaboración de informes complejos, planificación de proyectos, análisis exhaustivos o resolución de problemas con múltiples variables.
Una de las diferencias respecto a versiones anteriores es que el sistema puede mostrar un plan previo del razonamiento que va a seguir. El usuario tiene la posibilidad de revisar ese esquema inicial y interrumpir o redirigir el proceso mientras la respuesta está en curso, ajustando el enfoque sin tener que empezar desde cero.
Este mecanismo se complementa con mejoras en las capacidades de investigación, especialmente en lo que OpenAI describe como búsquedas en la web profunda (deep web) para consultas específicas que no suelen aparecer de forma inmediata en los motores de búsqueda convencionales. El modelo mantiene el contexto durante procesos de análisis más prolongados, lo que contribuye a respuestas más ricas y mejor alineadas con lo que pide el usuario.
En el ámbito profesional, estas funciones permiten afinar tareas como due diligence financiera, estudios de mercado, análisis jurídicos o elaboración de documentación técnica. La posibilidad de ajustar el razonamiento durante la generación del contenido reduce el número de iteraciones y ahorra tiempo a equipos que trabajan bajo presión de plazos.
OpenAI señala también que GPT-5.4 Thinking incorpora salvaguardas adicionales para limitar comportamientos engañosos y mejorar la trazabilidad de cómo llega a una determinada conclusión, aspecto relevante para sectores regulados en Europa, como el financiero o el sanitario.
Gestión inteligente de herramientas: Tool Search y ecosistemas complejos
Otro de los pilares de GPT-5.4 es su nuevo sistema de gestión de herramientas, conocido como Tool Search. El problema que intenta resolver es frecuente en proyectos empresariales: cuando un agente tiene acceso a una gran cantidad de herramientas o funciones, incluir todas sus descripciones en cada solicitud dispara el uso de tokens y encarece cada llamada a la API.
Con Tool Search, en lugar de cargar todas las definiciones completas, el modelo recibe únicamente una lista ligera de herramientas disponibles y recupera en detalle solo aquellas que necesita en cada momento. Según datos de pruebas realizadas sobre el benchmark MCP Atlas, con decenas de servidores de herramientas activos, este enfoque permitió reducir el consumo total de tokens en torno a un 47% manteniendo la precisión en las tareas.
Para las empresas que construyen soluciones sobre la API de OpenAI, esto tiene implicaciones directas: menores costes operativos y mejor escalabilidad a medida que el conjunto de herramientas integradas crece, y en algunos casos pueden acceder a ayudas REDIA para proyectos de inteligencia artificial.
OpenAI destaca que GPT-5.4 está mejor preparado para funcionar en “grandes ecosistemas de herramientas”, lo que encaja con la tendencia actual hacia arquitecturas basadas en microservicios y conectores especializados. En Europa, donde muchas compañías están adaptando sus sistemas heredados a entornos más modulares, esta flexibilidad puede facilitar la adopción progresiva de agentes de IA en distintos departamentos.
Este rediseño del sistema de herramientas se suma a las capacidades de Computer Use, de forma que el modelo no solo elige qué herramienta usar, sino que puede combinar herramientas, aplicaciones de escritorio y servicios web dentro de un mismo flujo de trabajo autónomo.
Ventana de contexto de hasta 1 millón de tokens: proyectos largos sin perder el hilo
GPT-5.4 también incorpora una ampliación significativa de la ventana de contexto, que puede llegar hasta 1 millón de tokens en la API y en entornos de desarrollo como Codex. Esta cifra permite procesar volúmenes de información muy superiores a los habituales en modelos anteriores, incluyendo contratos extensos, bases de código completas, históricos de conversación largos o conjuntos de documentos técnicos.
Para sectores como el jurídico, el financiero o el de consultoría, esta capacidad abre la puerta a análisis de casos complejos en una sola sesión, sin necesidad de fragmentar el material en múltiples partes. En el ámbito del desarrollo de software, posibilita trabajar con repositorios completos o módulos de gran tamaño manteniendo la coherencia global del proyecto.
OpenAI, no obstante, introduce una advertencia importante: las peticiones que superen los 272.000 tokens de entrada se facturan al doble de la tarifa estándar. Este umbral obliga a las empresas a diseñar con cuidado sus prompts y estrategias de contexto para aprovechar la ventana ampliada sin disparar los costes.
En términos prácticos, la recomendación para equipos europeos que utilizan la API es combinar la ventana de contexto extensa con técnicas de resumen, indexación y recuperación de información que permitan alimentar al modelo solo con la información realmente necesaria para cada tarea.
La gran ventana de contexto se complementa con mejoras en la forma en que GPT-5.4 mantiene la coherencia a lo largo de procesos de razonamiento largos, algo clave cuando se trabaja con documentos legales, informes regulatorios o documentación técnica de varias centenas de páginas.
Mejoras en precisión y reducción de errores factuales
Uno de los puntos en los que OpenAI hace más hincapié es la fiabilidad de GPT-5.4 frente a versiones anteriores. En pruebas internas basadas en conjuntos de preguntas donde usuarios habían detectado fallos factuales con modelos previos, el nuevo sistema muestra mejoras significativas.
La compañía afirma que las afirmaciones individuales de GPT-5.4 son un 33% menos propensas a ser falsas en comparación con GPT-5.2, y que las respuestas completas presentan aproximadamente un 18% menos de probabilidades de contener errores. Esta reducción de las llamadas “alucinaciones” es especialmente relevante en contextos donde un dato incorrecto puede tener consecuencias económicas o legales.
En el plano profesional, OpenAI cita evaluaciones en tareas como modelado financiero, análisis legales o elaboración de presentaciones, donde el modelo no solo responde mejor a preguntas puntuales, sino que completa entregables largos con menos necesidad de revisión humana. En algunos benchmarks internos relacionados con servicios profesionales, GPT-5.4 lidera las comparativas frente a otros modelos del mercado.
Estas mejoras se ven reforzadas por las capacidades de investigación en profundidad de la variante Thinking, que puede consultar múltiples fuentes, mantener el contexto y ajustar su razonamiento en función de la información encontrada. Para usuarios en España y el resto de Europa, la combinación de estas funciones resulta especialmente interesante en sectores sometidos a normas de cumplimiento estricto.
La menor tasa de error, unida a la posibilidad de revisar el plan de razonamiento, facilita también la documentación de cómo se ha llegado a una conclusión, algo que puede ser valioso en auditorías internas o procesos de validación de resultados generados por IA.
Programación, desarrollo y capacidades visuales reforzadas
GPT-5.4 hereda y mejora las capacidades de programación de la familia GPT-5.3, lo que se traduce en mejor rendimiento en tareas de codificación, depuración y explicación de código. En pruebas como SWE-Bench Pro, centrada en problemas reales de ingeniería de software, el modelo alcanza cifras de precisión por encima del 57%, superando ligeramente a las iteraciones previas.
En el entorno de desarrollo de OpenAI, el modelo se integra con herramientas experimentales como Playwright Interactive, que permite al sistema probar y depurar aplicaciones web o de escritorio mientras las desarrolla. Además, modos acelerados como /fast en Codex permiten aumentar la velocidad de generación de tokens hasta en un 50% en algunos casos, acortando los ciclos de prueba y error.
En cuanto a visión, GPT-5.4 incluye un modo mejorado de entrada de imágenes con soporte para archivos de alta resolución (hasta 10,24 millones de píxeles o unos 6.000 píxeles de lado). Esto facilita el trabajo con documentos escaneados, diagramas complejos, planos, capturas de pantalla densas o informes en PDF que antes resultaban difíciles de interpretar correctamente.
Los resultados que comparte OpenAI apuntan a mejoras en benchmarks como MMMU-Pro y OmniDocBench, con mejores tasas de acierto en localización de elementos, comprensión visual y precisión de clics en interfaces gráficas. Estas capacidades son relevantes, por ejemplo, para agentes que deben interpretar formularios, validar facturas o localizar información en documentos no estructurados.
Para equipos de desarrollo en España y otros países europeos, estas mejoras combinan tres elementos clave: mejor asistencia en el ciclo de programación, mayor capacidad de prueba automatizada y una comprensión más fiable de interfaces visuales, lo que reduce el tiempo necesario para pasar de un prototipo a una herramienta lista para producción.
Disponibilidad, planes y precios para acceder a GPT-5.4
OpenAI ha comenzado a desplegar GPT-5.4 de forma progresiva en sus distintos productos. En ChatGPT, la variante GPT-5.4 Thinking sustituye a GPT-5.2 Thinking para los usuarios de pago, estando disponible en los planes Plus, Team y Pro. La versión anterior se mantiene durante un tiempo limitado como modelo heredado para quienes necesiten compatibilidad temporal.
Para las empresas, GPT-5.4 Pro se ofrece en los planes Pro y Enterprise, orientado a organizaciones con cargas de trabajo intensivas, mayores necesidades de rendimiento y soporte. Tanto el modelo base como la variante Pro están también accesibles a través de la API de OpenAI, bajo identificadores como gpt-5.4 y gpt-5.4-pro, y en entornos de desarrollo como Codex.
En cuanto a precios, la compañía mantiene una estructura escalonada por millón de tokens. Para GPT-5.4, las tarifas de referencia anunciadas se sitúan en torno a 2,50 dólares por millón de tokens de entrada y 15 dólares por millón de tokens de salida, mientras que GPT-5.4 Pro eleva esos importes a aproximadamente 30 dólares por millón de tokens de entrada y 180 dólares por millón de tokens de salida. OpenAI ofrece modalidades con descuentos, como el uso en batch o planes flexibles, así como recargos por procesamiento prioritario.
La compañía sostiene que, pese a que el coste por token es superior al de modelos como GPT-5.2, la mayor eficiencia de GPT-5.4 permite completar muchas tareas con menos tokens, lo que en la práctica podría traducirse en un coste similar o incluso inferior por tarea resuelta. En Europa, donde las empresas suelen evaluar con detalle el retorno de la inversión en tecnología, este equilibrio entre precio y eficiencia será un factor determinante en la adopción.
Más allá de la estructura de precios, el hecho de que GPT-5.4 esté disponible tanto para suscripciones individuales de ChatGPT como para integraciones vía API facilita que autónomos, pymes y grandes corporaciones puedan probar y escalar su uso de acuerdo a sus necesidades y presupuestos.
Con este lanzamiento, OpenAI refuerza su apuesta por una inteligencia artificial capaz de operar ordenadores, gestionar herramientas, razonar a largo plazo y reducir errores factuales, acercándose a un escenario en el que los agentes de IA puedan asumir de forma sostenible tareas que hasta ahora recaían en trabajadores del conocimiento. El impacto real dependerá de cómo empresas y profesionales en España y el resto de Europa integren estas capacidades en su día a día, pero el listón tecnológico que marca GPT-5.4 sitúa el debate ya no en si utilizar este tipo de sistemas, sino en cómo y con qué rapidez incorporarlos a los procesos de trabajo.