Qué anunció OpenAI

OpenAI presentó GPT-5.5 el 23 de abril de 2026 y, un día después, actualizó el anuncio para confirmar que GPT-5.5 y GPT-5.5 Pro ya están disponibles en la API. La compañía lo define como su modelo más inteligente e intuitivo hasta ahora, pero el cambio no se resume en responder mejor en un chat: apunta a completar trabajo real.

GPT-5.5 no cambia cada pregunta pequeña de forma espectacular. La apuesta está en otra parte: entender mejor un objetivo desordenado, planificar pasos, usar herramientas, comprobar el resultado y mantenerse en una tarea durante más tiempo. Por eso OpenAI subraya áreas como programación, investigación, análisis de datos, documentos, hojas de cálculo y uso de software.

Dónde quiere destacar GPT-5.5

Ilustración de GPT-5.5 mostrando rutas de razonamiento avanzado y flujos de trabajo de agentes de IA.

OpenAI sitúa el modelo especialmente en programación agentiva, uso del ordenador y trabajo de conocimiento. Son tareas en las que el modelo no solo redacta un párrafo, sino que inspecciona un repositorio, se mueve por una herramienta, compara documentos, analiza una tabla, arma un plan y corrige el resultado si algo no encaja.

La empresa también afirma que GPT-5.5 mantiene una latencia por token similar a GPT-5.4 en servicio real, aunque trabaja a un nivel de inteligencia superior. Además, dice que usa muchos menos tokens para completar las mismas tareas en Codex. Para equipos que usan IA a escala, esto importa bastante: el coste no depende solo del precio oficial del modelo, sino también de cuántos intentos, cuánta salida y cuánta revisión exige cada tarea.

Acceso, Codex y API

Según el anuncio, GPT-5.5 se está desplegando en ChatGPT y Codex para usuarios Plus, Pro, Business y Enterprise. GPT-5.5 Pro se ofrece en ChatGPT para Pro, Business y Enterprise. El centro de ayuda de OpenAI habla de un despliegue gradual, así que no todos los usuarios tienen por qué ver las mismas opciones al mismo tiempo.

Para desarrolladores, la página de precios de la API lista GPT-5.5 a 5,00 dólares por millón de tokens de entrada, 0,50 dólares por millón de tokens de entrada en caché y 30,00 dólares por millón de tokens de salida. Es, claramente, un modelo premium. En producción tendrá sentido usarlo para trabajos difíciles y reservar modelos más baratos para clasificación, enrutamiento, reescrituras cortas o automatizaciones repetitivas.

Benchmarks con contexto

Concepto de red digital que compara diferentes arquitecturas de IA y estructuras de datos complejas.

La tabla de evaluaciones publicada por OpenAI muestra números fuertes: 82,7 % en Terminal-Bench 2.0, 84,9 % en GDPval wins or ties, 78,7 % en OSWorld-Verified y 35,4 % en FrontierMath Tier 4. En la parte más difícil de FrontierMath, GPT-5.5 Pro aparece todavía más alto. Estos datos respaldan la idea de avance en programación de largo recorrido, trabajo profesional y razonamiento difícil.

Aun así, los benchmarks no deben leerse como una garantía universal. En un flujo de trabajo real pesan la calidad de los archivos, las reglas de privacidad, los hábitos del equipo, la latencia, el presupuesto y la tolerancia al error. Un modelo puede ganar una prueba y, al mismo tiempo, ser demasiado caro o pesado para una automatización sencilla de gran volumen.

Por qué importa

El mensaje de fondo es que OpenAI quiere que GPT-5.5 se parezca menos a una caja de texto y más a un sistema de trabajo. Esa dirección se ve en Codex, en los flujos de uso del ordenador y en los modos de razonamiento más profundos de ChatGPT. Si el modelo conserva mejor el contexto, usa herramientas con más fiabilidad y revisa sus pasos, el valor deja de estar en una respuesta aislada y pasa a estar en una tarea terminada.

También hay un componente de control. OpenAI afirma que GPT-5.5 llega con su conjunto de salvaguardas más fuerte hasta la fecha, con pruebas internas y externas y evaluaciones adicionales en ciberseguridad y biología. En datos, la distinción sigue siendo clave: los usuarios particulares pueden desactivar en ChatGPT el uso de conversaciones para mejorar modelos, mientras que OpenAI dice que los datos de Business, Enterprise, Edu, Healthcare y API no se usan por defecto para entrenamiento.

Lo que habrá que comprobar

La prueba real no estará en las gráficas del lanzamiento, sino en el uso diario. Los desarrolladores mirarán si GPT-5.5 reduce de verdad los ciclos fallidos al programar. Los analistas comprobarán si maneja tablas y fuentes sin inventar datos en silencio. Las empresas calcularán si el coste superior se compensa con menos reintentos y trabajo terminado más rápido.

Por ahora, la conclusión más seria es equilibrada: GPT-5.5 es un lanzamiento importante de OpenAI, con mejoras creíbles en trabajo agentivo, programación y tareas profesionales. Pero sigue necesitando revisión humana, verificación de fuentes y disciplina de costes. Usado con objetivos claros y revisión humana, puede ser algo más que un chatbot más rápido: puede ser una herramienta de trabajo bastante más capaz.