GPT-5.6: OpenAI lanza su modelo de IA más potente con tres versiones y soporte multiagente

GPT-5.6: OpenAI lanza su modelo de IA más potente con tres versiones y soporte multiagente 2

OpenAI ha presentado la familia de modelos GPT-5.6, disponible desde el 9 de julio de 2026 para todos los usuarios de ChatGPT, Codex y la API. Según la compañía, se trata de su modelo insignia más avanzado hasta la fecha, organizado en tres niveles —Sol, Terra y Luna— y diseñado para rendir más con menos tokens y a un coste menor que las versiones anteriores y que los modelos de la competencia.

Tres modelos para diferentes necesidades y presupuestos

De acuerdo con OpenAI, la familia GPT-5.6 se estructura en torno a tres variantes pensadas para distintos casos de uso. Sol es el modelo insignia, orientado a tareas complejas y de alta exigencia. Terra es la opción intermedia, equilibrada para el trabajo diario. Y Luna es la alternativa más asequible, pensada para quienes priorizan la velocidad y el coste sobre la potencia máxima.

En cuanto a precios, la compañía informa que Sol tiene un coste de 5 USD por millón de tokens de entrada y 30 USD de salida. Terra se sitúa en 2,50 USD de entrada y 15 USD de salida. Luna, la más económica, cuesta 1 USD de entrada y 6 USD de salida. Según OpenAI, incluso los modelos más baratos de la familia superan en rendimiento a versiones anteriores de la competencia a una fracción del coste.

Qué hace diferente a GPT-5.6 Sol frente a otros modelos

Según los datos facilitados por OpenAI, GPT-5.6 Sol ha obtenido una puntuación de 53,6 en el benchmark Agents’ Last Exam, que evalúa flujos de trabajo profesionales en 55 áreas distintas. Eso supone, según la fuente, una ventaja de 13,1 puntos sobre Claude Fable 5 con razonamiento adaptativo, y de 11,4 puntos usando solo razonamiento medio, pero a aproximadamente una cuarta parte del coste estimado.

En el Índice de Inteligencia de Artificial Analysis, GPT-5.6 Sol con razonamiento máximo se sitúa a un punto de Fable 5, aunque completa las tareas en un 61 % menos de tiempo y a aproximadamente la mitad del coste estimado, de acuerdo con la información proporcionada por OpenAI. Son cifras relevantes para empresas que necesitan procesar grandes volúmenes de trabajo sin disparar la factura de la API.

El modo Ultra: varios agentes trabajando en paralelo

Una de las novedades más llamativas que presenta OpenAI es la configuración ultra, que coordina por defecto cuatro agentes en paralelo para completar tareas complejas más rápido. Según la compañía, esto permite desplazar la frontera entre rendimiento y latencia: mejores resultados en menos tiempo. En la API, los desarrolladores pueden replicar este comportamiento mediante la función multiagente beta de la API de Responses.

Además de ultra, OpenAI describe otras configuraciones de esfuerzo: max da más tiempo al modelo para razonar, explorar alternativas y revisar su enfoque antes de devolver una respuesta. Estas opciones están pensadas para problemas que se benefician de mayor inversión de cómputo, como investigación financiera, análisis jurídico o ingeniería de software compleja.

Codificación, diseño y trabajo del conocimiento, los puntos fuertes

Según los datos que facilita OpenAI, GPT-5.6 Sol es su mejor modelo de codificación hasta la fecha. En el Índice de agentes de codificación de Artificial Analysis, obtiene una puntuación de 80, superando a Claude Fable 5 en 2,8 puntos, usando menos de la mitad de los tokens de salida y tardando menos de la mitad del tiempo. Los benchmarks Terminal-Bench 2.1 y DeepSWE también muestran resultados que, según la fuente, establecen nuevos estándares del sector.

En diseño, la compañía afirma que GPT-5.6 representa un salto cualitativo en criterio visual. El modelo puede inspeccionar el resultado renderizado —no solo el código subyacente— para detectar problemas visuales y aplicar retoques antes de entregar el trabajo. Empresas como Canva, Figma o Lovable han sido citadas en el comunicado valorando positivamente estas mejoras en sus propias evaluaciones.

En lo que respecta al trabajo del conocimiento, el modelo establece nuevos resultados en BrowseComp (92,2 %) y en OSWorld 2.0 (62,6 %), según los datos aportados por OpenAI. En este último benchmark, la fuente indica que supera a Claude Opus 4.8 usando un 85 % menos de tokens de salida.

Ciberseguridad: más capacidad defensiva con acceso verificado

GPT-5.6 también avanza en ciberseguridad. De acuerdo con OpenAI, en ExploitBench el modelo obtiene un 73,5 % frente al 47,9 % de GPT-5.5 con un presupuesto comparable de tokens. En ExploitGym, casi duplica la tasa máxima de aprobados del modelo anterior, pasando del 15,1 % al 33,7 % con seis horas de tiempo de ejecución.

La compañía subraya que estas capacidades son de doble uso: sirven tanto para atacar como para defender. Por eso, OpenAI ha lanzado un programa de acceso de confianza llamado Daybreak Trusted Access for Cyber, que permite a investigadores y organizaciones verificadas acceder a mayor capacidad defensiva. Los usuarios individuales deberán activar la Seguridad avanzada de la cuenta con claves de acceso respaldadas por hardware antes del 1 de septiembre para mantener el acceso a los modelos con mayores capacidades de ciberseguridad.

Cómo afecta esto a la investigación interna de OpenAI

Uno de los datos más llamativos del comunicado es el impacto de GPT-5.6 dentro de la propia OpenAI. Según la compañía, durante las pruebas internas, la media diaria de tokens de salida por investigador activo fue más del doble del nivel máximo observado con GPT-5.5. En los últimos seis meses, el uso interno de tokens agénticos aumentó aproximadamente 22 veces.

Esto se enmarca en lo que OpenAI describe como aceleración de la investigación en IA. El modelo se usa a lo largo de todo el ciclo de desarrollo: para diagnosticar fallos, optimizar sistemas de entrenamiento, ejecutar experimentos e interpretar resultados. En el Índice RSI, que mide capacidades orientadas a la automejora, GPT-5.6 Sol representa una mejora de 16,2 puntos sobre GPT-5.5, según los datos facilitados.

Disponibilidad: quién puede acceder y desde cuándo

Según OpenAI, el despliegue comenzó el 9 de julio de 2026 y se está extendiendo de forma gradual hasta alcanzar disponibilidad completa en un plazo de 24 horas. La disponibilidad varía según el plan:

  • Usuarios de Plus, Pro, Business y Enterprise pueden acceder a GPT-5.6 Sol con configuraciones de esfuerzo medio o alto en ChatGPT.
  • Usuarios de Pro y Enterprise pueden seleccionar GPT-5.6 Sol Pro para los resultados de mayor calidad.
  • Usuarios de los planes Gratis y Go tienen acceso a GPT-5.6 Terra en ChatGPT Work y Codex.
  • El modo ultra está disponible para usuarios de Pro y Enterprise en ChatGPT Work, y para planes Plus y superiores en Codex.
  • Desarrolladores con acceso a la API pueden usar Sol, Terra y Luna, con soporte para llamadas programáticas a herramientas y la función multiagente en beta.

En cuanto al almacenamiento en caché, OpenAI introduce puntos de interrupción explícitos y un tiempo mínimo de caché de 30 minutos. Las escrituras en caché se facturan al 125 % de la tarifa de entrada estándar, mientras que las lecturas mantienen el descuento del 90 %, según la información publicada por la compañía.

Seguridad: el sistema de protección más robusto hasta ahora

OpenAI afirma que GPT-5.6 llega con las medidas de seguridad más sólidas de su historia. El proceso de evaluación previo al lanzamiento combinó red teaming humano con pruebas automatizadas a gran escala, incluyendo aproximadamente 700.000 horas de GPU A100e de red teaming automatizado de caja negra, según los datos que facilita la compañía.

Las protecciones están organizadas en capas: las medidas integradas durante el entrenamiento funcionan junto con verificaciones en tiempo de ejecución, supervisión continua y controles a nivel de cuenta. Según OpenAI, las medidas de ciberseguridad de GPT-5.6 Sol bloquean aproximadamente diez veces más actividad potencialmente dañina que los modelos anteriores, aunque reconocen que esto puede generar fricción en usos legítimos, para lo cual ofrecen la opción de redirigir solicitudes a modelos con menor capacidad.

Fuente: https://openai.com/es-ES/index/gpt-5-6/


También podría ser de tu interés:

Deja un comentario