Actualidad IA generativa

OpenAI hace que los agentes con GPT-6 respondan antes y gasten menos contexto

OpenAI
22 septiembre 2026

Qué han lanzado

GPT-6 estrena una caché de instrucciones con mayor reutilización y descuentos de hasta el 90% en entradas almacenadas.

OpenAI añade un panel de seguimiento y una herramienta que explica las causas de cada fallo de caché.

Qué cambia

Los agentes pueden conservar más contexto entre peticiones, responder antes y reducir el coste de tareas largas.

Es posible cambiar el esfuerzo de razonamiento, controlar herramientas y preparar la caché sin perder el contexto reutilizable.

GPT-6 mejora la reutilización del contexto con descuentos de hasta el 90%, un panel para medir la caché y nuevas herramientas que explican por qué se pierde.

OpenAI ha renovado la caché de instrucciones de GPT-6 para acelerar agentes y conversaciones que reutilizan grandes cantidades de contexto. El sistema conserva partes compartidas de solicitudes anteriores y evita volver a procesarlas completas en cada turno.

La mejora es especialmente útil en agentes que trabajan durante horas con las mismas instrucciones, herramientas y documentos. Los prefijos compatibles reutilizados durante una ventana de treinta minutos reciben descuentos de hasta el 90% en los tokens de entrada almacenados en caché.

El nuevo Prompt Caching Dashboard muestra qué proporción de la entrada se sirve desde la caché y cómo cambia con el tiempo. Sus gráficos separan los tokens reutilizados de los que se procesan de nuevo, lo que permite detectar cuándo una modificación aumenta el coste o retrasa las respuestas.

OpenAI también ha añadido una herramienta de diagnóstico para investigar fallos de caché. Al comparar una petición con una respuesta reciente, identifica cambios en el modelo, las herramientas, la configuración o el contenido que impidieron reutilizar el contexto y calcula cuántos tokens resultaron afectados.

Los desarrolladores pueden elegir puntos de corte explícitos para indicar qué parte estable de una instrucción debe conservarse. También pueden preparar la caché antes de que llegue la primera pregunta, de modo que instrucciones, definiciones de herramientas o material de referencia ya estén procesados cuando el usuario comienza la tarea.

GPT-6 permite cambiar el esfuerzo de razonamiento entre respuestas sin invalidar la caché anterior. Así, un agente puede dedicar más razonamiento a un paso difícil y reducirlo en una comprobación sencilla sin pagar de nuevo por todo el contexto compartido.

Las herramientas pueden activarse o desactivarse sin eliminar sus definiciones del mensaje. Mantener estable esa estructura ayuda a conservar la caché aunque cambie lo que el agente puede utilizar en cada momento.

Estas mejoras están orientadas a aplicaciones construidas con la API de GPT-6. No cambian los controles habituales del usuario dentro de ChatGPT, pero pueden reducir el tiempo de espera y el coste de los productos y agentes que funcionan con estos modelos.

Ver más