OpenAI lanza Ultrafast: ChatGPT responde hasta 14 veces más rápido
OpenAI habilitó en fase de prueba un modo que acelera hasta 14 veces las respuestas de GPT-5.6 Sol, apoyado en chips de la firma Cerebras y sin resignar, según la empresa, capacidad de razonamiento.

OpenAI incorporó a ChatGPT un modo llamado Ultrafast que multiplica hasta por 14 la velocidad de respuesta de GPT-5.6 Sol, su modelo más avanzado. Según la empresa, el sistema alcanza picos de 750 tokens por segundo, muy por encima de los 50 o 55 tokens por segundo que entrega el mismo modelo en su modo de razonamiento estándar. La función se liberó primero para un grupo acotado de usuarios, y OpenAI dijo que irá sumando gente a medida que tenga más capacidad de cómputo disponible.
La velocidad extra no sale de la nada. OpenAI construyó Ultrafast en conjunto con Cerebras, una empresa de semiconductores que diseña chips pensados específicamente para acelerar la ejecución de modelos de inteligencia artificial. Es una salida distinta a la que suelen tomar otras compañías cuando necesitan respuestas instantáneas: en general, para ganar velocidad hay que resignar potencia y pasar a un modelo más chico o más especializado, entrenado para una tarea puntual. OpenAI sostiene que Ultrafast evita ese recorte y mantiene la capacidad de razonamiento de GPT-5.6 Sol incluso a la velocidad más alta.
El boletín de Onda Corta
Dónde se nota la diferencia
La compañía detalló los escenarios donde el salto de velocidad se nota. En la resolución de incidentes técnicos, permite cruzar en simultáneo los registros de una aplicación, el historial de cambios en el código y las notas que dejan los ingenieros, para llegar más rápido al origen de una caída. En soporte al cliente y en aplicaciones de voz, evita las pausas incómodas cuando el asistente necesita consultar varias fuentes antes de responder algo complejo. En el análisis financiero se usa para monitorear transacciones y movimientos de mercado y marcar posibles fraudes apenas ocurren, mientras que en tiendas online agiliza las consultas sobre stock, características de un producto o inconvenientes de pago antes de cerrar la compra.
Puertas adentro, ya lo usan
OpenAI aplicó Ultrafast primero en sus propios equipos. El área de investigación lo usa para cruzar fuentes, consultar datos y ordenar la información de las herramientas que tiene conectadas. Antes, era normal dejar un conjunto de pruebas corriendo toda la noche y recién ver qué había pasado al día siguiente; ahora, con Ultrafast, el equipo de investigación llega a repetir el experimento varias veces en una sola jornada. Los equipos de ingeniería que atienden fallas técnicas lo aprovechan de otra manera: repasan registros, sintetizan el hilo de una conversación y dan por buena una solución mucho más rápido que antes.


El boletín de Onda Corta