OpenAI anunció Ultrafast, un nuevo nivel de servicio dentro de su API que permite que el modelo GPT-5.6 Sol procese información hasta 14 veces más rápido que el modo estándar, alcanzando una velocidad de hasta 750 tokens de salida por segundo. La compañía explicó que esta capacidad es posible gracias a su alianza con Cerebras, el fabricante de chips especializados en inferencia de baja latencia con el que OpenAI ya venía colaborando desde meses antes.
Velocidad sin perder inteligencia
Según la propia OpenAI, hasta ahora conseguir respuestas en tiempo real solía implicar sacrificar capacidades y optar por modelos más pequeños o especializados. Con Ultrafast, la empresa asegura romper esa disyuntiva al mantener el nivel de razonamiento de su modelo más avanzado mientras multiplica su velocidad de respuesta. Para dar una idea de la magnitud del salto, algunos análisis del sector ubican a Claude Opus 4.8 en torno a 55 tokens por segundo, mientras que GPT-5.6 Sol en modo estándar rondaría entre 75 y 100 tokens por segundo, lo que hace que la velocidad de Ultrafast resulte considerablemente superior a la de sus competidores directos.
Casos de uso durante la fase de prueba
OpenAI detalló que ya está probando esta tecnología junto a un grupo inicial de empresas en sectores como programación, comercio electrónico, investigación financiera y atención al cliente. Entre los ejemplos mencionados destaca la respuesta a incidentes críticos de sistemas, donde equipos de ingeniería pueden analizar registros, cambios de código y reportes en cuestión de segundos para diagnosticar fallas mientras estas todavía están ocurriendo. También se probó en investigación financiera, para detectar actividad sospechosa en transacciones en tiempo real, y en experimentos de investigación que antes requerían ejecuciones nocturnas y que ahora pueden convertirse en sesiones de trabajo interactivas.
Acceso limitado por ahora
Por el momento, Ultrafast se encuentra disponible únicamente en una vista previa restringida para un grupo selecto de clientes, y OpenAI ha indicado que ampliará el acceso de manera progresiva conforme aumente su capacidad de infraestructura [web:22]. Este lanzamiento se da además en un contexto donde GPT-5.6 Sol ya venía destacando en distintos comparativos independientes, posicionándose como líder en pruebas de agentes de programación como el índice de Artificial Analysis, gracias en parte a su arquitectura de subagentes que trabajan en paralelo.