OpenAI lanza Ultrafast, un modo que acelera GPT-5.6 hasta 14 veces
El nuevo sistema puede generar hasta 750 tokens por segundo y está pensado para aplicaciones que necesitan respuestas inmediatas
OpenAI presentó Ultrafast, un nuevo modo de ejecución diseñado para acelerar de forma significativa el funcionamiento de GPT-5.6 Sol y permitir que el modelo pueda utilizarse en aplicaciones que requieren procesamiento prácticamente en tiempo real.
Según informó la compañía, Ultrafast puede alcanzar una velocidad de ejecución de hasta 14 veces la del procesamiento estándar y generar hasta 750 tokens de salida por segundo.
La propuesta apunta especialmente a desarrolladores y empresas que necesitan utilizar modelos avanzados de inteligencia artificial en situaciones donde la latencia es determinante, pero que hasta ahora debían recurrir a modelos más pequeños o especializados para obtener respuestas suficientemente rápidas.
“Hasta ahora, acceder a velocidad en tiempo real significaba elegir un modelo más pequeño o más especializado. Ultrafast apunta a un progreso en una nueva dirección: más trabajo útil por segundo”, explicó OpenAI al presentar la tecnología.
Inteligencia artificial para trabajar en tiempo real
La velocidad se convirtió en uno de los principales desafíos para el desarrollo de aplicaciones basadas en modelos de inteligencia artificial cada vez más complejos.
Los modelos frontera pueden ejecutar tareas que requieren razonamiento, análisis de grandes cantidades de información y generación de respuestas extensas, pero esas capacidades también pueden implicar mayores tiempos de procesamiento.
Con Ultrafast, OpenAI busca reducir esa diferencia y permitir que GPT-5.6 Sol pueda intervenir en procesos donde unos pocos segundos pueden resultar determinantes.
La compañía puso como ejemplo la respuesta ante incidentes informáticos. Frente a un fallo crítico, el modelo podría analizar rápidamente archivos de registro y otra información disponible para identificar patrones y ayudar a determinar qué está ocurriendo.
Otro de los escenarios planteados es la investigación financiera, donde la velocidad permitiría analizar señales de mercado y detectar patrones prácticamente en tiempo real.
La capacidad también puede resultar relevante para asistentes interactivos, herramientas empresariales y sistemas en los que la inteligencia artificial debe procesar información mientras se desarrolla una determinada actividad, en lugar de trabajar únicamente sobre consultas estáticas.
El desafío de combinar capacidad y velocidad
El lanzamiento busca responder a una tensión que ha acompañado el desarrollo de los modelos de inteligencia artificial: cuanto mayores son sus capacidades, más recursos computacionales suelen necesitar para funcionar.
Para aplicaciones donde la respuesta inmediata es prioritaria, una alternativa habitual ha sido utilizar modelos más pequeños, capaces de procesar las solicitudes con mayor rapidez pero con capacidades más limitadas.
OpenAI plantea que Ultrafast puede modificar parcialmente esa ecuación al llevar un modelo frontera a velocidades que permiten pensar en nuevos usos en tiempo real.
La compañía resume el objetivo como conseguir una mayor cantidad de “trabajo útil por segundo”, en lugar de obligar a los desarrolladores a elegir únicamente entre capacidad y velocidad.
El modo está diseñado específicamente para GPT-5.6 Sol, el modelo frontera presentado por OpenAI a comienzos de julio.
La novedad llega, además, pocos días después de que la compañía presentara GPT-5.6 Cyber, una variante orientada a tareas avanzadas relacionadas con la ciberseguridad.
Por ahora, acceso limitado
Ultrafast todavía no tendrá una disponibilidad generalizada.
OpenAI explicó que el nuevo modo se encuentra inicialmente en fase de vista previa para un grupo limitado de clientes, mientras continúa evaluando su funcionamiento y aumentando la capacidad disponible.
La intención de la compañía es ampliar progresivamente el acceso a medida que pueda disponer de mayor infraestructura para sostener este nivel de procesamiento.
La llegada de Ultrafast abre así otro frente en la evolución de la inteligencia artificial generativa. La carrera ya no pasa únicamente por desarrollar modelos capaces de resolver tareas cada vez más complejas, sino también por conseguir que puedan hacerlo a una velocidad suficiente como para integrarse en procesos que ocurren en tiempo real.
Con velocidades de hasta 750 tokens por segundo, OpenAI busca que GPT-5.6 Sol pueda pasar de responder consultas a intervenir de forma mucho más inmediata en sistemas y aplicaciones donde cada segundo cuenta.
Con información de Europa Press.
Acerca de los comentarios
Hemos reformulado nuestra manera de mostrar comentarios, agregando tecnología de forma de que cada lector pueda decidir qué comentarios se le mostrarán en base a la valoración que tengan estos por parte de la comunidad. AMPLIAREsto es para poder mejorar el intercambio entre los usuarios y que sea un lugar que respete las normas de convivencia.
A su vez, habilitamos la casilla [email protected], para que los lectores puedan reportar comentarios que consideren fuera de lugar y que rompan las normas de convivencia.
Si querés leerlo hacé clic aquí[+]