OpenAI ha lanzado ‘Ultrafast’, un nuevo modo para su modelo GPT-5.6 Sol que promete trabajar 14 veces más rápido que el procesamiento estándar, alcanzando hasta 750 tokens por segundo. Esta innovación, impulsada por la asociación con Cerebras, está diseñada para aplicaciones empresariales como respuesta a incidentes, atención al cliente y análisis de mercados financieros, y rivaliza con las ofertas aceleradas de Anthropic.
***
- OpenAI introduce ‘Ultrafast’, un modo que hace que GPT-5.6 Sol procese 14 veces más rápido, llegando a 750 tokens por segundo.
- La función está en vista previa para un grupo reducido de clientes y se expandirá a medida que crezca la capacidad, gracias a la colaboración con Cerebras.
- El modo Ultrafast se orienta a flujos de trabajo corporativos como respuesta a incidentes, servicio al cliente, análisis de mercados financieros y comercio electrónico.
Si alguna vez deseaste que ChatGPT respondiera un poco más rápido, parece que OpenAI está respondiendo a tus plegarias. El laboratorio de inteligencia artificial ha lanzado un nuevo modo llamado Ultrafast, que según la compañía está diseñado para acelerar seriamente el ritmo al que su modelo más reciente y potente, GPT-5.6 Sol, lleva a cabo su trabajo.
Según informó TechCrunch, Ultrafast puede trabajar 14 veces más rápido que el procesamiento estándar, entregando hasta 750 tokens de salida por segundo, esas piezas discretas de texto que genera un modelo de lenguaje cuando interactúa con un humano.
“Hasta ahora, obtener velocidad en tiempo real normalmente significaba elegir un modelo más pequeño o más especializado”, señaló la compañía en una publicación de blog el jueves. “Ultrafast apunta al progreso en una nueva dirección: más trabajo útil por segundo”. Este movimiento responde a una demanda creciente por respuestas casi instantáneas en entornos donde la latencia puede ser crítica, como el trading algorítmico o el soporte al cliente de alta exigencia.
¿Qué es Ultrafast y cómo funciona?
Ultrafast es un modo operativo que modifica la forma en que GPT-5.6 Sol ejecuta su procesamiento, optimizando la generación de tokens para alcanzar velocidades nunca antes vistas en un modelo de escala completa. La clave está en la colaboración con Cerebras, fabricante de chips especializados en inferencia de IA, cuyos procesadores masivos permiten reducir drásticamente los cuellos de botella. La compañía afirma que el modo entrega hasta 750 tokens por segundo, una cifra que cuadruplica lo que ofrecen la mayoría de los modelos comerciales actuales.
Esta aceleración no sacrifica la calidad del texto generado, según OpenAI, sino que aprovecha arquitecturas de hardware y software optimizadas para flujos de trabajo específicos. El modo está diseñado para tareas que requieren respuestas inmediatas, como análisis de mercado en vivo, detección de intrusiones o atención al cliente con grandes volúmenes de consultas. No se trata de una simple optimización de compilación, sino de una reingeniería del pipeline de inferencia, lo que explica su asociación con Cerebras.
La vista previa de Ultrafast se está lanzando gradualmente para un grupo selecto de clientes empresariales, quienes ya pueden probar el modo en sus entornos. OpenAI asegura que ampliará el acceso a medida que “crezca la capacidad”, lo que sugiere que la infraestructura aún está en expansión. La compañía no ha revelado detalles sobre los costos adicionales, pero se espera que el prestigio de esta funcionalidad la posicione como una oferta premium dentro de su portafolio.
Casos de uso corporativos
OpenAI sugiere que esta versión de alto octanaje de GPT-5.6 Sol puede implementarse en una serie de flujos de trabajo corporativos diferentes, especialmente en respuesta a incidentes, servicio y soporte al cliente, análisis de mercados financieros y comercio electrónico. En el ámbito financiero, la velocidad es esencial para procesar noticias, informes y datos en tiempo real, y poder generar resúmenes ejecutivos en milisegundos cambiaría las reglas del juego. Por ejemplo, un sistema que analice tweets corporativos o reportes trimestrales podría responder a movimientos del mercado antes que sus competidores, ofreciendo ventajas tácticas.
En el sector de soporte, los bots impulsados por Ultrafast podrían manejar conversaciones simultáneas con miles de usuarios sin retrasos perceptibles, mejorando la experiencia del cliente y reduciendo costos operativos. La capacidad de generar 750 tokens por segundo implica que un párrafo de respuesta se produce en menos de un segundo, lo que hace que la interacción sea prácticamente instantánea. Esto es crucial en escenarios de crisis, donde cada segundo cuenta para mitigar daños reputacionales o financieros.
El comercio electrónico, otro campo mencionado, se beneficiaría de descripciones de productos, recomendaciones personalizadas y atención al cliente en tiempo real, todo sin fricciones. OpenAI también destaca la utilidad en análisis de contratos, generación de código y cualquier tarea que requiera iteración rápida. La versatilidad del modo lo convierte en una herramienta transversal para equipos que demandan inteligencia artificial de alta disponibilidad.
Competencia en el mercado de IA acelerada
Los competidores de OpenAI, como Anthropic, han lanzado de manera similar versiones aceleradas de sus modelos. Claude tiene un modo rápido, aunque no ofrece la velocidad que OpenAI está ofreciendo aquí, según TechCrunch. Anthropic ha priorizado la eficiencia en otros aspectos, pero no ha logrado alcanzar las cifras de tokens por segundo que presenta Ultrafast. Esta diferencia podría ser un factor decisivo para empresas que dependen de la baja latencia en sus operaciones críticas.
La comparación no es solo técnica, sino estratégica. OpenAI está apostando por una integración profunda con hardware especializado, mientras que Anthropic se ha enfocado más en optimizaciones de software. El enfoque de Cerebras ha demostrado ser efectivo en modelos a gran escala, y la asociación con OpenAI podría crear una barrera competitiva difícil de superar. Aunque otros jugadores como Google o Meta también desarrollan aceleradores, ninguno ha anunciado públicamente velocidades comparablemente altas para modelos de última generación.
En este escenario, la velocidad se consolida como un nuevo campo de batalla en la industria de la IA. Las aplicaciones que exigen decisiones en fracciones de segundo, como el trading de alta frecuencia, están demandando cada vez más estos avances. OpenAI toma la delantera, pero el mercado es dinámico y las respuestas de los rivales no se harán esperar, especialmente si logran replicar o superar estas cifras.
Disponibilidad y perspectivas futuras
Ultrafast, que actualmente se está lanzando en vista previa, está impulsado por la asociación de OpenAI con el fabricante de chips Cerebras. Solo un grupo reducido de clientes tiene acceso por ahora, pero la compañía tiene planes de expandir la disponibilidad a medida que la capacidad de su infraestructura crezca. Esto implica que la tecnología aún está en una fase de pruebas, y no se sabe cuándo estará disponible para el público general o para planes estándar.
La decisión de limitar el acceso responde probablemente a la necesidad de validar el modo en entornos reales y ajustar posibles errores antes de una implementación masiva. Además, la demanda de los clientes actuales podría estar copando los recursos disponibles, lo que obliga a una distribución escalonada. OpenAI ha repetido este patrón con otras funciones, como la modalidad de voz avanzada o las herramientas de análisis de datos, que iniciaron en beta para socios selectos.
En cuanto a las implicaciones estratégicas, Ultrafast podría cambiar la dinámica de precios en la nube de IA, ya que un mayor rendimiento por segundo podría traducirse en un costo por token menor a largo plazo. Si la escalabilidad se confirma, OpenAI podrá ofrecer servicios de IA cuasi instantáneos a una escala masiva, lo que atraería a empresas que actualmente dependen de soluciones más lentas. El tiempo dirá si esta velocidad se convertirá en el estándar de la industria, pero por ahora, OpenAI ha plantado una bandera clara en la carrera por la IA más rápida del mercado.
La noticia de TechCrunch ha generado expectativas en la comunidad tecnológica, que ve en Ultrafast un paso hacia la reducción de la latencia en modelos de lenguaje. Los desarrolladores y arquitectos de software ya están imaginando aplicaciones que antes eran inviables por los tiempos de espera, desde generación de código en tiempo real hasta juegos interactivos basados en texto. El futuro, sin duda, será más veloz.
Imagen original de DiarioBitcoin, creada con inteligencia artificial, de uso libre, licenciada bajo Dominio Público.
Este artículo fue escrito por un redactor de contenido de IA y revisado por un editor humano para garantizar calidad y precisión.
ADVERTENCIA: DiarioBitcoin ofrece contenido informativo y educativo sobre diversos temas, incluyendo criptomonedas, IA, tecnología y regulaciones. No brindamos asesoramiento financiero. Las inversiones en criptoactivos son de alto riesgo y pueden no ser adecuadas para todos. Investigue, consulte a un experto y verifique la legislación aplicable antes de invertir. Podría perder todo su capital.
Suscríbete a nuestro boletín
Artículos Relacionados
Adopción
Chime Financial estudia integrar stablecoins a su app de banca móvil
Empresas
GM y LG reanudan baterías en Ohio tras siete meses de parada, pero el mercado EV sigue tambaleante
IA
Agentes de IA de Anthropic se declaran la guerra al compartir una misma tarea
Bitcoin