Enlace

ChatGPT Ultrafast ↗

OpenAI:

Today, we’re sharing an early look at Ultrafast, a new service tier that runs GPT‑5.6 Sol up to 14× faster than Standard processing, launching first in the OpenAI API. Powered by Cerebras, Ultrafast generates up to 750 output tokens per second, bringing our most intelligent model to products and workflows where every second matters.

Como punto de referencia, Fable 5 anda en 52tps, y GPT 5.6 Sol en 61.5tps.

Cerebras es uno de los líderes en el campo. Groq también es un jugador a tener en la mira. Y recuerda que hace 2 meses OpenAI y Broadcom anunciaron un chip de inferencia diseñado específicamente para GPT.

Estamos por entrar en la era de la aceleracón de inferencia. Modelos más grandes, corriendo más rápido. Curiosamente, el anuncio de OpenAI no menciona precios, y la disponibilidad de Ultrafast está limitada a “un grupo selecto de clientes”.

Comparto enlaces y analisis como este regularmente. Recíbelos por correo.