Nuevos Modelos
2026-08-14
El modelo más rápido de OpenAI no es un modelo más pequeño: es el mismo, ejecutándose en los chips de un rival
OpenAI abrió el 13 de agosto una vista previa limitada del modo Ultrafast: GPT-5.6 Sol servido a hasta 750 tokens de salida por segundo en la API, lo que la empresa cifra en hasta 14 veces su velocidad estándar. La velocidad no procede de un modelo destilado o recortado, sino del hardware de Cerebras, de modo que la salida debería ser el mismo Sol que ya usan los clientes. El acceso se limita a un pequeño grupo de clientes de la API mientras se amplía la capacidad, y OpenAI no ha publicado precios. La compañía señala como casos de uso la respuesta a incidentes, la atención al cliente, el análisis financiero y el comercio electrónico: cargas de trabajo donde el cuello de botella es la latencia y no la capacidad.
Por qué importaHasta ahora, obtener una respuesta rápida significaba aceptar una peor: un modelo más pequeño, un contexto más corto, un ajuste especializado. Separar velocidad de capacidad cambia qué productos son construibles: un agente que debe hacer veinte llamadas a herramientas antes de decir nada resulta inservible a velocidad estándar y del todo corriente a 750 tokens por segundo. El anuncio contiene además una admisión más discreta. El servicio de frontera más rápido de OpenAI corre sobre el silicio de un competidor, no sobre el de Nvidia ni sobre la infraestructura que la empresa está levantando con cientos de miles de millones de dólares.
✓ Verificado · 3 fuentes
▶ Vídeo relacionado: Why OpenAI Chose Cerebras Over NVIDIA for GPT-5.6 Sol
Léelo en la app — gratis, en 9 idiomas
Noticias relacionadas
El caballo de batalla barato de DeepSeek ya ve — y en tareas de agente que exigen ojos dice acercarse a lo mejor de Anthropic
2026-08-21Enséñaselo al robot una vez — de tres a doce segundos — y acierta 59 veces de cada 100 sin ningún entrenamiento
2026-08-21El modelo se inventa sus propias tareas, monta el banco de pruebas para medirlas y luego se entrena con el resultado; y DeepReinforce ha regalado los pesos
2026-08-20Un modelo gratuito que cabe en una sola tarjeta gráfica saca 52 — y luego gasta 22.276 tokens de pensamiento en dibujar una imagen
2026-08-18Zhipu no construyó un modelo nuevo. Siguió entrenando el viejo, y dice que programar mejoró un 50 por ciento
2026-08-17