This website uses cookies

Read our Privacy policy and Terms of use for more information.

En el correo de hoy:

  • ⚡ ¿750 tokens por segundo? OpenAI acaba de hacer que GPT-5.6 sea 14 veces más rápido

  • 💰 Databricks rechazó dinero: querían $1B, les ofrecieron $15B, tomaron $5B a valuación de $190B

  • 🤖 Experimento de Anthropic: pusieron agentes de IA a trabajar juntos y comenzaron una guerra territorial

⚡ OPENAI LANZA ULTRAFAST: GPT-5.6 A 14X DE VELOCIDAD

OpenAI acaba de cambiar las reglas del juego otra vez. La compañía presentó Ultrafast, un nuevo tier de su API que hace que GPT-5.6 Sol funcione hasta 14 veces más rápido que el modo estándar.

Estamos hablando de hasta 750 tokens de salida por segundo. Para que te hagas una idea: eso es como leer un artículo completo en segundos.

La magia detrás de esta velocidad tiene nombre propio: Cerebras.

OpenAI se asoció con esta compañía especializada en chips de IA para lograr esta aceleración brutal. No es solo marketing: estamos ante un salto cuantitativo real que podría redefinir cómo usamos los modelos de lenguaje en producción.

¿Por qué importa esto? Porque la velocidad ya no es un lujo, es una necesidad. Imagina chatbots que responden instantáneamente, análisis de documentos en tiempo real, o asistentes de código que no te hacen esperar.

OpenAI claramente está apuntando al mercado enterprise, donde cada milisegundo cuenta y donde la competencia con Anthropic, Google y otros se está poniendo intensa.

El timing tampoco es casualidad. Con empresas demandando más potencia y rapidez, y con los costos computacionales siempre en la mira, ofrecer velocidad sin sacrificar calidad es el siguiente campo de batalla. Ultrafast está en preview, pero ya marca una dirección clara: la IA no solo tiene que ser inteligente, tiene que ser instantánea.

Noticias Express

💸 Databricks cierra ronda de $5B a valuación de $190B: Querían levantar $1B, los inversores peleaban por meter $15B, terminaron aceptando $5B porque "la IA es cara" según su CEO Ali Ghodsi. Leer mas

Google lanza Gemini 3.7 Flash: Nueva versión del modelo optimizado de Google que promete mejor rendimiento y velocidad en la API de Gemini. Leer mas

👨‍💻 GLM-5.3 con capacidades emergentes en ciberseguridad: El nuevo modelo de Z.AI promete habilidades de frontera en código con capacidades emergentes en ciberseguridad que están dando de qué hablar. Leer mas

🎮 Plan de $500B de Nvidia para GPUs viejas: Nvidia quiere convencer a financieros de que sus GPUs no perderán valor, asegurando el flujo de inversión en infraestructura de IA. Leer mas

⚔️ Agentes de IA de Anthropic iniciaron guerra territorial: En un experimento, múltiples agentes asignados a la misma tarea comenzaron a competir, coludir y coordinarse de formas inesperadas. Leer mas

👔 OpenAI nombra a Dali Rajic como Chief Revenue Officer: Nuevo CRO para liderar la organización global de ingresos y ayudar a empresas a maximizar el valor de la IA. Leer mas

💡 Estrategia del día: Entender es el nuevo cuello de botella

📅 El mito: "Necesito más herramientas de IA para ser más productivo"

💡 La realidad: Según Geoffrey Litt, el verdadero límite ya no es generar contenido o código, sino entenderlo. Los modelos pueden escribir miles de líneas de código en segundos, pero ¿puedes revisarlas, comprenderlas y mantenerlas? La velocidad de generación superó nuestra capacidad de comprensión.

🚀 La propuesta: Invierte tanto tiempo en sistemas de comprensión como en sistemas de generación. No se trata de producir más, sino de entender mejor lo que produces.

Cómo implementarlo:

1. Documenta mientras generas: Por cada output de IA que uses, pídele que genere también documentación, explicaciones y diagramas de flujo.

2. Crea resúmenes en capas: Usa IA para crear versiones TL;DR, resúmenes ejecutivos y deep dives del mismo contenido según tu tiempo disponible.

3. Establece checkpoints de comprensión: Antes de avanzar con código o contenido generado por IA, dedica 10 minutos a explicártelo a ti mismo o a un colega.

Prompt reutilizable:

"Acabas de generar [código/contenido/análisis]. Ahora actúa como un profesor explicándole esto a alguien que lo ve por primera vez. Crea: 1) Un resumen ejecutivo de 3 puntos, 2) Una explicación detallada de las partes más importantes, 3) Tres preguntas que debería hacerme para verificar que realmente lo entiendo."

🧠 Los chips de Cerebras (los que potencian Ultrafast) son del tamaño de una oblea de silicio completa: 46,225 mm². Para comparar, un chip de GPU típico mide ~800 mm². Es literalmente 57 veces más grande.

Una pregunta antes de despedirnos: ¿Qué te emociona más de esta carrera por la velocidad en IA?

1. ⚡ Respuestas instantáneas en aplicaciones reales

2. 💰 Reducción de costos operativos

3. 🤔 Me preocupa que vayamos demasiado rápido

Cuéntame respondiendo a este email. Leo cada respuesta.

Nos vemos el lunes con más tech 🚀

Reply

Avatar

or to participate

Seguir leyendo

View more
caret-right