En Hot Chips 2026, Google ha desvelado su octava generación de TPU, presentando dos variantes: la TPU 8t, enfocada en entrenamiento, y la TPU 8i, diseñada para inferencia. Ambas están optimizadas para arquitecturas de mezcla de expertos (MoE) y contextos largos, una respuesta directa a las demandas actuales del sector. La propuesta busca consolidar el hardware propietario como pilar del cómputo de IA.
Arquitectura Axion y memoria: La apuesta por la inferencia 🚀
La TPU 8i se distingue por priorizar un ancho de banda HBM y SRAM superior, elementos clave para reducir la latencia en modelos generativos. Un detalle relevante es que esta variante se apoya en CPUs Axion de diseño propio, basadas en arquitectura Arm. Esta combinación permite ejecutar pipelines de IA generativa y tareas de renderizado con mayor fluidez, moviendo el cuello de botella desde la memoria hacia el cómputo real, un cambio que los profesionales del sector notarán en sus flujos diarios.
El vecino que siempre tiene el hardware más nuevo 😅
Mientras el resto intenta cuadrar presupuestos para una GPU, Google saca dos TPU nuevas como quien cambia de móvil. La 8t y la 8i llegan con la naturalidad de quien tiene un supercomputador en el bolsillo, y la 8i encima se trae a sus CPUs Axion de la mano. Es como si el vecino del piso de arriba, además de tener la mejor consola, también tuviera el mando con mejor agarre. Da un poco de envidia, pero al menos sabemos que el futuro del renderizado va en serio.