UX3607 ZB A16 BannerPCS BTS Banner
Google estaría desarrollando un chip especializado para Gemini capaz de multiplicar la eficiencia de sus TPU

Google estaría desarrollando un chip especializado para Gemini capaz de multiplicar la eficiencia de sus TPU

por Edgar Otero

Google estaría desarrollando un nuevo chip para centros de datos diseñado específicamente alrededor de Gemini, similar al Jalapeño de OpenAI. El proyecto, conocido internamente como Frozen v2, buscaría integrar parte de la arquitectura del modelo directamente en el silicio para reducir el número de operaciones necesarias durante la inferencia y mejorar tanto la velocidad de respuesta como el consumo energético.

La información procede de The Information, que cita a dos personas con conocimiento directo del proyecto. Según esas fuentes, los ingenieros de Google estiman que el chip podría procesar entre seis y diez veces más tokens por vatio que la generación más reciente de TPU de la compañía. Su posible despliegue se situaría a partir de 2028, aunque Google no ha confirmado que llegue finalmente a producción.

La idea parte de una diferencia importante frente a una TPU convencional. Una TPU puede ejecutar distintos modelos cargados sobre el hardware, lo que obliga al sistema a tomar numerosas decisiones durante el procesamiento y a mover grandes cantidades de datos. Frozen v2 intentaría evitar parte de ese trabajo fijando en los transistores determinadas decisiones estructurales propias de Gemini.

Con este enfoque, el chip podría reducir la latencia y aumentar la eficiencia en tareas de inferencia, es decir, cuando un modelo ya entrenado genera respuestas. El objetivo no sería sustituir a toda la familia TPU, sino crear una solución más especializada para determinadas cargas de Gemini, especialmente en servicios donde el volumen de consultas y el coste energético son factores decisivos.

Google habría descartado fijar los pesos completos del modelo

Una primera versión del proyecto habría ido más lejos. El diseño original, impulsado por el científico jefe de Google DeepMind, Jeff Dean, contemplaba incorporar directamente los pesos de Gemini en el chip. Esa propuesta habría ofrecido un nivel de especialización todavía mayor, pero también habría dejado el hardware ligado a una versión concreta del modelo con una vida útil limitada.

Google habría optado finalmente por mantener actualizables los pesos y fijar solo parte de la arquitectura. De esta forma, Frozen v2 podría seguir utilizándose con varias versiones de Gemini mientras compartan una estructura común. La compañía todavía estaría decidiendo qué porcentaje exacto del modelo quedaría bloqueado en el silicio y qué partes continuarían siendo configurables por software.

La producción prevista sería mucho menor que la de las TPU tradicionales. Google consideraría esta generación como una prueba para valorar hasta qué punto merece la pena avanzar hacia chips más estrechamente vinculados a modelos concretos. Frozen v2 conviviría con las TPU de octava generación, que ya se dividen en variantes separadas para entrenamiento e inferencia.

La escasez de capacidad de cálculo estaría acelerando el proyecto

El desarrollo también respondería a la presión sobre la infraestructura de IA de Google. Según la información publicada, Google Cloud habría llegado a rechazar contratos con clientes externos por falta de capacidad disponible. Un chip más eficiente permitiría atender más consultas con el mismo consumo y ampliar la capacidad útil de los centros de datos sin depender únicamente de nuevas instalaciones.

Como ya apuntábamos mencionando a OpenAI al inicio de esta noticia, la especialización extrema del silicio ya ha aparecido en otros proyectos. La empresa canadiense Taalas presentó en febrero su chip HC1, con Llama 3.1 8B integrado de forma permanente en una matriz fabricada por TSMC. NVIDIA, por su parte, cerró un acuerdo para licenciar tecnología de Groq, otra compañía centrada en aceleradores de inferencia. Frozen v2 encajaría así en una tendencia hacia chips más adaptados a modelos y tareas concretas.

Google ha evitado confirmar el proyecto y ha señalado que no todas sus líneas de investigación terminan convirtiéndose en productos. Por ahora, Frozen v2 seguiría en fase de desarrollo y evaluación. Si alcanza la producción en 2028, supondría un cambio relevante en la forma de diseñar hardware para Gemini, con una parte mayor del modelo trasladada desde el software hacia la propia estructura física del chip.

Fin del Artículo. ¡Cuéntanos algo en los Comentarios!

Redactor del Artículo: Edgar Otero

Edgar Otero

Soy técnico en sistemas informáticos, empecé a experimentar un Pentium II, aunque lo mío siempre ha sido el software. Desde que actualicé de Windows 95 a Windows 98 no he dejado de instalar sistemas. Tuve mi época Linuxera y fui de los que pidió el CD gratuito de Canonical. Actualmente uso macOS para trabajar y tengo un portátil con Windows 11 en el que también he instalado Chrome OS Flex. En definitiva, experimentar, probar y presionar botones.

Comentarios y opiniones sobre: Google estaría desarrollando un chip especializado para Gemini capaz de multiplicar la eficiencia de sus TPU ¿Qué opinas? ¿Alguna pregunta?
NitroV16 AI Banner