Google planea un chip de IA v2 “Congelado” para integrar la arquitectura de Gemini, lo que podría aumentar la eficiencia de la inferencia 6-10 veces para 2028.

Según Beating, Google está desarrollando el chip de inferencia de IA Frozen v2, que integrará parte de la arquitectura de Gemini directamente en el hardware para reducir la carga computacional y el traslado de datos durante la ejecución del modelo. Se espera que el chip procese entre 6 y 10 veces más tokens por vatio que el último TPU de Google, con despliegue previsto tan pronto como en 2028.

La iniciativa busca hacer frente a la empeorante escasez de chips de Google, que ya ha obligado a Google Cloud a rechazar pedidos de clientes externos. Frozen v2 funcionará junto con TPU; mientras que TPU admite varios modelos, Frozen v2 prioriza la eficiencia sobre la flexibilidad.

Aviso legal: La información en esta página puede provenir de fuentes de terceros y es solo para referencia. No representa las opiniones ni puntos de vista de Gate y no constituye asesoramiento financiero, de inversión ni legal. El comercio de activos virtuales implica un alto riesgo. No te bases únicamente en la información presentada en esta página para tomar decisiones. Para más detalles, consulta el Aviso legal.
Comentar
0/400
Sin comentarios