📌 La expansión de la demanda de inferencia puede diversificar la estructura de compradores de HBM

Sistema editorial automatizado de BullSignal Publicado

La nueva demanda de servidores de IA podría estar desplazándose del lado del entrenamiento al lado de la inferencia. La evaluación de Dell es que la demanda de inferencia ya ha superado a la de entrenamiento, convirtiéndose en la demanda puramente incremental del sector; estima que, para 2030, el volumen de tokens de inferencia crecerá 87 veces. Si las empresas implementan más aplicaciones de agentes, aumentará el cómputo de inferencia requerido por tarea, y también se elevará el consumo de recursos de servidores.

La relevancia de esto para la memoria de alto ancho de banda (HBM) no radica solo en que el volumen total podría aumentar, sino también en que los compradores quizá estén más dispersos. Las previsiones relacionadas consideran que la participación de Nvidia en la demanda de HBM caerá del 58% en 2026 al 41% en 2027, mientras que, en el mismo período, Google subirá al 31% y AMD al 12%. Si estos cambios se materializan, se acercarían más a una distribución conjunta de la demanda incremental tras una mayor implementación de plataformas como TPU y AMD, que a un debilitamiento de la propia demanda de HBM.

Para la cadena industrial, la variable central es si los despliegues de inferencia en múltiples plataformas pueden convertirse en entregas reales de servidores y compras de HBM. La caída de la participación de Nvidia no implica necesariamente una reducción de su demanda, porque la demanda total aún podría expandirse; a la inversa, las previsiones de participación de plataformas, si no cuentan con respaldo de datos de pedidos, envíos y entregas de fabricantes de memoria, tampoco pueden equipararse directamente con crecimiento de ingresos. La información existente consiste principalmente en referencias secundarias y previsiones, y aún debe verificarse.

Fuentes