Alibaba presenta el Zhenwu V900: 216 GB por tarjeta, clústeres de 500.000 chips y 20 GW de centros de datos en el horizonte
El Alibaba Zhenwu V900 es el nuevo chip de IA de la empresa china: entrena e infiere con 216 GB de memoria por tarjeta, clústeres de hasta 500.000 unidades y la meta de 20 GW de centros de datos en 2032. Estas son las cifras y la letra pequeña.
Qué anunció Alibaba en la Apsara Conference 2026
El 22 de septiembre de 2026, en la Apsara Conference de Alibaba Cloud en Hangzhou, el consejero delegado Eddie Wu presentó el acelerador Zhenwu V900, desarrollado por T-Head (Pingtouge), la unidad de semiconductores del grupo. Alibaba lo describe como el chip de IA más potente de China; la prensa especializada recoge el anuncio, pero no existe ninguna medición independiente publicada.
El Zhenwu V900: entrenar e inferir con el mismo chip
El V900 unifica las dos fases de la IA: el mismo acelerador entrena modelos y después los sirve a los usuarios, en lugar de vender hardware distinto para cada fase. La empresa afirma que rinde tres veces más que su generación anterior, el Zhenwu M890, descrito por la prensa especializada con 144 GB de HBM y una arquitectura PPU con núcleo Transformer. Es una comparación contra su propio chip, no contra Nvidia.
216 GB por tarjeta, 1.200 GB/s de interconexión y clústeres de hasta 500.000 tarjetas
Las cifras sobre la mesa: 216 GB de memoria por tarjeta, 1.200 GB/s de ancho de banda de interconexión entre chips, soporte nativo de cómputo de baja precisión FP8 y FP4, y despliegues de hasta 500.000 tarjetas. Son datos de fabricante repetidos por la prensa: una ficha comercial, no una ficha auditada.
Lee también
Producción en masa en el primer trimestre de 2027 y un J900 previsto para 2028
El V900 no se vende hoy: la producción en masa está prevista para el primer trimestre de 2027. En el mismo evento se adelantó un Zhenwu J900 con arquitectura de cómputo paralelo propia para marzo de 2028 y nuevas CPUs de servidor Yitian para el tercer trimestre de 2027. Todo escrito en futuro.
Los números frente a la letra pequeña
El "tres veces más" es contra el M890, el chip anterior de Alibaba
El multiplicador se mide contra la generación previa de la propia empresa. No es "tres veces más que una GPU de gama alta de Nvidia": no hay benchmark que lo sostenga, y triplicar el rendimiento declarado entre generaciones propias es lo esperable en dos años de trabajo, no una revolución.
Los 141 GB de la H200: una comparación de capacidad, no de rendimiento
Varias notas destacan que los 216 GB del V900 superan los 141 GB de la H200 de Nvidia. Es una comparación de memoria contra un chip de la generación Hopper anterior: más memoria permite que quepa un modelo más grande sin repartirlo entre tarjetas, pero no dice nada de velocidad de cálculo ni de eficiencia energética.
Lee también
Lo que nadie independiente ha medido todavía
A septiembre de 2026 no hay benchmarks de terceros, ni precio por tarjeta, ni disponibilidad comercial, ni cifras de coste por token. Lo único publicable es lo declarado por la empresa y lo que la prensa recogió citándola.
Por qué la memoria manda en un chip de IA
Capacidad por tarjeta, ancho de banda y formatos de baja precisión
El límite práctico de los modelos grandes suele estar en la memoria antes que en los FLOPS: de poco sirven manos rapidísimas si el modelo no cabe en la mesa de trabajo y hay que traerlo por un pasillo estrecho en cada paso. Los formatos FP8 y FP4 reducen el espacio de cada peso y aceleran las operaciones, a cambio de una precisión que se compensa durante el entrenamiento.
Qué implica un clúster de cientos de miles de aceleradores
A esa escala el problema no son las tarjetas, sino la red, la refrigeración, la energía y el software de orquestación. La cifra de 500.000 unidades es sobre todo una declaración sobre el tamaño al que Alibaba quiere operar su propia nube.
La pila completa: no es un chip, es una estrategia
Servidores Panjiu, CPUs Yitian y centros de datos
El anuncio incluye los servidores de supernodo Panjiu, la hoja de ruta de CPUs Yitian y la infraestructura que los aloja. Controlar chip, servidor, nube y modelo permite ajustar coste y rendimiento en toda la cadena, algo que un cliente que solo compra GPUs no puede hacer.
Modelos Qwen de 5 a 10 billones de parámetros y su efecto en la API
Eddie Wu habló de modelos Qwen de próxima generación en el rango de 5 a 10 billones de parámetros: es un plan declarado, no un modelo publicado. Si llega, más oferta de modelos abiertos grandes es presión a la baja sobre el precio de la API.
Más de 20 GW para 2032 y el gasto ya reportado
Alibaba dice que quiere operar más de 20 GW de capacidad global de centros de datos en 2032 y anuncia inversiones superiores a 53.000 millones de dólares en tres años. Es plan, no gasto ejecutado: lo contabilizado es el capex del trimestre de junio, 67.700 millones de yuanes, un 75 % más que un año antes.
El contexto incómodo: los controles de exportación
Los controles de exportación de Estados Unidos dejan a Nvidia fuera del segmento alto del mercado chino, y ese hueco es la razón de ser del V900: comparar "en igualdad de condiciones" no tiene sentido cuando el rival no puede vender allí su tope de gama. La semana pasada Huawei adelantó su Ascend 960DT, así que la competencia real hoy es entre fabricantes chinos por ocupar el espacio que dejó la restricción.
Qué cambia para quien desarrolla con IA
Más cómputo chino en la nube y portabilidad de modelos
Para quien programa, lo relevante es qué aparece en el catálogo de la nube: más capacidad en China significa más competencia en cómputo alquilado, con efecto indirecto para quien está fuera de Asia. El anuncio solo cierra con Qwen en la ecuación, chip, nube y modelos propios, lo que refuerza la convención de mantener el código de inferencia portable entre APIs.
Cómo leer un anuncio de hardware sin creerse la diapositiva
Tres preguntas bastan: contra qué producto se mide la mejora declarada, si existe una medición independiente y cuándo se puede comprar. Si las respuestas son "contra el nuestro", "no" y "en unos trimestres", se está leyendo una hoja de ruta, no un producto.
Conclusión
El Zhenwu V900 es un anuncio serio con cifras concretas y también un conjunto de promesas a varios años. Lo sólido: la memoria por tarjeta, la unificación de entrenamiento e inferencia y una pila que va del chip al modelo. Lo que falta: producción en 2027, benchmarks independientes y precios. El rastro de este terreno se sigue en el análisis del Ascend 960DT de Huawei, en el repaso a la batalla de chips de IA y en la nota sobre Qwen3.8-27B. El blog sigue cubriendo la tecnología con criterio: vuelve si te interesan el hardware y la infraestructura de IA.


