Alibaba prepara un modelo de 10 billones de parámetros y clústeres con medio millón de chips

Alibaba prepara un modelo de 10 billones de parámetros y clústeres con medio millón de chips

Los próximos Qwen 4.5 y Qwen 5 se suman a una carrera por la infraestructura que va mucho más allá de los modelos.

image

Alibaba decidió aumentar de forma drástica las apuestas en la carrera por la inteligencia artificial y, al mismo tiempo, escala en tres niveles a la vez: modelos, sus propios procesadores y centros de datos.

El equipo Qwen ya está entrenando Qwen 4, y la compañía espera aumentar los futuros Qwen 4.5 y Qwen 5 hasta 5–10 billones de parámetros. Para comparar, el actual buque insignia Qwen 3.8 Max contiene 2,4 billones de parámetros. Alibaba quiere usar modelos de la próxima generación para tareas más complejas con horizontes de planificación largos y avanzar gradualmente hacia sistemas capaces de operar con mayor autonomía. La arquitectura del futuro Qwen 4 la compañía ya la está probando en modelos experimentales de la familia Qwen 3.8.

El número de parámetros por sí solo no muestra la calidad del modelo directamente. Especialmente inadecuada es la comparación simple para arquitecturas Mixture of Experts, donde al procesar cada token solo se activa una parte de la red total. Sin embargo, el crecimiento de 2,4 billones hasta el tope de 10 billones incrementa de forma marcada los requisitos de memoria, interconexiones e infraestructura de cómputo.

Bajo esa carga Alibaba presentó el nuevo acelerador Zhenwu V900, desarrollado por la división T-Head. La compañía afirma que el chip es tres veces más potente que su predecesor M890 y soporta la unificación de hasta 500.000 aceleradores en un solo clúster para entrenar y desplegar los modelos más grandes. La generación anterior Zhenwu M890 Alibaba la presentó en mayo junto con el sistema de servidores Panjiu AL128 de 128 aceleradores.

Zhenwu V900 debe entrar en producción en serie y en suministro comercial en el primer trimestre de 2027. La posibilidad de montar un clúster con 500.000 procesadores por ahora representa el límite superior de la arquitectura, no un sistema existente de ese tamaño. La escala, sin embargo, muestra bien la dirección de la industria china: Huawei reveló recientemente sus propios superclústeres con cientos de miles de aceleradores y planes de sistemas de aproximadamente un millón de procesadores.

Alibaba amplía al mismo tiempo la base energética para ese equipo. El director de la compañía, Eddie Wu, se propuso aumentar la potencia total de los centros de datos globales de Alibaba Cloud a más de 20 GW para 2032. La compañía ya se enfrenta a una situación en la que la demanda de cómputo para IA crece más rápido que la capacidad disponible, por lo que el despliegue comercial de nuevos supernodos de IA debe comenzar ya en el trimestre en curso. Además, los fabricantes chinos de aceleradores dependen cada vez más de la disponibilidad de memoria HBM, que se ha convertido en uno de los principales cuellos de botella de la industria.

Alibaba intenta controlar toda la cadena por sí misma: desde la arquitectura Qwen y el diseño de procesadores hasta servidores, red y centros de datos en la nube. Ese enfoque reduce la dependencia de Nvidia ante las restricciones de exportación de Estados Unidos y permite optimizar los modelos directamente para su propio hardware. En mayo T-Head afirmó que ya había entregado a clientes más de 560.000 procesadores Zhenwu de generaciones anteriores.

Planes de Alibaba fueron presentados el 22 de septiembre en la conferencia Apsara en Hangzhou. Tras el anuncio, las acciones de la compañía en Hong Kong subieron un 5,1% y alcanzaron un máximo de aproximadamente un mes. La escala de la futura infraestructura muestra que la siguiente fase de la competencia por la IA se desplaza cada vez más de modelos individuales y chips hacia la capacidad de vincular cientos de miles de aceleradores en un único sistema de cómputo.

La familia Qwen ya se vio envuelta en un episodio político-tecnológico inusual en Estados Unidos. En septiembre un modelo pequeño de Alibaba se detectó brevemente en el buscador del Registro Federal estadounidense, tras lo cual modos adicionales de búsqueda desaparecieron del sitio.

Paralelamente, Alibaba obtiene acceso a un enorme mercado de consumo a través de asociaciones. Apple prepara para usuarios chinos una versión separada de su plataforma de inteligencia, donde las tecnologías Qwen deberían convertirse en una de las bases de la infraestructura local de IA.

La carrera de las empresas chinas ahora se parece cada vez menos a una competición por el procesador más rápido. Los fabricantes compensan las limitaciones en el acceso a aceleradores occidentales avanzados con sus propios chips, interconexiones complejas y clústeres gigantes. Si Alibaba realmente se acercara al límite anunciado de 500.000 Zhenwu V900, la infraestructura sería comparable en escala con los proyectos de cómputo más ambiciosos de China.