DeepSeek supuestamente planea un clúster de Huawei de 160.000 chips para inferencia de IA, lo que señala un gran esfuerzo chino por reducir la dependencia del hardware de Nvidia.

Según informes, DeepSeek planea desplegar al menos 160.000 procesadores de IA de Huawei en un centro de datos en Mongolia Interior, un proyecto que podría convertirse en el mayor clúster de chips Huawei conocido si se completa. El sistema propuesto se utilizaría para inferencia y no para entrenamiento de modelos, según una información citada por The Decoder, lo que marca un cambio potencialmente importante en la forma en que las empresas chinas de IA están construyendo sus sistemas frente a las restricciones sobre el hardware de Nvidia.
El plan se centra en los procesadores Ascend-950DT de próxima generación de Huawei. En la evidencia proporcionada no se presenta como un pedido completado, un despliegue operativo ni un anuncio confirmado públicamente por DeepSeek o Huawei. En cambio, los informes describen una construcción prevista cuya entrega podría tardar más de un año debido a limitaciones en la producción de chips y a la escasez de memoria de alto ancho de banda.
La distinción entre inferencia y entrenamiento es central en esta historia. El entrenamiento requiere un procesamiento sostenido a través de un gran número de aceleradores mientras un modelo aprende de los datos. La inferencia es la fase de producción en la que un modelo ya entrenado responde a solicitudes de los usuarios, genera contenido o realiza tareas para aplicaciones.
Según los informes, el clúster propuesto de DeepSeek se centraría en cargas de trabajo de inferencia. The Decoder, citando el reporte de Bloomberg, afirmó que DeepSeek sigue utilizando hardware de Nvidia para las cargas de entrenamiento más pesadas. Eso sugiere que el proyecto no es un reemplazo inmediato de todas las partes de la infraestructura informática de DeepSeek. En cambio, crearía una gran plataforma nacional para servir modelos una vez entrenados.
Aun así, al menos 160.000 procesadores representarían un despliegue sustancial. Si se entregara y conectara de forma eficaz, el sistema podría respaldar un acceso a modelos de gran volumen y reducir la dependencia de la empresa de aceleradores importados para servicios de producción. Sin embargo, el resultado práctico dependería de más factores que el número de procesadores: la interconexión, la compatibilidad del software, la energía, la refrigeración, la capacidad de memoria y la gestión del clúster afectarían el rendimiento utilizable.
El cronograma informado es incierto. The Decoder dijo que Huawei podría no ser capaz de entregar la cantidad total durante más de un año, citando límites de producción y escasez de memoria. Esa salvedad convierte el anuncio tanto en una historia sobre la capacidad de la cadena de suministro como sobre los planes de adquisición de DeepSeek.
Los aceleradores de IA dependen de la memoria de alto ancho de banda para mover datos rápidamente entre el procesador y las cargas de trabajo que está atendiendo. El informe señaló que la china CXMT ha comenzado a producir pequeños lotes de HBM3E, una tecnología de memoria utilizada por procesadores de IA, pero sigue varios años por detrás de Samsung, SK Hynix y Micron, que ya están fabricando HBM4 en masa.
Esas comparaciones muestran por qué un gran proyecto doméstico de aceleradores puede ser difícil de escalar rápidamente. Incluso si Huawei puede diseñar y ensamblar los procesadores, asegurar suficiente memoria avanzada y capacidad de empaquetado podría determinar si un plan de 160.000 chips se convierte en un clúster operativo o en un objetivo a más largo plazo. La evidencia no establece una fecha de entrega firme, una configuración final del sistema ni si toda la cantidad propuesta se ha asegurado contractualmente.
Los tres informes proporcionados coinciden en la afirmación principal: DeepSeek está asociado con un despliegue planificado de 160.000 chips de Huawei, y la ubicación prevista es Mongolia Interior. CNBC TV18 y tech-ish.com presentan el plan como un esfuerzo por reducir la dependencia de Nvidia mientras los productos de Nvidia siguen limitados en China. The Decoder ofrece el relato más detallado del tipo de chip propuesto, el papel exclusivo de inferencia, los cuellos de botella de suministro y el uso continuado de Nvidia para entrenamiento.
Sin embargo, la evidencia son reportes periodísticos y no una especificación técnica pública ni un anuncio de la empresa. Ninguna de las fuentes proporcionadas aquí confirma que Huawei haya aceptado el pedido completo, que la construcción esté terminada o que el clúster haya entrado en pruebas. La afirmación de que este sería el mayor clúster de chips Huawei conocido también es una comparación reportada, no una clasificación sectorial auditada de forma independiente.
Esa distinción importa para los compradores e investigadores de IA. Un número de procesadores planificado no revela por sí solo el rendimiento, el costo por solicitud, el tiempo de actividad ni la compatibilidad con la pila de software utilizada por DeepSeek. Esos resultados solo pueden evaluarse después de que el sistema se entregue y se mida en condiciones de producción.
Para DeepSeek, trasladar la inferencia al hardware de Huawei podría proporcionar un mayor control sobre el suministro y la capacidad de despliegue en China. También podría hacer que los costos y la disponibilidad de servicio dependan menos de la adquisición de Nvidia, los controles de exportación o el acceso a sistemas importados. Pero migrar la inferencia a esta escala puede requerir optimización de software, conversión de modelos, cambios de programación y pruebas extensas en el ecosistema de hardware y software de Huawei.
Para los equipos de IA empresariales, el clúster propuesto destaca una lección más amplia de adquisición: diversificar aceleradores no consiste simplemente en comprar un chip diferente. Los equipos deben evaluar toda la plataforma, incluido el soporte del compilador, los marcos de inferencia, el ancho de banda de memoria, la red, la observabilidad y la disponibilidad de hardware de reemplazo.
El proyecto también ilustra los diferentes cuellos de botella a los que se enfrenta la industria de IA de China. Las restricciones a la exportación pueden impulsar la demanda de aceleradores domésticos, pero la demanda por sí sola no resuelve la escasez de memoria avanzada ni las limitaciones de fabricación. La capacidad de Huawei para entregar a escala —y la capacidad de DeepSeek para lograr un rendimiento competitivo de inferencia en el clúster resultante— será más informativa que la mera cifra de procesadores del titular.
La señal de seguimiento más clara será una confirmación de DeepSeek o Huawei de que el proyecto existe como un pedido comprometido y no como un plan interno. Los informes sobre el progreso de la construcción, los calendarios de entrega y el número de chips Ascend-950DT realmente instalados establecerán si se está alcanzando la escala propuesta.
Las divulgaciones técnicas serán igualmente importantes. Esté atento a mediciones independientes del rendimiento de inferencia, la latencia, el consumo de energía y el costo en comparación con los sistemas de Nvidia. Los detalles sobre la pila de software, el soporte de modelos, el diseño de red y la configuración de memoria mostrarán si el clúster puede servir cargas de trabajo reales de manera eficiente.
Por último, la disponibilidad de HBM3E de CXMT y la producción de Huawei indicarán si China puede ampliar su infraestructura doméstica de IA más allá de despliegues individuales. Si el suministro sigue siendo limitado, el proyecto de DeepSeek podría convertirse en un plan de capacidad a largo plazo más que en un sustituto cercano de los sistemas basados en Nvidia.
El plan informado de DeepSeek es significativo porque separa la dependencia de la infraestructura de IA en dos etapas. China puede seguir usando sistemas de Nvidia para las cargas de entrenamiento más exigentes mientras traslada la inferencia a gran escala a aceleradores domésticos. Esa es una forma más limitada de sustitución que reemplazar Nvidia en toda la pila de IA, pero aun así podría importar para servicios dirigidos al consumidor y despliegues empresariales donde la demanda de inferencia es persistente.
La historia debe juzgarse por la entrega y los resultados operativos, no por el número propuesto de chips. Hasta que la capacidad de suministro de Huawei, el despliegue de DeepSeek y los datos independientes de rendimiento sean más claros, la cifra de 160.000 procesadores se entiende mejor como una gran ambición reportada, y como una prueba de si el ecosistema doméstico de hardware de IA de China puede escalar de planes estratégicos a infraestructura de producción fiable.