← Volver al blog
Aiaprox. 7 min de lectura

Huawei Cloud reconstruyó su stack en torno a los agentes y después puso fecha a las facturas

Publicado 4 oct 2026
Huawei Cloud reconstruyó su stack en torno a los agentes y después puso fecha a las facturas

Huawei Cloud aprovechó su conferencia anual Connect, en septiembre, para afirmar que su cartera de IA empresarial ya está completamente en el mercado y que el centro de diseño de esa cartera son los agentes. El CEO de Huawei Cloud, Zhou Yuefeng, enmarcó el cambio como la construcción de una «Agentic Cloud» para una era de agentes industriales, y los anuncios que la acompañaron trataban principalmente de fontanería.

Cuatro piezas de fontanería, para ser precisos. Huawei Cloud describió su nuevo paradigma de infraestructura como tokens eficientes, memoria mejorada, programación integrada de cargas generales y de IA, y autonomía segura. Dijo que la plataforma resultante ya atiende a más de 3500 clientes en todo el mundo. La frase suena a marketing hasta que se mira a qué apunta cada pieza, porque cada una responde a un fallo con el que se topan los agentes en producción y los chatbots no.

Tokens, memoria y la recuperación en diez minutos

La capa de cómputo es el servicio de clúster Lingqu Ascend 950. Huawei Cloud afirma que utiliza un mecanismo de recuperación rápida de cinco niveles con observabilidad de enlace completo, que los trabajos de entrenamiento en él se han ejecutado durante 40 días sin interrupción y que un fallo se recupera en menos de diez minutos. Sitúa el rendimiento de tokens un 20 % por encima de la generación anterior. El servicio se comercializó en China el 30 de septiembre, con un lanzamiento en el extranjero previsto para el 30 de noviembre.

Un manojo de hebras de fibra óptica azul brillante sobre un fondo negro

Un objetivo de recuperación de diez minutos es una especificación distinta de una puntuación de benchmark. Los entrenamientos largos fallan, y el coste de un fallo se mide en horas de GPU perdidas y sobrecarga de reinicio, así que el tiempo de recuperación es la cifra que de verdad le importa al equipo financiero de un cliente.

La capa de memoria está dirigida a un modo de fallo específico de los agentes de larga duración. Huawei Cloud llama al producto CMS memory storage y lo describe como un espacio de memoria a escala de petabytes, aproximadamente el doble de la capacidad de ofertas comparables, con velocidades de lectura a nivel de terabytes para acceso de alta velocidad y una mejora de rendimiento del 50 %. La propuesta es que un agente que trabaja en una tarea larga necesita algún lugar donde guardar lo que ha aprendido que no sea la ventana de contexto, porque una ventana de contexto que crece sin límite es cara y poco fiable.

Luego está la capa de acceso a modelos. Se describe AgenticMaaS como una forma de que los desarrolladores llamen a modelos convencionales de última generación con un solo clic y sin trabajo de despliegue. MiniMax demostró en el mismo evento un modelo multimodal ejecutándose en la plataforma, lo que recuerda que en China los proveedores de modelos y los proveedores de nube a menudo venden al mismo comprador empresarial.

Comercial y de código abierto, vendidos juntos

La capa de aplicaciones es donde el enfoque de Huawei Cloud se diferencia de una jugada de infraestructura pura. Sigue una estrategia dual: la plataforma comercial ZhiGuo AgentArts y su contraparte de código abierto llamada openJiuwen. Entre ambas, la compañía afirma haber publicado más de 5000 activos generales y más de 1000 activos sectoriales, es decir, habilidades, plantillas y conectores reutilizables en lugar de modelos en bruto.

La plataforma se utiliza en más de cien organismos gubernamentales, bancos, instituciones de investigación y empresas, incluidos el gobierno del distrito de Longgang en Shenzhen, Postal Savings Bank of China, China Southern Power Grid y Kingsoft Office. Kingsoft creó agentes enfocados a la oficina en la plataforma combinando su centro de documentos WPS 365 con su asistente Comate, que es el tipo de integración que un proveedor de nube no puede construir por sí solo y un proveedor de aplicaciones no puede alojar por sí solo.

Está previsto que ZhiGuo AgentArts se lance comercialmente en mercados internacionales el 30 de diciembre. La comunidad de código abierto en torno a openJiuwen informa de más de 50 000 estrellas y 3,29 millones de descargas. Publicar tanto una plataforma comercial como una versión abierta es una forma de sembrar la base de desarrolladores con personas que finalmente necesitarán el nivel de pago, y es un patrón que varios proveedores chinos siguen ahora.

El otro argumento a favor de on-premises

Huawei Cloud no es la única empresa que vende infraestructura para agentes en China, y una serie de eventos más discretos en septiembre muestra el resto del mercado. Mitac, en colaboración con AMD, organizó seminarios de despliegue en Wuxi y Guiyang para un dispositivo de agentes empresariales llamado Agent Builder, construido en torno a los procesadores Ryzen AI Max de AMD y comercializado sobre la base de la soberanía de datos. La propuesta allí es la opuesta a una nube pública: mantener el modelo, el cómputo, la base de conocimiento y los sistemas de negocio dentro de la empresa, y ejecutar el agente en un equipo en la oficina.

Ambos enfoques responden a la misma objeción de compra. Las empresas quieren agentes que toquen procesos de negocio reales, y los procesos de negocio reales contienen datos que no les resulta cómodo poner detrás del endpoint de otro.

Los cuatro números que un comprador ya sigue

Los cuatro pilares de infraestructura se corresponden con cuatro costes. Los tokens son el precio de cada inferencia, y por eso el anuncio lidera con el rendimiento en lugar de con una puntuación de benchmark. La memoria es lo que cuesta una tarea de larga duración cuando la ventana de contexto deja de ser suficiente. La programación es la penalización de utilización de ejecutar cargas generales y de IA en hardware compartido. La seguridad es lo que pregunta un departamento de cumplimiento antes de que algo toque datos de producción.

La afirmación de Huawei Cloud es que ha abordado los cuatro en un solo stack, y que puede hacerlo porque posee el silicio. Es una promesa más difícil de igualar para un competidor, y más fácil de comprobar para un cliente, porque el resultado aparece en tres lugares que un equipo de compras ya mide: coste por millón de tokens, tasa de ejecuciones largas fallidas y proporción de tiempo de GPU que realmente hace trabajo.

Por qué la infraestructura es la historia, y no los modelos

La afirmación interesante que surge del debate chino sobre agentes de este año es que la capacidad de los modelos ha convergido, y que el valor se ha desplazado a lo que los rodea. Un profesor de práctica del Shanghai Advanced Institute of Finance presentó la versión económica del argumento en un foro de Shanghái en septiembre: a diferencia de las plataformas de internet, donde el coste marginal tiende a cero y los efectos de red son fuertes, un modelo grande consume recursos en cada inferencia, y un usuario puede cambiar de modelo en minutos. Un foso construido únicamente sobre el modelo es débil.

Si esa lectura es correcta, la capa defendible es la que resulta cara de mover, y eso significa tokens, memoria, programación y seguridad en lugar de pesos.

La ventaja de Huawei en ese marco es vertical. Posee el chip, la interconexión, la nube y la plataforma de modelos, y por eso el anuncio de Ascend 950 lidera con el tiempo de recuperación y el rendimiento de tokens en lugar de con una posición en una tabla de clasificación. Los competidores sin negocio de chips venden una historia de integración, y las historias de integración son más fáciles de copiar.

El contraargumento es que estar integrado también te convierte en un único punto de fallo, y que las empresas quieren cada vez más una capa de agentes portátil en lugar de una con forma de proveedor. Esa tensión es lo que pondrán a prueba los próximos dos trimestres, empezando por la fecha de comercialización en China del 30 de septiembre y el lanzamiento internacional a finales de noviembre. El plazo internacional importa más que el nacional, porque un stack construido en torno a silicio nacional tiene que demostrar que puede servir a un cliente cuyos datos no pueden salir de su propia jurisdicción.

Artículos relacionados