A cerca de 350 km de Pequim, Ulanqab tem latência de ida e volta estimada em cerca de 4 ms e energia cotada entre 0,32 e 0,35 yuan por kWh. A Alibaba afirma que a arquitetura modular CUBE 5.0 pode entregar a infraestrutura base de um grande data center de IA em 100 dias, com redução de cerca de 10% no custo de const...
Publicado porEditado com GPT-5.6 TerraImagens geradas com GPT Image 2
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: How is Alibaba’s Ulanqab data center in Inner Mongolia becoming a major hub for China’s AI computing—despite being about 350 kilometers from. Article summary: Alibaba’s Ulanqab campus is becoming an AI-compute hub because it combines west-China energy economics with east-China responsiveness: inexpensive renewable-heavy power and a cool climate reduce operating costs, while fi. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Ulanqab, na Mongólia Interior, ajuda a explicar uma mudança importante na infraestrutura de inteligência artificial: o melhor local para concentrar processamento não precisa ficar dentro do maior mercado consumidor. O campus da Alibaba Cloud fica perto o suficiente para atender Pequim com uma latência de ida e volta reportada de cerca de 4 milissegundos, mas aproveita eletricidade mais barata e um clima que reduz a necessidade de refrigeração. Essa combinação pode torná-lo uma base viável tanto para inferência — quando um modelo responde a pedidos — quanto para treinamento de IA em grande escala. 24
25
Ulanqab fica a aproximadamente 350 km de Pequim. Ainda assim, Wang Zhaoyang, responsável pelas operações de data centers da Alibaba, disse à imprensa local que a transmissão de dados entre as duas cidades leva cerca de 4 milissegundos. Segundo ele, esse atraso é aceitável para aplicações de IA conversacional. 25
A distinção é relevante: distância física não é o mesmo que atraso percebido pelo usuário. Um campus regional bem conectado pode atender uma grande metrópole se o tempo de trânsito na rede for pequeno diante do restante do tempo de resposta. Duas conexões diretas de fibra óptica com Pequim teriam reduzido a latência de mão única para menos de 2,1 milissegundos. 35
Data centers voltados à IA consomem enormes volumes de eletricidade, o que torna o custo energético do local um fator central. Relatos citam tarifa local de cerca de 0,32 a 0,35 yuan por kWh e estimam que as fontes renováveis respondam por aproximadamente 90% da oferta local de energia. 21
25
O clima oferece uma segunda vantagem. A temperatura média anual de Ulanqab é reportada em torno de 4 °C, e fontes locais afirmam que a refrigeração natural pode ser usada durante boa parte do ano. 24
35 Para uma operação com clusters densos de aceleradores, menor dependência de refrigeração mecânica pode reduzir custos operacionais além da economia na conta de luz.
Há também iniciativas específicas de energia limpa para computação. Um projeto de base de computação de baixo carbono em Ulanqab, que integra geração, rede, carga e armazenamento, entrou em operação em 2025. Ele foi projetado para fornecer energia verde diretamente a cargas de data centers e deve gerar 848 milhões de kWh por ano para consumo próprio. 39
A arquitetura CUBE 5.0 da Alibaba foi concebida para atacar outro gargalo: o tempo necessário para deixar um data center pronto para receber equipamentos de TI. Em vez de instalar sistemas críticos sequencialmente no local, o modelo modulariza fornecimento de energia, refrigeração, segurança, gestão inteligente e proteção contra incêndio, permitindo fabricar e preparar componentes em paralelo. 34
A Alibaba afirma que esse método pode reduzir a entrega da infraestrutura subjacente de um data center de IA para 100 dias e cortar cerca de 10% do custo de construção. Os ciclos convencionais de entrega na China são estimados entre seis e 12 meses. 25
34
Há uma ressalva importante: os 100 dias contam a partir de uma planta básica ou de contêineres empilhados e terminam antes da entrada de servidores e equipamentos de rede. Portanto, não representam necessariamente o tempo total entre a decisão de investimento e a operação de um serviço de IA. 32
34
O CUBE 5.0 também foi desenhado para mudanças nos requisitos de hardware. Segundo a Alibaba, a arquitetura usa corrente contínua de alta tensão, aceita refrigeração a ar e a líquido, é compatível com chips heterogêneos e pode acomodar pelo menos três gerações de evolução de chips. 34
Construção rápida e eletricidade barata não produzem aceleradores de ponta. A disponibilidade de chips adequados, memória, interconexões e software maduro continua sendo um fator limitante para clusters de IA.
A Alibaba começou a oferecer, na região de Ulanqab, instâncias de supernó Lingjun baseadas no chip Zhenwu M890. 1 O M890 é apresentado como um acelerador integrado para treinamento e inferência; a empresa informa 144 GB de memória e 800 GB/s de largura de banda entre chips.
11
Isso amplia as opções de hardware doméstico, mas não resolve por si só a questão da qualidade da capacidade. Formar um cluster competitivo de IA exige fornecimento constante de componentes, rede, ferramentas de software, confiabilidade e capacidade de executar modelos com eficiência em muitos aceleradores — não apenas entregar um grande número de chips.
O mercado chinês de computação para IA tem mostrado sinais aparentemente contraditórios: a demanda por capacidade de alta qualidade pode ser intensa, enquanto parte dos data centers permanece subutilizada. Um relatório do setor em 2026 apontou utilização geral abaixo de 40% nos centros de computação inteligente, enquanto reportagens anteriores descreveram forte ociosidade em partes do mercado. 3
10
Esses números não devem ser lidos como uma única taxa universal de utilização. As métricas variam conforme período, região, tipo de chip e critério adotado — capacidade instalada, alugada ou efetivamente usada. Ainda assim, elas revelam um problema estrutural: a capacidade pode ficar parada se estiver no lugar errado, usar chips inadequados à carga de trabalho, não tiver rede ou software suficientemente capazes, ou não contar com demanda recorrente. 8
9
Para Ulanqab, portanto, o teste comercial será a utilização, não a capacidade anunciada. A localização e o modelo de construção reduzem o custo e aceleram a oferta de processamento, mas não asseguram que cada acelerador será empregado de forma produtiva.
A estratégia mais ampla da Alibaba é disponibilizar vários tipos de aceleradores em uma plataforma de nuvem compartilhada, em vez de depender de um único fornecedor de hardware. Isso torna a camada de software e sistemas decisiva: arquitetura de cluster, redes, compiladores, softwares de execução e otimização de modelos precisam funcionar entre chips distintos.
A Alibaba afirma que a série Zhenwu, da sua unidade de semicondutores T-Head, também conhecida como Pingtouge, acumulava mais de 560 mil unidades enviadas a mais de 400 clientes de mais de 20 setores até maio de 2026. 7
11 O volume indica expansão da implantação, mas não mede, por si só, o desempenho em modelos de fronteira nem substitui uma pilha madura de computação heterogênea.
O campus da Alibaba em Ulanqab reúne uma lógica física consistente: energia de baixo custo e com forte participação renovável, clima frio e seco, latência de poucos milissegundos até Pequim e um desenho de infraestrutura voltado a encurtar ciclos de construção. 21
25
34
Sua relevância no longo prazo dependerá da execução. O polo vencedor de computação para IA não será apenas aquele que construir mais capacidade ao menor custo, mas aquele que conseguir combinar chips compatíveis e bem conectados com cargas de trabalho reais — e manter os sistemas em uso produtivo.
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
A cerca de 350 km de Pequim, Ulanqab tem latência de ida e volta estimada em cerca de 4 ms e energia cotada entre 0,32 e 0,35 yuan por kWh.
A cerca de 350 km de Pequim, Ulanqab tem latência de ida e volta estimada em cerca de 4 ms e energia cotada entre 0,32 e 0,35 yuan por kWh. A Alibaba afirma que a arquitetura modular CUBE 5.0 pode entregar a infraestrutura base de um grande data center de IA em 100 dias, com redução de cerca de 10% no custo de construção.
O diferencial não é apenas instalar chips: o sucesso dependerá de oferta de aceleradores, redes, software e uso efetivo da capacidade.