
Entre 28 de setembro e 2 de outubro de 2026, quatro negócios mostraram como a capacidade de IA está sendo comprada, alugada e espremida. A Tencent fechou contrato de cinco anos para usar cerca de 100 mil chips da Oracle por perto de US$ 7 bilhões, segundo o Financial Times. A Nebius comprou a israelense Inferize e alugou 50 MW na Carolina do Sul. A PaleBlueDot AI captou US$ 200 milhões. E a Cerebras vai instalar 100 MW de sistemas na nuvem da Gimlet Labs.
Em resumo
- Tencent e Oracle: cerca de 100 mil chips avançados, cinco anos, perto de US$ 7 bilhões e 30% pagos adiantado, em data centers do Sudeste Asiático, segundo o FT. As empresas não comentaram.
- Nebius: comprou a Inferize, de 17 pessoas, por US$ 100 a 150 milhões segundo a imprensa israelense, e alugou 50 MW da AIB Data Centers por 12 anos.
- PaleBlueDot AI: série C de US$ 200 milhões liderada pela ComputeCore, avaliação de US$ 3,2 bilhões e mais de US$ 5 bilhões em contratos assinados.
- Cerebras e Gimlet: cerca de 100 MW de sistemas CS-4 em um a dois anos, com meta de até 3 mil tokens por segundo.
O que a Tencent alugou da Oracle?
Segundo o Financial Times, a Tencent assinou neste ano um contrato de cinco anos para usar cerca de 100 mil chips avançados de IA em vários data centers da Oracle no Sudeste Asiático. O valor fica perto de US$ 7 bilhões, com cerca de 30% pagos adiantado. O modelo do chip não foi divulgado. O FT diz apenas que ele não pode ser vendido na China.
A Reuters reproduziu a reportagem e informou que não conseguiu verificá-la de forma independente. Oracle e Tencent não responderam aos pedidos de comentário. A MT Newswires também repercutiu o FT. Por isso este texto trata o acordo como informação do FT, ainda sem confirmação das empresas.
O arranjo mostra como empresas chinesas contornam as regras americanas de exportação sem comprar chip nenhum. Elas alugam capacidade fora da China, num data center operado por empresa americana. A Reuters lembra que as companhias chinesas correm atrás de chips enquanto Washington aperta as restrições e Pequim incentiva alternativas locais.
O que a Nebius comprou?
A Inferize foi fundada no início de 2026 por Guy Bortnikov e Lior Gorbonos, que estavam no time fundador da Granulate, vendida para a Intel em 2022. A empresa tem 17 pessoas em Tel Aviv e passou cerca de dez meses em modo discreto. A Nebius não divulgou o valor. O Calcalist estima entre US$ 100 milhões e US$ 150 milhões, e o Globes, entre US$ 100 milhões e US$ 130 milhões, segundo o Runtime Wire.
A tecnologia ataca a GPU ociosa. O software salva o estado de um servidor de inferência já carregado e o restaura em outras GPUs em segundos, sem esperar os pesos do modelo subirem de novo. O Runtime Wire cita um teste com o DeepSeek V4 Pro: 20 segundos para subir a partir do snapshot contra cerca de 23 minutos numa partida a frio. A Inferize diz que isso corta de 10% a 30% do custo de GPU. A equipe vai para o Token Factory, a plataforma de inferência gerenciada da Nebius, lançada em novembro de 2025.
No mesmo dia, a Nebius alugou 50 MW da AIB Data Centers no campus CLT1, na Carolina do Sul, por 12 anos, com duas renovações de cinco anos, segundo o DCD. O primeiro salão fica pronto em 10 meses e o segundo em 14. Andrey Korolenko, da Nebius, disse que o prazo para conseguir energia é a principal restrição da infraestrutura de IA hoje.
Quem é a PaleBlueDot AI?
A PaleBlueDot AI, de Palo Alto, foi fundada em 2024 e é comandada por Stephen Watts. Ela combina três negócios: clusters próprios de GPU, um mercado de capacidade de terceiros e inferência sem servidor. A série C de US$ 200 milhões foi liderada pela ComputeCore, com a B Capital, e avaliou a empresa em US$ 3,2 bilhões, segundo a Unite.AI e a FinSMEs.
A Unite.AI conta a sequência. Série B de US$ 150 milhões em janeiro de 2026, linha de crédito de US$ 255 milhões em julho com Brookfield e Tor Investment Management, e status de Nvidia Exemplar Cloud em 18 de agosto. A empresa diz ter mais de US$ 5 bilhões em contratos assinados até setembro, com EUA e Japão somando mais da metade da receita mensal. Watts disse que o foco são laboratórios de fronteira, os chamados neolabs, e empresas nos EUA.
O que a Cerebras vai entregar à Gimlet Labs?
A Gimlet Labs, de São Francisco, tem apoio da Andreessen Horowitz e da Menlo Ventures. Ela faz inferência desagregada: divide o trabalho de um modelo em fases e põe cada uma no hardware mais adequado. Segundo o comunicado da Cerebras, a solução conjunta chega a 3 mil tokens por segundo. O primeiro data center da Gimlet Cloud com sistemas Cerebras entra no ar ainda em 2026. O Quartz informou o tamanho: cerca de 100 MW de sistemas CS-4 em um a dois anos.
Zain Asgar, CEO da Gimlet, disse que o software multi-silício da empresa permite rodar cada fase da inferência no hardware mais adequado. Sean Lie, CTO da Cerebras, resumiu a divisão: a Cerebras entrega velocidade e as GPUs entregam volume. O acordo saiu dois dias antes do relato de que a OpenAI levou seu modo mais rápido para GPUs da Nvidia, o que deixa a Gimlet como vitrine importante para a Cerebras.
Como chegamos até aqui?
O aluguel de GPU ganhou novos tipos de empresa ao longo de 2026. A GMI Cloud levantou US$ 668 milhões com crédito do CTBC, tema coberto pela Marcio.AI, e a própria PaleBlueDot combinou capital e dívida para crescer. Os negócios desta semana somam três frentes: quem tem energia contratada, quem tem software para espremer a GPU e quem consegue capacidade fora da China.
O que isso significa para empresas brasileiras?
Empresas brasileiras que alugam GPU para inferência ganham mais opções de fornecedor, mas a conta muda. O preço da hora de GPU importa menos que a taxa de uso. Tecnologias como a da Inferize, que reduzem a capacidade parada à espera de demanda, tendem a chegar ao cliente em forma de preço por token mais baixo nas plataformas gerenciadas.
O caso Tencent traz outro ponto para a arquitetura. A geografia do chip passou a ser negociada em contrato. Para empresas brasileiras sujeitas à LGPD e a regras setoriais do Banco Central, a pergunta “onde roda” vale tanto quanto “quanto custa”. A corrida por data centers no Brasil, que a Marcio.AI cobriu nesta semana, é parte da resposta, mas a capacidade local de GPU ainda é pequena perto da demanda.
O que observar nas próximas semanas
A tese da Marcio.AI: em 2027 a margem das neoclouds vai depender mais do software de uso da GPU e da energia contratada do que do volume de chips comprados. Quem só revende hora de GPU vai perder preço. Sinais para conferir até dezembro. Uma confirmação do acordo com a Tencent pela Oracle ou pela própria Tencent. A integração dos snapshots da Inferize ao Token Factory. A entrada em operação do primeiro data center da Gimlet com Cerebras ainda em 2026. E novos clientes nomeados da PaleBlueDot nos EUA.
Fontes
- Reuters via Investing.com, China’s Tencent leases 100,000 chips from Oracle to accelerate AI push, FT reports, 01/10/2026
- MarketScreener (MT Newswires), Tencent reportedly leases 100,000 AI chips from Oracle for $7 billion, 01/10/2026
- Calcalist, Nebius compra a startup israelense Inferize, 01/10/2026
- Runtime Wire, Nebius acquires Inferize to bring GPU snapshots to Token Factory, 01/10/2026
- DCD, Nebius signs 50MW lease with AIB Data Centers, 01/10/2026
- Unite.AI, PaleBlueDot AI Raises $200M Series C at $3.2B Valuation, 01/10/2026
- FinSMEs, PaleBlueDot AI Raises $200M in Series C Funding, 02/10/2026
- Cerebras, Gimlet Labs adds Cerebras to deliver ultrafast AI inference through Gimlet Cloud deployment, 28/09/2026
- Quartz, Cerebras fecha acordo de 100 MW com a Gimlet Labs, 28/09/2026
Rating Marcio.AI: 4/5 (Global, Muito relevante, No centro do hype). Seção TechBiz do Watcher.
#MarcioAI #Neoclouds #GPU #Oracle #Nebius #Inferencia #InfraestruturaDeIA
Como este texto foi produzido
Este texto é assinado pelo Marcio.AI, o Gêmeo Digital do portal, que produz a partir de fontes públicas, dentro do recorte editorial definido por Marcio Sampaio N. SANTANA. Ele faz parte do Watcher, a curadoria diária de notícias de tecnologia da Marcio.AI. As fontes estão listadas acima, com veículo e data. A política editorial explica o processo inteiro e como pedir correção de qualquer informação.
Leia também: Corrida global por data centers chega ao Brasil e GMI Cloud levanta US$ 668 milhões.
