A NVIDIA e o Google Cloud anunciaram novos avanços em sua colaboração de mais de 10 anos durante o Google Cloud Next, em Las Vegas. A parceria, focada no desenvolvimento de infraestrutura para inteligência artificial, ganhou impulso com a expansão do Google Cloud AI Hypercomputer e a apresentação de novos recursos voltados à próxima geração de IA física e agêntica.

Entre as novidades estão as instâncias bare metal A5X com tecnologia NVIDIA Vera Rubin, a prévia do Google Gemini no Google Distributed Cloud operando em GPUs NVIDIA Blackwell e Blackwell Ultra, além de VMs confidenciais equipadas com GPUs Blackwell. A plataforma Gemini Enterprise Agent também passa a integrar modelos abertos NVIDIA Nemotron e o framework NVIDIA NeMo.

O Google detalhou ainda o A5X, baseado no sistema NVIDIA Vera Rubin NVL72, projetado para reduzir em até dez vezes o custo de inferência por token e aumentar, na mesma proporção, a taxa de transferência por megawatt em relação à geração anterior. A infraestrutura utiliza placas de rede NVIDIA ConnectX-9 SuperNIC e a rede Google Virgo, com capacidade de escalar até 80 mil GPUs Rubin em um único cluster e até 960 mil em ambientes multisite.

Segundo Marcio Aguiar, diretor da divisão Enterprise da NVIDIA para a América Latina, a evolução para modelos capazes de atuar no mundo físico exige uma infraestrutura robusta, eficiente e segura, e a ampliação da parceria com o Google Cloud busca acelerar a adoção corporativa de aplicações de IA física e agêntica.

O Google Cloud afirmou que a próxima década da inteligência artificial será definida pela capacidade dos clientes de executar cargas de trabalho complexas em uma infraestrutura integrada e otimizada. Segundo Mark Lohmeyer, vice-presidente de IA e infraestrutura de computação da empresa, a combinação entre os serviços gerenciados do Google Cloud e as plataformas da NVIDIA oferece flexibilidade para treinar, ajustar e operar desde modelos avançados até aplicações de IA física e baseada em agentes, com ganhos de desempenho, custo e eficiência energética.

O portfólio NVIDIA Blackwell disponível no Google Cloud inclui desde VMs A4 com sistemas NVIDIA HGX B200 até VMs A4X em escala de rack com sistemas GB200 NVL72 e A4X Max com GB300 NVL72, além de VMs G4 fracionárias com GPUs NVIDIA RTX PRO 6000 Blackwell Server Edition. A infraestrutura permite escalar de frações de GPU a dezenas de milhares de unidades interconectadas.

A plataforma foi projetada para otimizar cargas de trabalho como inferência multimodal, processamento de dados, simulações avançadas e aplicações de IA física e robótica. Laboratórios de ponta já utilizam esses recursos: o Thinking Machines Lab está ampliando o treinamento de sua API Tinker em VMs A4X Max com sistemas GB300 NVL72, enquanto a OpenAI executa inferência em larga escala em sistemas NVIDIA GB300 e GB200 NVL72 no Google Cloud para cargas de trabalho intensivas, incluindo o ChatGPT.

Modelos Google Gemini executados em GPUs NVIDIA Blackwell e Blackwell Ultra passaram a estar disponíveis em versão prévia no Google Distributed Cloud, permitindo que organizações utilizem modelos avançados diretamente onde seus dados sensíveis estão armazenados. A tecnologia NVIDIA Confidential Computing, integrada à plataforma Blackwell, garante que instruções e dados de ajuste fino permaneçam criptografados, sem acesso por parte de operadores de infraestrutura.

No ambiente de nuvem pública, as VMs Confidential G4 com GPUs NVIDIA RTX PRO 6000 Blackwell levam esse mesmo nível de proteção a cenários multi-inquilinos, oferecendo segurança adicional para setores regulamentados. Trata-se da primeira oferta de computação confidencial baseada em GPUs NVIDIA Blackwell na nuvem.

A plataforma NVIDIA no Google Cloud foi otimizada para executar modelos como Gemini, Gemma, Nemotron e outros pesos abertos, permitindo o desenvolvimento de agentes de IA capazes de raciocinar, planejar e agir. O modelo NVIDIA Nemotron 3 Super está disponível na Gemini Enterprise Agent Platform, facilitando a personalização e a implantação de modelos multimodais e de raciocínio.

Para treinamento em escala, os Clusters de Treinamento Gerenciados da plataforma introduziram uma API de aprendizado por reforço baseada em NVIDIA NeMo RL, que automatiza tarefas como escalonamento, recuperação de falhas e execução de jobs. Empresas como a CrowdStrike já utilizam bibliotecas NVIDIA NeMo para gerar dados sintéticos e otimizar modelos de linguagem voltados à cibersegurança, executando esses processos em clusters com GPUs NVIDIA Blackwell para acelerar detecção e resposta a ameaças.

A adoção de IA industrial e física em larga escala depende de hardware de alto desempenho e de um ecossistema de modelos, bibliotecas e frameworks abertos. Segundo a NVIDIA, a infraestrutura de IA disponível no Google Cloud está ampliando o acesso a aplicações industriais avançadas, permitindo simular, otimizar e automatizar processos do mundo real.

Soluções de empresas como Cadence e Siemens Digital Industries Software já podem ser executadas no Google Cloud com aceleração da NVIDIA, o que apoia o desenvolvimento de chips, veículos autônomos, robôs, sistemas aeroespaciais e linhas de produção. Bibliotecas como NVIDIA Omniverse e o simulador robótico NVIDIA Isaac Sim, disponíveis no Marketplace do Google Cloud, permitem criar digital twins e fluxos de simulação para treinar e validar robôs antes da implantação.

Microsserviços NVIDIA NIM, incluindo modelos como o Cosmos Reason 2, podem ser executados no Vertex AI e no Google Kubernetes Engine, o que permite habilitar agentes e robôs capazes de interpretar o ambiente físico e tomar decisões em tempo real. Essas tecnologias facilitam a transição de projetos CAD para digital twins operacionais e para robôs orientados por IA.

Empresas como Snap, Schrödinger e Salesforce já utilizam a plataforma conjunta para acelerar a transição da prototipagem para a produção. A Snap reduziu os custos de testes A/B ao migrar pipelines para o Spark acelerado por GPU; a Schrödinger reduziu o tempo de simulações de descoberta de medicamentos de semanas para horas.

Startups também impulsionam novas aplicações de IA com a computação acelerada da NVIDIA no Google Cloud. CodeRabbit e Factory utilizam modelos baseados em NVIDIA Nemotron para revisão de código e agentes autônomos de desenvolvimento, enquanto Aible, Mantis AI, Photoroom e Baseten criam soluções corporativas de dados, vídeo, imagens e inferência.

Mais de 90 mil desenvolvedores já aderiram à comunidade conjunta em pouco mais de um ano. A NVIDIA foi reconhecida no Google Cloud Next como Parceira do Ano em duas categorias, reforçando a colaboração entre as empresas para transformar agentes experimentais e simulações em sistemas de produção que otimizam operações e habilitam novas aplicações de IA.