NVIDIA DGX Cloud Lepton (formerly Lepton AI)
NVIDIA DGX Cloud Lepton conecta desenvolvedores a computação GPU através de uma rede global de parceiros de nuvem a partir de uma única plataforma. Você cria, treina e implanta modelos com um fluxo de trabalho único, seja qual for a localização das GPUs, seja na AWS, CoreWeave, Lambda ou provedores regionais que atendem às regras de soberania de dados. O site integra microserviços NVIDIA NIM, endpoints serverless em build.nvidia.com e ferramentas para inferência, testes e treinamento sem necessidade de reestruturar ao trocar de provedores.
Mercados independentes de GPU fazem você escolher uma nuvem e reescrever scripts de implantação quando a capacidade muda. DGX Cloud Lepton atua como um corretor de computação: descubra GPUs de mais de 25 parceiros, execute cargas de trabalho onde seus dados estão e mantenha a mesma experiência de desenvolvedor do protótipo à produção. A NVIDIA adquiriu a startup original Lepton AI em abril de 2025 e a incorporou nesta camada unificada multi-nuvem.
Startups nativas de IA, construtores de modelos e equipes de plataforma que ultrapassam um contrato com uma única nuvem são os usuários-alvo. Parceiros listados na plataforma incluem AWS, CoreWeave, Crusoe, Lambda, Nebius, Scaleway e Together AI com hardware Blackwell e classe H100. O acesso começa por meio das APIs build.nvidia.com e da biblioteca Python leptonai de código aberto.
Fluxo de trabalho unificado de desenvolvimento, treinamento e inferência em parceiros NVIDIA Cloud e marketplaces de GPU
Acesso instantâneo a APIs aceleradas NVIDIA e microserviços NIM via build.nvidia.com
Implante cargas de trabalho de IA em ambientes multi-cloud sem rearquear quando os provedores mudam
Execute computação em regiões específicas para atender a requisitos de soberania de dados e baixa latência
Rede de parceiros inclui AWS, CoreWeave, Lambda, Nebius, Scaleway, Together AI e Mistral AI GPUs
Biblioteca Python open-source leptonai e lep CLI para gerenciar endpoints, pods de desenvolvimento e jobs em lote
Ferramentas integradas facilitam a transição do protótipo para produção em dezenas de milhares de GPUs
Um fluxo de trabalho abrange várias nuvens de GPU sem reescrever o código de implantação quando a capacidade muda.
Integração direta com microserviços NVIDIA NIM e endpoints serverless build.nvidia.com
Escolha de parceiro regional ajuda a atender aos requisitos de residência de dados.
Biblioteca open-source leptonai permanece mantida para desenvolvimento e implantação local.
Sem preços públicos de autoatendimento em lepton.ai; acesso a GPUs empresariais passa por NVIDIA e parceiros.
O produto independente Lepton AI desaparece após a aquisição da NVIDIA em 2025.
Melhor para equipes já no ecossistema NVIDIA, não para entusiastas casuais.
O que é o NVIDIA DGX Cloud Lepton?
O NVIDIA DGX Cloud Lepton é uma plataforma unificada de IA que conecta desenvolvedores a computação GPU de uma rede global de provedores de nuvem. O DGX Cloud Lepton oferece uma experiência consistente para desenvolvimento, treinamento e inferência em ambientes multi-nuvem.
O que aconteceu com o Lepton AI?
A NVIDIA adquiriu o Lepton AI em abril de 2025 e renomeou a plataforma para NVIDIA DGX Cloud Lepton. O domínio lepton.ai agora hospeda o produto da NVIDIA, enquanto a biblioteca open-source leptonai permanece disponível no GitHub.
Quais provedores de nuvem funcionam com o DGX Cloud Lepton?
Os parceiros do DGX Cloud Lepton incluem AWS, CoreWeave, Crusoe, Lambda, Nebius, Nscale, Scaleway, Together AI, Mistral AI e outros parceiros de nuvem da NVIDIA. O marketplace lista GPUs das classes Blackwell, H100 e H200 em várias regiões.
Como os desenvolvedores acessam o DGX Cloud Lepton?
Os desenvolvedores começam pelo build.nvidia.com para APIs NVIDIA serverless e microserviços NIM, depois escalam no DGX Cloud Lepton para cargas de trabalho GPU multi-nuvem. O pacote Python leptonai e o CLI lep gerenciam endpoints, pods de desenvolvimento e jobs em lote.
O DGX Cloud Lepton pode executar cargas de trabalho em regiões específicas?
Sim. O NVIDIA DGX Cloud Lepton permite que equipes tragam computação de regiões específicas para atender regras de soberania de dados e necessidades de baixa latência. Você escolhe provedores e regiões na plataforma Lepton sem alterar seu fluxo de trabalho de aplicação.
O DGX Cloud Lepton suporta inferência e treinamento?
Sim. O DGX Cloud Lepton cobre desenvolvimento, treinamento e inferência em uma única plataforma com serviços integrados para teste, treinamento e implantação. Microserviços NVIDIA NIM cuidam da inferência enquanto GPUs parceiras cobrem treinamento em larga escala.

