
Acelere o treinamento e a disponibilização de HPC e IA com o sistema de arquivos paralelo de alto desempenho e compatível com POSIX do Google.
Recursos
Para atender às demandas da IA de última geração, estamos aumentando a escala em 10 vezes. Ao aumentar o desempenho do Managed Lustre para 10 TB/s, abrimos caminho para cargas de trabalho de IA/ML massivas, acelerando significativamente os pipelines de treinamento e inferência.
Para maximizar a flexibilidade, nossa nova opção dinâmica oferece desempenho máximo para seus dados mais críticos, ao mesmo tempo em que reduz os custos totais em todo o conjunto de dados. Ao consolidar em uma única SKU, oferecemos faturamento previsível com o custo exato conhecido antecipadamente. Como todos os dados residem no Lustre, você consegue latência ultrabaixa para dados ativos e latência semelhante a blocos para dados inativos. Isso ajuda a eliminar gargalos no carregamento, treinamento e checkpointing de alta frequência do modelo quando você traz todo o conjunto de dados para o Managed Lustre.
O verdadeiro custo da IA não é apenas o armazenamento, mas também a computação ociosa. O Managed Lustre oferece a entrega de dados de alta capacidade e baixa latência necessária para manter seus recursos mais caros totalmente saturados. Ao otimizar a distribuição de dados e acelerar a criação de pontos de verificação rápidos, você melhora drasticamente o uso do acelerador, o que leva a uma redução da sobrecarga e a um desempenho superior por dólar.
Treinar modelos grandes de aprendizado profundo exige conjuntos de dados enormes. O Managed Lustre, baseado no DDN EXAScaler (link em inglês), distribui o acesso aos dados, reduzindo os tempos de treinamento, permitindo insights mais rápidos, maior precisão e gerenciamento de projetos complexos de IA. A escalonabilidade foi projetada para que o desempenho acompanhe o aumento dos dados, evitando gargalos de armazenamento. Assista a uma visão geral da Omdia sobre o Managed Lustre aqui.
A IA agêntica continua a impulsionar as grandes janelas de contexto, o que pode representar um desafio de armazenamento para oferecer a você uma experiência responsiva ao interagir com LLMs. Janelas de contexto grandes aumentam a sensibilidade à latência, porque a memória local nos aceleradores costuma se esgotar, exigindo que o modelo acesse o armazenamento externo.
Impulsionando a inovação em vários setores
| Setores |
|---|
IA e ML Elimine a falta de dados e treine modelos de fundação em grande escala. Ao desacoplar computação e armazenamento, o Managed Lustre aumenta a capacidade de processamento da inferência de LLM, com o armazenamento em cache de chave-valor externo em menos de um milissegundo, mantendo seus aceleradores mais caros totalmente saturados. Conheça a IA no Google Cloud. |
Saúde e ciências biológicas Impulsionar a inovação revolucionária em direção a novas curas. Ofereça as IOPS extremas necessárias para acelerar a descoberta de medicamentos, analisar sequências genômicas complexas e alimentar suítes de imagens médicas baseadas em IA, reduzindo drasticamente o tempo de geração de insights para pesquisadores e médicos. Conheça as soluções de saúde e ciências biológicas no Google Cloud. |
Visão computacional, robótica e veículos autônomos Acelerar o pipeline de veículos definidos por software. Permita que os inovadores ingiram sem esforço telemetria de sensores em escala de petabytes, ao mesmo tempo em que turbinam a engenharia de pesquisa e desenvolvimento com armazenamento de latência zero para simulações de aerodinâmica, segurança e otimização térmica. Conheça o setor automotivo no Google Cloud. |
Mercados de capitais Executar cargas de trabalho que exigem precisão de submilisegundos. Seja executando análises de risco quantitativas complexas e simulações de mercado em tempo real para serviços financeiros, acelerando a renderização de efeitos visuais de alta resolução e fluxos de trabalho de pós-produção para estúdios de mídia globais. Conheça as soluções do Google Cloud para mercados de capitais e serviços financeiros. |
Mídia e entretenimento Cumpra os prazos de produção com desempenho de armazenamento sem compromissos. Ofereça aos seus estúdios a capacidade de processamento ultrarrápida necessária para edição de vídeo de alta resolução, renderização de efeitos visuais em tempo real e fluxos de trabalho de pós-produção acelerados. Conheça o setor de mídia e entretenimento no Google Cloud. |
IA e ML
Elimine a falta de dados e treine modelos de fundação em grande escala. Ao desacoplar computação e armazenamento, o Managed Lustre aumenta a capacidade de processamento da inferência de LLM, com o armazenamento em cache de chave-valor externo em menos de um milissegundo, mantendo seus aceleradores mais caros totalmente saturados.
Conheça a IA no Google Cloud.
Saúde e ciências biológicas
Impulsionar a inovação revolucionária em direção a novas curas. Ofereça as IOPS extremas necessárias para acelerar a descoberta de medicamentos, analisar sequências genômicas complexas e alimentar suítes de imagens médicas baseadas em IA, reduzindo drasticamente o tempo de geração de insights para pesquisadores e médicos.
Conheça as soluções de saúde e ciências biológicas no Google Cloud.
Visão computacional, robótica e veículos autônomos
Acelerar o pipeline de veículos definidos por software. Permita que os inovadores ingiram sem esforço telemetria de sensores em escala de petabytes, ao mesmo tempo em que turbinam a engenharia de pesquisa e desenvolvimento com armazenamento de latência zero para simulações de aerodinâmica, segurança e otimização térmica.
Conheça o setor automotivo no Google Cloud.
Mercados de capitais
Executar cargas de trabalho que exigem precisão de submilisegundos. Seja executando análises de risco quantitativas complexas e simulações de mercado em tempo real para serviços financeiros, acelerando a renderização de efeitos visuais de alta resolução e fluxos de trabalho de pós-produção para estúdios de mídia globais.
Conheça as soluções do Google Cloud para mercados de capitais e serviços financeiros.
Mídia e entretenimento
Cumpra os prazos de produção com desempenho de armazenamento sem compromissos. Ofereça aos seus estúdios a capacidade de processamento ultrarrápida necessária para edição de vídeo de alta resolução, renderização de efeitos visuais em tempo real e fluxos de trabalho de pós-produção acelerados.
Conheça o setor de mídia e entretenimento no Google Cloud.
Preços
| Preços do Managed Lustre | Os preços do Managed Lustre são baseados principalmente no local e no nível de serviço. |
|---|---|
| Nível de serviço | Preços |
1.000 MB/s/TiB Ideal para cargas de trabalho de alto desempenho que querem treinar IA/ML, em que a capacidade de processamento é fundamental. | A partir de US$ 0,60/GiB por mês |
500 MB/s/TiB Melhor para equilíbrio de alto desempenho: excelente para cargas de trabalho exigentes de IA/ML, aplicativos complexos de HPC e análises intensivas em dados que exigem capacidade de processamento substancial, mas podem se beneficiar de uma relação preço-desempenho mais equilibrada. | A partir de US$ 0,34/GiB por mês |
250 MB/s/TiB Ideal para HPC de uso geral e IA com uso intensivo de capacidade de processamento: adequado para uma ampla variedade de cargas de trabalho de HPC, inferência de IA/ML, pré-processamento de dados e aplicativos que precisam de um desempenho significativamente melhor do que o NFS tradicional, a um preço econômico. | A partir de US$ 0,21/GiB por mês |
125 MB/s/TiB Ideal para cargas de trabalho focadas em capacidade com requerimentos de acesso paralelo: projetado para cenários em que grandes capacidades e acesso paralelo ao sistema de arquivos são essenciais. Bom para tarefas paralelas com menos vinculação de E/S. | A partir de US$ 0,145/GiB por mês |
25 MB/s/TiB – dinâmico Desempenho dinâmico com armazenamento em cache no nível do bloco para dados frequentes. Ideal para cargas de trabalho armazenáveis em cache, em que leituras e gravações se concentram em um subconjunto de um corpus de dados maior. Fornece um namespace unificado para dados quentes e frios. | A partir de US$ 0,06/GiB por mês |
Conheça os preços do Google Cloud. Confira todos os detalhes de preços.
Preços do Managed Lustre
Os preços do Managed Lustre são baseados principalmente no local e no nível de serviço.
1.000 MB/s/TiB
Ideal para cargas de trabalho de alto desempenho que querem treinar IA/ML, em que a capacidade de processamento é fundamental.
A partir de US$ 0,60/GiB por mês
500 MB/s/TiB
Melhor para equilíbrio de alto desempenho: excelente para cargas de trabalho exigentes de IA/ML, aplicativos complexos de HPC e análises intensivas em dados que exigem capacidade de processamento substancial, mas podem se beneficiar de uma relação preço-desempenho mais equilibrada.
A partir de US$ 0,34/GiB por mês
250 MB/s/TiB
Ideal para HPC de uso geral e IA com uso intensivo de capacidade de processamento: adequado para uma ampla variedade de cargas de trabalho de HPC, inferência de IA/ML, pré-processamento de dados e aplicativos que precisam de um desempenho significativamente melhor do que o NFS tradicional, a um preço econômico.
A partir de US$ 0,21/GiB por mês
125 MB/s/TiB
Ideal para cargas de trabalho focadas em capacidade com requerimentos de acesso paralelo: projetado para cenários em que grandes capacidades e acesso paralelo ao sistema de arquivos são essenciais. Bom para tarefas paralelas com menos vinculação de E/S.
A partir de US$ 0,145/GiB por mês
25 MB/s/TiB – dinâmico
Desempenho dinâmico com armazenamento em cache no nível do bloco para dados frequentes. Ideal para cargas de trabalho armazenáveis em cache, em que leituras e gravações se concentram em um subconjunto de um corpus de dados maior. Fornece um namespace unificado para dados quentes e frios.
A partir de US$ 0,06/GiB por mês
Conheça os preços do Google Cloud. Confira todos os detalhes de preços.
Caso de negócio
Conheça nossos clientes do Managed Lustre
"Nossa capacidade de ajudar as empresas a identificar e bloquear áudios, vídeos e imagens deepfake depende da qualidade dos nossos modelos. O Lustre gerenciado é essencial para o treinamento bem-sucedido do nosso modelo com os conjuntos de dados dinâmicos. Ele satura totalmente nossas GPUs e é 6 vezes mais rápido do que as outras soluções de armazenamento que avaliamos."
Assista a história de sucesso aqui.
—Zohaib Ahmed, CEO da Resemble AI
"O Managed Lustre nos permite escalonar em 3 vezes o treinamento de modelo de IA para o AFEELA Intelligent Drive em comparação com outras soluções do Google Cloud."
—Motoi Kataoka, gerente sênior da plataforma de análise de dados e IA da Sony Honda Mobility Inc.
"Ao integrar o Managed Lustre aos VTC (agora Managed Training Clusters na plataforma de agentes do Gemini Enterprise), a Salesforce AI Research eliminou os gargalos típicos de onboarding, o que nos permitiu começar a trabalhar imediatamente com a carga de trabalho de inferência. Esse armazenamento de alta capacidade e baixa latência mantém nossas GPUs B200 totalmente saturadas, gerando um ganho de desempenho substancial na inferência de modelos de linguagem grandes em comparação com a H200. Para nossos clientes, isso se traduz diretamente em agentes de IA mais rápidos e responsivos que podem lidar com raciocínios complexos com uma fração da latência anterior."
—Lavanya Karanam, engenheira-chefe de software da Salesforce
"A migração para o Google Cloud mudou fundamentalmente o ritmo da minha pesquisa. Meu trabalho envolve o treinamento de redes neurais em grande escala com base em conjuntos de dados massivos, incluindo o Common Corpus completo, que a equipe de cluster carregou e tornou acessível diretamente para mim. O conjunto de dados completo simplesmente não seria possível com nenhuma outra infraestrutura que eu tivesse acesso prático. Com o Lustre gerenciado, a ingestão que antes era um gargalo no meu pipeline agora é concluída em segundos, minhas GPUs são usadas de forma consistente e gasto muito menos tempo esperando na fila. O resultado é um tempo de insight mensuravelmente mais rápido em todos os experimentos que realizo."
Christopher J. Lynch, Ph.D., Professor assistente de pesquisa, Virginia Modeling, Analysis, & Simulation Center (VMASC), Old Dominion University
O Managed Lustre eliminou pelo menos 50% das interrupções que enfrentamos ao executar experimentos de treinamento para modelos de raciocínio matemático, permitindo que executemos o dobro de experimentos. Integramos o serviço como um cache regional para checkpoints "quentes" e conseguimos uma inicialização e persistência de checkpoints mais rápidas, confiáveis e convenientes. No nosso fluxo de trabalho, os jobs de treinamento gravam checkpoints que a inferência subsequente ou novos jobs de treinamento consomem em um sistema off-line, resultando em um aumento de até 15 vezes na velocidade de recuperação de dados e uma diminuição de mais de 50% no tempo de inicialização. A capacidade de usar o Lustre como um sistema de arquivos montado confiável com desempenho sólido imediato permitiu que nossa equipe de pesquisa fosse mais autossuficiente na experimentação com novas tecnologias de treinamento, permitindo o dobro de ciclos de iteração, mantendo um desempenho superior em relação à busca dos mesmos dados em outras opções de armazenamento."
—Riley Patterson, líder de infraestrutura da Harmonic
"Ao compartilhar um cluster de GPU entre várias organizações, precisávamos de um armazenamento de alto desempenho que pudesse acompanhar o ritmo sem se tornar um gargalo. O Managed Lustre simplificou a implantação, e os recursos de cota nos permitem compartilhar a capacidade de armazenamento entre as equipes de maneira organizada. Mesmo com picos de E/S simultâneos de nós de GPU em execução ao mesmo tempo, não vimos gargalos na capacidade de processamento."
— Jiyeon Jung, engenheiro sênior de infraestrutura de IA, LG AI Research
O Managed Lustre permitiu que a Atlassian criasse um sistema de treinamento de vários nós eficiente e confiável que usa GPUs preemptivas. O Lustre transformou os eventos de preempção de reexecuções de treinamento caras em restaurações gerenciáveis de 5 minutos. Para nosso treinamento de IA de vários nós no GKE, ter uma única camada de armazenamento compartilhada entre pods é a diferença entre cargas de trabalho que travam nas transferências de dados e cargas de trabalho que escalonam de maneira limpa, oferecendo uma capacidade de processamento quase 5 vezes maior e uma utilização de GPU 70% melhor, em comparação com um sistema baseado em NVMe. Agora, ela é nossa camada de armazenamento padrão para treinamento distribuído na Atlassian."
— Vishal Natani, gerente sênior de engenharia de ML, plataforma de ML, Atlassian
Como escalonar cargas de trabalho do GKE com o Managed Lustre
Um guia sobre como usar o driver CSI do Managed Lustre com o Google Kubernetes Engine (GKE) para provisionar facilmente armazenamento de alto desempenho para cargas de trabalho de IA, ML e HPC conteinerizadas. Leia o blog.
Como acelerar a IA e o HPC com o Managed Lustre
Visão geral de como o Managed Lustre simplifica a implantação de sistemas de arquivos paralelos para cargas de trabalho de computação de alto desempenho. Leia o blog.
Cache externo de chave-valor com o Managed Lustre
Um aprofundamento no uso do Lustre para descarregar caches de chave-valor para inferência de modelos de linguagem grandes (LLM), reduzindo o overhead de memória em TPUs/GPUs. Leia o blog.





