As GPUs sem servidor permitem-lhe executar as suas cargas de trabalho de IA sob demanda de forma contínua, com dimensionamento automático, arranque a frio otimizado e faturação por segundo. Tem governação de dados incorporada com escala para zero quando não está em uso, e reduz a sobrecarga operacional para suportar facilmente inferência de modelos personalizados em tempo real e outras tarefas relacionadas com GPU. Os cenários comuns para GPUs sem servidor incluem inferência em tempo real e em lote, aprendizagem automática intensiva em computação, computação de alto desempenho (HPC) e análise de dados.