SageMaker: Aumento de 45% no Throughput com Separação GPU
ArquiteturaA técnica DPD (Separação GPU) resolve a latência em clusters SageMaker HyperPod, otimizando o uso da GPU e impulsionando a inferência LLM.
Read Report →