SageMaker: +45% Throughput con Separación GPU
arquitectura-cloudLa separación GPU en SageMaker HyperPod optimiza el throughput hasta en un 45%. DPD resuelve cuellos de botella al separar prefill y decode, crucial para la inferencia LLM.
Read Report →