Mises à jour d'inférence pour Amazon SageMaker AI
AWS a déployé 13 nouvelles fonctionnalités d'inférence cette année pour SageMaker AI. Ces nouveautés concernent les points de terminaison gérés et HyperPod Inference, incluant notamment la mise en cache KV multiniveau.
Lire la source →