Intelligence artificielle
Amazon lance SageMaker HyperPod Inference Gateway pour optimiser l'IA générative
- Amazon introduit un module Kubernetes natif pour Amazon EKS, réduisant la latence des requêtes IA jusqu'à 82 %.
- L'outil utilise des signaux GPU en temps réel pour router les demandes vers les pods les plus adaptés.
- Aucune modification des serveurs de modèles ou des applications clientes n'est requise.