OpenAI et Broadcom dévoilent Jalapeño, une puce dédiée à l'inférence des LLM
OpenAI intègre du matériel sur mesure avec la puce Jalapeño, co-développée avec Broadcom, optimisée pour l'inférence des grands modèles de langage (LLM).
Ce composant devrait être déployé à grande échelle d'ici fin 2026, visant à améliorer les performances et l'efficacité des traitements d'IA.
Cette collaboration marque une étape dans la verticalisation du hardware pour les besoins spécifiques des acteurs de l'IA générative.
1 rédaction rapporte ce fait
Factae établit le fait ; chaque récit est à un clic, chez sa rédaction.