Intelligence artificielle
Mercury 2.5 : un modèle LLM atteint 770 tokens par seconde
- Le modèle Mercury 2.5 atteint une vitesse de 770 tokens par seconde en inférence.
- Cette performance est mesurée par Artificial Analysis sur des benchmarks standardisés.
- Le modèle vise à optimiser les coûts et la latence pour les applications d'IA.