Microsoft Research : des descriptions détaillées surpassent la taille brute pour les générateurs d'images
Lens, le nouveau modèle texte-vers-image de Microsoft Research, atteint 3,8 milliards de paramètres seulement tout en rivalisant avec des modèles bien plus volumineux sur les benchmarks standards
L'efficacité provient de 800 millions de descriptions d'images générées par GPT-4.1, bien plus détaillées que le texte alt basique du web, remplaçant l'approche par échelle brute
Le code et les poids du modèle sont publiés en open-source, permettant une réplication et une itération communautaire sur l'optimisation qualité-paramètres
1 rédaction rapporte ce fait
Factae établit le fait ; chaque récit est à un clic, chez sa rédaction.
3,8 milliards de paramLens, le nouveau modèle texte-vers-image de Microsoft Research, atteint 3,8 milliards de par…800 millions de descriptionsLens, le nouveau modèle texte-vers-image de Microsoft Research, atteint 3,8 milliards de par…
Bluesky annonce le lancement de ses services protocolaires pour AT Protocol. L'objectif est de permettre…