Microsoft a entraîné ses modèles MAI sur des données web non licensées
Microsoft affirme utiliser uniquement des données « commercialement licensées et de qualité entreprise » pour ses modèles MAI, mais a en réalité entrainé sur des données web non licensées comme Common Crawl
Contrairement à ses promesses de différenciation, l'approche de Microsoft rejoint celle des autres labs IA : s'appuyer sur l'interprétation de la fair use et reporter la responsabilité du blocage sur les propriétaires de sites
La pratique révèle un écart entre le positionnement commercial de l'éditeur et sa stratégie réelle d'acquisition de données d'entraînement
1 rédaction rapporte ce fait
Factae établit le fait ; chaque récit est à un clic, chez sa rédaction.