🔥 Les essentiels de cette actualité
- Google a remporté une enchère à 10 millions de dollars pour acquérir 34 ans de données internes de Spirit Airlines, incluant dossiers médicaux et fichiers Teams.
- Le syndicat AFA recense 500 millions d’enregistrements Teams et 175 000 dossiers de salariés concernés : des données contenant violences conjugales et fausses couches.
- La désidentification promise par Google est-elle crédible, quand l’IA peut recroiser des jeux de données anonymisés pour réidentifier des individus ?
- Quelles protections juridiques les travailleurs américains peuvent-ils espérer, dans un vide légal que l’explosion des besoins en données d’entraînement transforme en eldorado ?
Google vient de remporter une enchère de 10 millions de dollars portant sur quelque trente-quatre années de données internes de Spirit Airlines, compagnie aérienne américaine en faillite, mais la vente doit encore être approuvée par le tribunal. L’ensemble comprend notamment des données de facturation, d’opérations de vol, de ventes de services Wi-Fi, mais aussi des dossiers de salariés, des relevés de temps de travail et des millions de fichiers issus de Microsoft Teams, OneDrive et SharePoint. Google a confirmé que ces données pourraient servir à améliorer ses produits et ses modèles d’intelligence artificielle. L’entreprise affirme que les données clients seront exclues et qu’elle ne recevra aucune information personnelle provenant de cet ensemble. Mais le syndicat des agents de bord conteste précisément la capacité du dispositif prévu à garantir cette confidentialité.
L’Association of Flight Attendants (AFA), qui représente 5 500 anciens agents de bord de Spirit et compte environ 55 000 membres au total, a déposé une objection formelle devant le tribunal des faillites. Ses avocats dressent un inventaire vertigineux : plus d’un million de relevés de pointage, plus de 175 000 dossiers de salariés, près de 150 000 formulaires fiscaux, 80 000 comptes de messagerie électronique, 17 millions d’éléments OneDrive individuels, 20,6 millions de fichiers SharePoint partagés et 500 millions d’enregistrements Microsoft Teams. Derrière ces chiffres, un ancien agent de bord interrogé sous couvert d’anonymat affirme que ces fichiers peuvent contenir des informations médicales liées aux assurances, des mentions de fausses couches, de violences conjugales ou encore des échanges concernant des négociations syndicales confidentielles.
« Ces données n’ont rien à faire dans une vente. C’est scandaleux ! », a déclaré Sara Nelson, présidente de l’AFA.
Ce qui rend cette affaire particulièrement révélatrice, c’est l’asymétrie juridique qu’elle expose entre consommateurs et salariés. Aux États-Unis, le droit des faillites et certaines lois sur la protection des données ont progressivement intégré des garde-fous concernant les informations des consommateurs. Les données des travailleurs bénéficient d’un cadre beaucoup moins uniforme. Quelques États, dont la Californie, ont commencé à adopter des protections explicites concernant les données des salariés, mais une grande partie du pays évolue encore dans une zone juridique nettement moins protectrice pour eux, alors même que la valeur commerciale de leurs informations augmente avec l’essor de l’intelligence artificielle.
La « désidentification » ne suffit plus
Le dispositif prévu pour la transaction repose notamment sur la désidentification. Google choisirait ou approuverait un tiers chargé de supprimer les éléments permettant de relier les informations à une personne précise. L’AFA conteste frontalement l’efficacité de cette garantie. Ses avocats soutiennent que les progrès de l’intelligence artificielle rendent la réidentification plus facile en permettant de croiser plusieurs ensembles de données même lorsque les noms et autres identifiants directs ont été supprimés. La promesse d’anonymisation se trouve ainsi fragilisée par les capacités mêmes des technologies que ces données pourraient contribuer à entraîner.
Ari Ezra Waldman, professeur de droit à l’Université de Californie à Irvine et spécialiste des questions de vie privée et de technologie, résume l’enjeu en soulignant que la valeur économique de pratiquement toute production linguistique augmente à mesure que les investissements dans les grands modèles de langage explosent.
« Dans un monde où des milliards et des milliers de milliards sont dépensés dans les grands modèles de langage, tout ce qui implique l’usage de mots devient susceptible d’être exploité à des fins lucratives. Si cette vente se fait sans aucune limite, aucun salarié ne bénéficie d’aucune protection. »
La remarque dépasse largement Spirit Airlines. Des entreprises spécialisées dans l’acquisition de données provenant de sociétés disparues ou en difficulté ont récemment trouvé un marché dans la revente d’anciens messages Slack, de dépôts GitHub, de contenus Google Drive et d’autres archives professionnelles à des entreprises travaillant sur l’intelligence artificielle. La liquidation d’une société peut ainsi transformer des années d’échanges numériques en ressource commerciale. Les salariés concernés se retrouvent face à la possibilité que des données produites dans le cadre de leur emploi soient ensuite valorisées pour entraîner des systèmes d’IA.
Seema Patel, professeure à la faculté de droit de l’Université de Californie à San Francisco et spécialiste du droit du travail et des technologies, identifie le cœur du problème : « Il n’existe aucune frontière entre les informations que le salarié produit dans l’exercice de son travail et ses informations personnelles. Le droit n’a pas rattrapé la réalité. » Elle estime que, dans ce domaine, les entreprises disposent encore d’une marge de manœuvre considérable.
Ce qui frappe également dans cette affaire, c’est le profil des travailleurs concernés. Il s’agit notamment d’agents de bord, et non seulement de cadres produisant quotidiennement des documents stratégiques ou techniques. Pourtant, leurs plannings, leurs communications professionnelles, leurs informations administratives et parfois médicales peuvent constituer des ensembles massifs de données ayant une valeur pour l’industrie de l’IA. La valeur commerciale de la donnée professionnelle ne concerne donc plus uniquement certains métiers numériques. Tout salarié peut désormais générer, au cours de sa carrière, une masse d’informations susceptible d’intéresser des entreprises cherchant de nouveaux corpus d’entraînement.
L’audience concernant la vente a été reportée au 9 septembre. Son issue pourrait avoir des conséquences bien au-delà de Spirit Airlines. Ari Ezra Waldman estime qu’elle pourrait influencer durablement la manière dont syndicats et entreprises considèrent la vente et l’utilisation des données des salariés pour entraîner des systèmes d’intelligence artificielle. Pour l’AFA, l’objectif immédiat est d’exclure les données des agents de bord de la transaction ou de leur garantir un niveau de protection comparable à celui accordé aux données des consommateurs.
Dans un registre plus immédiat, les anciens agents de bord réclament par ailleurs environ 68 millions de dollars au titre des congés, des soins de santé et des arriérés de salaire. L’un d’eux résume ainsi leur colère : « Nous avons le sentiment que c’est une gifle de plus : nous attendons toujours les salaires qui nous sont dus pendant que Spirit va empocher 10 millions de dollars grâce à nos informations privées. » Entre la promesse de désidentification et la réalité économique d’une procédure de faillite dans laquelle des décennies de données professionnelles peuvent devenir un actif valorisable, l’écart est considérable. L’affaire Spirit pose ainsi une question appelée à devenir centrale avec l’expansion de l’IA : jusqu’où une entreprise peut-elle monétiser les traces numériques produites par ses salariés lorsque ceux-ci n’en contrôlent plus l’usage ?
IMPORTANT - À lire
Données des salariés, IA, faillites : ces rapports de force redessinent l'économie mondiale. Notre revue papier décrypte chaque mois ces mutations en profondeur.
Ne subissez plus l'actualité : comprenez-la. Recevez chaque mois une analyse rigoureuse des grands enjeux. Abonnez-vous à la revue papier.
Source : wired.com




Participez au débat, et partagez votre opinion !
Faites avancer la discussion en donnant votre avis à la communauté.