Twitch regrette mais assume : les contenus des chaînes entraînent par défaut l’IA d’Amazon
Faut nous comprendre, on peut pas faire autrement
Illustration : Flock
Le 13 août à 15h42
Twitch exploite les contenus des chaînes des créateurs de contenus pour entraîner les modèles IA d’Amazon. Rien de vraiment étonnant, la plateforme de streaming étant la propriété du géant du commerce en ligne, et puis bien d’autres entreprises font de même avec leurs utilisateurs. Le hic ici, c’est que la fonction est activée par défaut…
Twitch regrette mais assume : les contenus des chaînes entraînent par défaut l’IA d’Amazon
Faut nous comprendre, on peut pas faire autrement
Illustration : Flock
Twitch exploite les contenus des chaînes des créateurs de contenus pour entraîner les modèles IA d’Amazon. Rien de vraiment étonnant, la plateforme de streaming étant la propriété du géant du commerce en ligne, et puis bien d’autres entreprises font de même avec leurs utilisateurs. Le hic ici, c’est que la fonction est activée par défaut…
Droit
Droit
5 min
Une bonne partie de la communauté des créateurs de Twitch n’apprécie pas – c’est un euphémisme – l’IA générative. Depuis ce mercredi 12 août, c’est donc une vague de colère qui s’abat sur la plateforme, après que celle-ci a activé par défaut l’autorisation d’exploiter le contenu des chaînes pour entraîner les modèles IA d’Amazon. Tout peut y passer : streams, vidéos à la demande, clips, chats de stream, images et textes de la chaîne.

« Votre audio pourrait contribuer à améliorer les modèles de conversion de la parole en texte. Cela permettrait d’améliorer les sous-titres sur Twitch, mais aussi sur l’ensemble des services Amazon », illustre ainsi la FAQ mise en ligne pour l’occasion. Il reste heureusement la possibilité de désactiver l’utilisation des contenus, dans les réglages « Sécurité et confidentialité » de Twitch.
Néanmoins, même en désactivant l’option, les données de discussion dans un chat peuvent tout de même être exploitées pour entraîner les modèles IA d’Amazon si quelqu’un dans le chat a accepté de participer.
Twitch face à la colère des créateurs
La nouveauté n’est pas passée inaperçue. Et Twitch a bien conscience de l’impopularité de l’IA générative chez ses créateurs. Lors d’un stream houleux repris par Aftermath, Mike Minton, directeur produit du service, et Mary Kish, responsable de la communauté, ont tenté d’expliquer cette décision. Devant le barrage de questions sur le caractère « opt-in » de l’option, le directeur produit n’a pas fait mystère de la raison pour laquelle Twitch avait procédé de la sorte.
« Alors, pourquoi est-ce que ce n’est pas une option à activer volontairement ? » a expliqué Mike Minton. « Il y a une réponse honnête, et je pense que la plupart d’entre vous peuvent probablement la comprendre : si c’était à activer volontairement, personne ne le ferait. C’est honnêtement la réponse. » Aucun créateur de Twitch n’autoriserait volontairement de donner ses contenus pour entraîner les modèles IA d’Amazon, c’est pourquoi l’option est activée par défaut.
Voilà qui a au moins le mérite de la franchise. Et de la clarté… même si le reste de la discussion n’a malheureusement pas beaucoup éclairé les créateurs en colère. « C’est un sujet délicat, et je pense que notre communauté a eu la réaction à laquelle je m’attendais de votre part, à savoir que vous n’aimez pas ça », a convenu Mary Kish, qui elle-même a désactivé l’option.
Les mains liées de Twitch
Pourquoi diable avoir activé cette fonction par défaut ? Parce que si Amazon n’exploitait pas les streams pour ses modèles, d’autres entreprises l’auraient fait. « Si des modèles ont été entraînés sur [vos contenus], il se peut que ce soit Amazon, ou pas », a indiqué Mike Minton. « Il s’agissait probablement de l’une des dizaines d’entreprises qui créent des modèles et utilisent tout contenu accessible publiquement qu’elles peuvent trouver. »
Il se trouve que Twitch est la plateforme de streaming dominante, et qu’Amazon est une des plus grandes entreprises de la planète. Autrement dit, ce ne sont pas de petits acteurs soumis aux diktats des mastodontes de leurs secteurs respectifs : ils peuvent imposer leurs propres règles. Hélas, les pauvres n’ont visiblement pas le choix, à en croire Mike Minton :
« Je ne peux pas l’affirmer avec certitude, mais je pense qu’il est assez raisonnable de supposer que presque tout contenu disponible est utilisé pour l’entraînement de modèles, d’une manière ou d’une autre, que ce soit autorisé ou non. Donc je pense que nous devons aussi reconnaître qu’il y a beaucoup d’éléments ici qui échappent même à notre contrôle direct. »
Minuscule consolation : ni Amazon ni Twitch ne revendent les données à des tiers. « Nous ne revendons pas les données à d’autres entreprises qui entraînent des modèles (…) Ce n’est pas ce qui se passe ici. Nous ne tirons aucun profit et ne gagnons pas d’argent en vendant vos données », affirme Minton.
Quant à savoir si Amazon exploitait déjà en douce les contenus des streams pour l’entraînement de son IA, les deux responsables bottent en touche.« Je ne peux pas me prononcer sur ce qu’Amazon utilise ou pas précisement comme contenu concernant l’entrainement », a déclaré Mike Minton. Lui et Mary Kish encouragent les utilisateurs de Twitch à désactiver l’option : « Les chiffres de désinscription nous aideront à réaffirmer que notre communauté n’est pas réceptive à l’IA sous quelque forme que ce soit », a affirmé la responsable de la communauté.
Commentaires (22)
Abonnez-vous pour prendre part au débat
Déjà abonné ou lecteur ? Se connecter
Cet article est en accès libre, mais il est le produit d'une rédaction qui ne travaille que pour ses lecteurs, sur un média sans pub et sans tracker. Soutenez le journalisme tech de qualité en vous abonnant.
Accédez en illimité aux articles d'un média expert
Profitez d'au moins 1 To de stockage pour vos sauvegardes
Intégrez la communauté et prenez part aux débats
Partagez des articles premium à vos contacts
Abonnez-vousLe 13 août à 16h55
Le 13 août à 19h13
Le 14 août à 10h07
Le 13 août à 17h09
Ce serait dommage que l'honnêteté leur retombe dessus, mais ça fait une belle preuve, quand même.
Modifié le 14 août à 12h24
C'est la même mécanique fascisante à l’œuvre quand par exemple on est partisan de sacrifier des droits au motif de fonctionner "mieux", retirer/ignorer le droit de parole pour aller plus vite, déshumaniser des processus au prétexte d'efficience.
C'est une réflexion que certaines personnes, pourtant par ailleurs raisonnablement intelligentes, n'ont pas, notamment dans les sphères technologiques, les amenant à former/entretenir des composantes d'un fonctionnement technologiste.
Ce Mike Minton sonne fortement comme technologiste avec cette phrase. Et ils sont légion dans tout ce qui est informatique, par manque de culture informatique à tout le moins.
Les milieux du libre, sa philosophie, amènent systématiquement à conserver l'être humain au centre de la réflexion & des actions. En France, la loi du 6 janvier 1978 est une lointaine précurseure au RGPD en ce sens, et c'était déjà un petit miracle en soi.
Respectez les humains à la source et à la destination des systèmes informatiques, n'oubliez pas que ces systèmes les réifient, donc les maltraitent, et si vous œuvrez dans ces sphères, gardez un œil ouvert, veillez à ce que cette maltraitance systémique soit la plus limitée possible, et remettez régulièrement en question les décisions prises & action effectuées à l'aune de l'impact sur les personnes.
Les utilisateurs sont des humains : pas des clients, pas un identifiant.
Ainsi, quand on en vient au consentement, il est donc non-négociable de priver un être humain de son droit à décider de son être, et par extension de ses données : l'"opt-in" est la seul à devoir être considéré, l'"opt-out" est une perversion. Une évidence, finalement.
Merci Next pour l'alerte sur cette option dont je n'avais pas entendu parler. Je n'ai constaté à mon niveau aucune communication personnelle de Twitch.
Le 13 août à 17h41
Le 13 août à 19h26
La seule fois où je suis allé sur Twitch, c'est pour le live de Next après la reprise, j'ai donc peu d'infos sur ce qui y circule tous les jours.
En plus, ils peuvent tenter l'intérêt légitime qui semble avoir le vent en poupe en ce qui concerne l'IA pour la CNIL.
Donc, pourquoi se priveraient-ils de cette possibilité ? Il faut juste prévenir et permettre de s'y opposer.
Le 13 août à 23h37
Et je pense que c'est ici que ça du plomb dans l'aile.
Le 14 août à 11h24
[...]« Votre audio pourrait contribuer à améliorer les modèles de conversion de la parole en texte[...]
Le 14 août à 16h41
Beaucoup de streamers se filment en direct, je crois.
Le 13 août à 17h57
C'est certes pas faux et très transparent, mais la pente semble fichtrement glissante vue de ma fenêtre...
Le 13 août à 19h28
Le 14 août à 16h42
Le 14 août à 16h54
L'opt-out est possible en raison d'intérêts légitimes et la CNIL indique que ça peut être une base légale pour l'apprentissage de l'IA.
Donc, non, ça pourrait ne pas compter car il n'y a pas que le consentement comme base légale au traitement.
Le 14 août à 17h21
N'y a t-il pas une notion d'équilibre à trouver pour pouvoir invoquer cet argument ?
Le 14 août à 19h35
Le 14 août à 19h45
Le 17 août à 14h52
Et dire "[nous] ne gagnons pas d’argent en vendant vos données" alors qu'ils vont gagner de l'argent en revendant le résultat de leur exploitation, j'ai dû mal à voir, là aussi, en quoi ça change quelque chose en pratique.
Le 14 août à 10h10
Le 13 août à 20h16
Par contre, combien de temps ils se sont servi des contenus postés par
la matière premièreles utilisateurs en toute impunité avant que ça devienne trop bruyant, là...Modifié le 14 août à 15h25
Pour streamer, tu peux sinon utiliser ffmpeg et VLC et ne balancer tes données vidéos/audio à aucune plateforme. La ligne de commandes fait 3 lignes, avec 1Gbps en envoi tu peux servir 500 personnes à 2Mbps, très satisfaisant en H265 1080p, si tu veux plus, tu montes un relais RTP (nginx sait faire) ou tu prends "plus de Giga" ^^
Le problème de l'Internet est toujours le même : les gens centralisent, au lieu d'apprendre comment ça marche, puis décentraliser.
Modifié le 14 août à 16h45
En France, on avait finalement tout compris en 1980. ^^
Signaler un commentaire
Voulez-vous vraiment signaler ce commentaire ?