S’il est amusant d’imiter les œuvres d’artistes disparus comme Van Gogh ou Frida Kahlo avec un générateur d’IA, il n’en va pas de même pour les artistes vivants. Permettre à n’importe qui de créer une image « dans le style » d’un artiste peut inonder son marché de contrefaçons, ajoutant ainsi une confusion autour de l’authenticité et une perte potentielle de revenus.
En réponse, les gens cherchent un moyen de protéger leurs images des générateurs d’art IA. Les réponses ne sont peut-être pas parfaites ou infaillibles, mais il existe des moyens de défendre vos images contre l’utilisation par des générateurs d’art IA.
Comment les générateurs d’IA obtiennent vos images
Les générateurs d’art IA passent par une période d' »entraînement » pour apprendre à produire une image à partir d’un texte. Dans le cadre de ce processus d’apprentissage, ils doivent étudier des centaines de millions de paires image-texte pour finir par générer une image précise d’objets, de couleurs et de scènes du monde réel, ainsi que des techniques et un style artistiques.
Il se trouve que les modèles d’IA doivent apprendre de la créativité des humains. Par exemple, Midjourney et Stability Diffusion sont deux générateurs d’art IA entraînés sur l’ensemble de données LAION-5B à code source ouvert, qui contient des milliards d’images provenant de l’internet.
En utilisant des robots d’exploration du Web pour « gratter » les sites Web à la recherche de données, ces ensembles de données créent des listes d’URL d’images, ainsi que leur légende, dans quelque chose qui pourrait ressembler à une énorme feuille de calcul Excel. Si vous avez déjà publié vos œuvres d’art en ligne, elles peuvent figurer dans un ensemble de données d’images et donc être utilisées pour entraîner l’IA, que vous y ayez consenti ou non.
1. Exclure les jeux de données d’entraînement de l’IA
Spawning est un groupe d’artistes dont le site Web populaire, Have I Been Trained ?, peut être utilisé pour vérifier si vos images figurent dans le jeu de données LAION-5B. Ils ont pris l’initiative d’ajouter une fonction permettant de se retirer de la base de données. En vertu d’un accord, Spawning transmettra les listes d’exclusion des utilisateurs à LAION, qui a déclaré qu’il honorera la demande et retirera ces images de sa collection.
L’outil d’opt-out de Spawning nécessite encore quelques développements car, au moment de la rédaction de cet article, il n’est pas possible d’ajouter plusieurs images à la fois. Il n’existe pas non plus d’accord d’exclusion avec d’autres ensembles de données qui pourraient être utilisés pour entraîner des modèles d’IA.
Étant donné que de nombreuses sociétés d’IA ne divulguent pas les détails les plus fins sur la façon dont leurs modèles d’IA sont construits, il est parfois difficile de savoir quel ensemble de données elles utilisent. DALL-E est un générateur d’art d’IA populaire qui ne partage pas cette information.
Par ailleurs, si vous utilisez DeviantArt pour partager vos œuvres d’art, vos images sont désormais protégées par défaut contre toute utilisation pour des ensembles de données d’entraînement d’IA. Cela fonctionne en marquant votre image avec « noai », ce qui signifie que si un modèle d’IA s’avère avoir utilisé votre image pour l’entraînement, il violera les conditions d’utilisation de DeviantArt.
Bien entendu, ces mesures d’exclusion ne sont pas appliquées et peuvent donc être ignorées par des tiers s’ils le souhaitent. Bien que cette solution ne soit pas la plus efficace, elle ouvre la voie à davantage de règles et de réglementations pour protéger le travail des artistes.
Dans un monde idéal, les gens auraient la possibilité d’accepter, plutôt que de refuser. Nous espérons que cela se produira à l’avenir. Pour plus de détails sur la façon de retirer vos images des ensembles de données, consultez notre guide sur la façon de retirer vos images de l’entraînement de l’IA.
2. Copyright de votre travail
La question de la légalité de la pratique du raclage d’images sur Internet a été portée à l’attention des tribunaux. Et pour aider les artistes à présenter des preuves de leur côté, les droits d’auteur sur les images qu’ils possèdent sont indispensables.
Au début de l’année 2023, la célèbre dessinatrice de bandes dessinées Sarah Andersen a fait partie d’un groupe d’artistes qui ont intenté un procès aux sociétés d’intelligence artificielle Stability AI et Midjourney, ainsi qu’au site Web de partage d’œuvres d’art DeviantArt, pour avoir récupéré leurs œuvres sans leur consentement, y compris celles de millions d’autres artistes.
Un autre exemple est le site Web d’images de stock, Getty Images, qui a intenté un procès contre Stability AI pour avoir raclé ses images sans licence. L’entreprise a découvert que ses images protégées par le droit d’auteur étaient utilisées lorsque les images générées par l’IA ont commencé à apparaître avec le filigrane de Getty Images – un indice assez évident.
Si la légalité sera déterminée en temps voulu, le droit d’auteur est l’une des rares choses qui peuvent être utilisées pour lutter pour les droits du travail des artistes, comme on l’a vu dans les cas que nous avons mentionnés. Il n’est peut-être pas à jour avec la technologie de l’IA, mais il peut contribuer à votre défense à l’avenir.
C’est une pratique qui vaut de toute façon la peine d’être apprise afin que vous puissiez protéger votre travail contre le vol, que l’IA soit impliquée ou non. Suivez notre guide sur le droit d’auteur pour vos photos afin de découvrir en détail comment tout cela fonctionne.
3. Bloquez les robots des sites Web avec Robots.txt
Les ensembles de données d’images ne sont capables d’indexer un grand nombre d’images que parce qu’ils utilisent ce que l’on appelle des « web crawlers ». Comme leur nom l’indique, ils parcourent les sites Web à la recherche d’informations particulières.
Certains crawlers sont utiles et aident les moteurs de recherche comme Google à trouver et à indexer les informations les plus pertinentes à afficher sur leur page de résultats de recherche. D’autres sont utilisés pour rechercher des images sur des sites Web afin de les inclure dans des ensembles de données d’apprentissage de l’IA.
C’est là que Robots.txt entre en jeu. Robots.txt est un fichier texte qui peut être placé dans le code backend d’un site Web pour indiquer aux robots d’exploration ce qu’ils peuvent et ne peuvent pas analyser. Vous pouvez l’utiliser pour empêcher un crawler de regarder certaines pages ou certains fichiers, ce qui est utile si vous ne voulez pas que vos images soient utilisées par l’IA.
Si vous voulez en savoir plus, lisez notre guide sur ce qu’est un crawler web et comment il fonctionne. Pour ceux qui ont un site Web, demandez à votre développeur d’intégrer un fichier Robots.txt dans le code de votre site afin d’empêcher que vos images ne soient récupérées par les ensembles de données d’entraînement de l’IA.
Ce que l’on peut attendre de l’avenir
C’est frustrant de devoir rivaliser avec les modèles d’IA, mais d’autres solutions sont en route.
D’une part, des procédures judiciaires sont en cours pour déterminer ce qui est légal et comment le droit d’auteur fonctionne avec la génération d’images par l’IA. L’issue de ces débats publics fixera des normes juridiques, voire suscitera des réglementations, que les entreprises d’IA devront suivre.
D’autre part, les développeurs réfléchissent à la manière de résoudre le problème en utilisant de nouvelles technologies. Une étude prometteuse montre que l’on peut utiliser l’IA pour se combattre elle-même en rendant une image « inapprenable » pour les ensembles de données d’entraînement de l’IA.
Comme l’explique le Dr Sarah Monazam Erfani de l’Université de Melbourne : « Nous avons conçu une technique basée sur l’apprentissage automatique qui identifie et modifie juste assez de pixels dans une image pour confondre l’IA et la transformer en une image « inapprenable ». Le changement est très faible et imperceptible pour l’œil humain, mais il introduit suffisamment de ‘bruit’ dans une image pour la rendre inutile pour l’apprentissage de l’IA. »
Si vous êtes une personne touchée par les générateurs d’images d’IA, cela vaut la peine de faire entendre votre voix pour que ces entreprises soient poussées à changer leurs pratiques. Ce n’est qu’en raison d’un fort retour d’information de la part de la communauté DeviantArt qu’une nouvelle préférence d’exclusion a été créée, alors assurez-vous de donner votre avis aux plateformes de partage d’art et aux entreprises d’IA.
Défendre vos images contre l’IA
Vous pouvez protéger vos images des générateurs d’art de l’IA en vous retirant des ensembles de données d’entraînement de l’IA, en mettant vos images sous copyright et en utilisant la norme Robots.txt. Bien que cela ne garantisse pas que vos images restent en dehors des systèmes d’IA, l’utilisation de ces trois méthodes vous donnera la meilleure défense jusqu’à ce que d’autres solutions soient développées.
De nouveaux outils sont en cours de développement, notamment des moyens d’ajuster imperceptiblement votre image afin que l’IA ne puisse pas en tirer de leçons, ce qui la rendrait inutile pour l’entraînement des générateurs d’art de l’IA. En attendant, n’abandonnez pas. Il existe encore des moyens de protéger vos images contre les générateurs d’art IA.
