Accueil Technologie
OpenAI a-t-il déjà perdu le contrôle de ChatGPT ?

OpenAI a-t-il déjà perdu le contrôle de ChatGPT ?

Le lancement de ChatGPT d’OpenAI a été suivi d’une excitation qui n’a d’égale que celle d’une poignée de produits technologiques dans l’histoire de l’Internet.


Alors que de nombreuses personnes sont ravies de ce nouveau service d’IA, l’excitation que d’autres ont ressentie s’est depuis transformée en inquiétudes, voire en craintes. Les étudiants trichent déjà avec ce service, de nombreux professeurs ayant découvert des dissertations et des devoirs rédigés par le chatbot IA. Les professionnels de la sécurité s’inquiètent de voir des escrocs et des acteurs de la menace l’utiliser pour rédiger des courriels de phishing et créer des logiciels malveillants.

Alors, avec toutes ces inquiétudes, OpenAI est-il en train de perdre le contrôle de l’un des plus puissants chatbots IA actuellement en ligne ? C’est ce que nous allons découvrir.


Comprendre le fonctionnement de ChatGPT

un robot doté d'un cerveau représentant l'intelligence artificielle

Avant de pouvoir se faire une idée précise de l’ampleur de la perte de contrôle d’OpenAI sur ChatGPT, nous devons d’abord comprendre le fonctionnement de ChatGPT.

En un mot, ChatGPT est entraîné en utilisant une collection massive de données provenant de différents coins d’Internet. Les données d’entraînement de ChatGPT comprennent des encyclopédies, des articles scientifiques, des forums Internet, des sites d’information et des référentiels de connaissances comme Wikipédia. En fait, il se nourrit de l’énorme quantité de données disponibles sur le World Wide Web.

En parcourant l’Internet, il rassemble des connaissances scientifiques, des conseils de santé, des textes religieux et toutes les bonnes données auxquelles vous pouvez penser. Mais il passe également au crible une tonne d’informations négatives : jurons, contenus NSFW et pour adultes, informations sur la façon de créer des logiciels malveillants, et la plupart des mauvaises choses que l’on peut trouver sur Internet.

Il n’y a pas de moyen infaillible de s’assurer que ChatGPT n’apprend que des informations positives en écartant les mauvaises. Techniquement, il n’est pas possible de le faire à grande échelle, surtout pour une IA comme ChatGPT qui doit s’entraîner sur une grande quantité de données. En outre, certaines informations peuvent être utilisées à la fois pour le bien et le mal, et ChatGPT n’aurait aucun moyen de connaître leur intention à moins de les placer dans un contexte plus large.

Donc, dès le départ, vous avez une IA capable du « bien et du mal ». Il est alors de la responsabilité d’OpenAI de s’assurer que le côté « mal » de ChatGPT n’est pas exploité pour des gains non éthiques. La question est la suivante : OpenAI en fait-elle assez pour garder ChatGPT aussi éthique que possible ? Ou OpenAI a-t-il perdu le contrôle de ChatGPT ?

ChatGPT est-il trop puissant pour son propre bien ?

robot en plastique au visage bleu

Au début de ChatGPT, le chatbot pouvait créer des guides sur la fabrication de bombes si vous le demandiez gentiment. Des instructions sur la fabrication de logiciels malveillants ou la rédaction d’un e-mail d’escroquerie parfait étaient également prévues.

Cependant, une fois qu’OpenAI s’est rendu compte de ces problèmes éthiques, la société s’est empressée d’adopter des règles pour empêcher le chatbot de générer des réponses qui encouragent des actions illégales, controversées ou contraires à l’éthique. Par exemple, la dernière version de ChatGPT refuse de répondre à toute question directe sur la fabrication de bombes ou sur la façon de tricher à un examen.

Malheureusement, OpenAI ne peut fournir qu’une solution de fortune à ce problème. Plutôt que de mettre en place des contrôles rigides sur la couche GPT-3 pour empêcher que ChatGPT ne soit exploité de manière négative, OpenAI semble se concentrer sur la formation du chatbot pour qu’il paraisse éthique. Cette approche ne prive pas ChatGPT de sa capacité à répondre aux questions concernant, par exemple, la tricherie aux examens – elle apprend simplement au chatbot à « refuser de répondre ».

Ainsi, si quelqu’un formule ses invites différemment en adoptant des astuces de jailbreak de ChatGPT, il est très facile de contourner ces restrictions de fortune. Au cas où vous ne connaîtriez pas le concept, les jailbreaks de ChatGPT sont des invites soigneusement formulées pour que ChatGPT ignore ses propres règles.

Jetez un coup d’oeil à quelques exemples ci-dessous. Si vous demandez à ChatGPT comment tricher aux examens, il ne produira aucune réponse utile.

Comment tricher aux examens par ChatGPT

Mais si vous jailbreakez ChatGPT en utilisant des invites spécialement conçues, il vous donnera des conseils pour tricher à un examen en utilisant des notes cachées.

Comment faire passer des notes cachées

Voici un autre exemple : nous avons posé une question contraire à l’éthique au ChatGPT vanille, et les protections d’OpenAI l’ont empêché de répondre.

hide a dead body by chatgpt

Mais lorsque nous avons demandé à notre instance jailbreakée du chatbot IA, nous avons obtenu des réponses semblables à celles des tueurs en série.

Options de masquage des cadavres

Il a même écrit un email d’arnaque classique de Prince nigérian quand on lui a demandé.

Email d'arnaque du prince nigérian

Le jailbreaking invalide presque complètement toutes les protections mises en place par OpenAI, soulignant que l’entreprise pourrait ne pas avoir de moyen fiable de garder son chatbot IA sous contrôle.

Nous n’avons pas inclus nos invites jailbreakées dans nos exemples pour éviter les pratiques contraires à l’éthique.

Que réserve l’avenir à ChatGPT ?

Technologie des machines-robots

Idéalement, OpenAI souhaite combler le plus grand nombre possible de failles éthiques pour éviter que ChatGPT ne devienne une menace pour la cybersécurité. Cependant, pour chaque mesure de protection mise en place, ChatGPT a tendance à perdre un peu de sa valeur. C’est un dilemme.

Par exemple, des mesures de protection contre la description d’actions violentes pourraient diminuer la capacité de ChatGPT à écrire un roman impliquant une scène de crime. En augmentant les mesures de sécurité, OpenAI sacrifie inévitablement une partie de ses capacités dans le processus. C’est la raison pour laquelle ChatGPT a subi un déclin significatif de ses fonctionnalités depuis qu’OpenAI a renouvelé ses efforts pour une modération plus stricte.

Mais combien de capacités supplémentaires de ChatGPT OpenAI sera-t-il prêt à sacrifier pour rendre le chatbot plus sûr ? Tout ceci est lié à une croyance de longue date au sein de la communauté de l’IA : les grands modèles de langage comme ChatGPT sont notoirement difficiles à contrôler, même par leurs propres créateurs.

OpenAI peut-il mettre ChatGPT sous contrôle ?

Pour l’instant, OpenAI ne semble pas avoir de solution claire et nette pour éviter l’utilisation non éthique de son outil. S’assurer que ChatGPT est utilisé de manière éthique est un jeu de chat et de souris. Alors qu’OpenAI découvre les moyens employés par les gens pour jouer le système, ses utilisateurs sont aussi constamment en train de bricoler et de sonder le système pour découvrir de nouvelles façons créatives de faire faire à ChatGPT ce qu’il n’est pas censé faire.

Alors, OpenAI trouvera-t-il une solution fiable à long terme à ce problème ? Seul le temps nous le dira.

0 0 votes
Évaluation de l'article
S’abonner
Notification pour
guest
0 Commentaires
Le plus ancien
Le plus récent Le plus populaire
0
Nous aimerions avoir votre avis, veuillez laisser un commentaire.x