Grok, le chatbot de l'intelligence artificielle (AI) intégrés dans X (anciennement Twitter) et construit par la société d'Elon Musk, Xai, est de retour dans les gros titres après s'être appelé «mechahitler» et produit des remarques pro-nazies.
Les développeurs se sont excusés pour les «postes inappropriés» et «ont pris des mesures pour interdire le discours de haine» des messages de Grok sur les débats de X. sur les biais de l'IA ont également été relancés.
Mais la dernière controverse de Grok révèle non pas pour les résultats extrémistes, mais pour la façon dont il expose une malhonnêteté fondamentale dans le développement de l'IA. Musk prétend construire une IA de «recherche de vérité» sans biais, mais la mise en œuvre technique révèle une programmation idéologique systémique.
Cela équivaut à une étude de cas accidentelle sur la façon dont les systèmes d'IA intégrent les valeurs de leurs créateurs, la présence publique non filtrée de Musk rendant visible ce que les autres sociétés sont généralement obscures.
Grok est un chatbot d'IA avec «une touche d'humour et un soupçon de rébellion» développé par Xai, qui possède également la plate-forme de médias sociaux X.
La première version de Grok lancée en 2023. Des évaluations indépendantes suggèrent le dernier modèle, Grok 4, dépasse les concurrents sur les tests «d'intelligence». Le chatbot est disponible autonome et sur X.
XAI déclare que «les connaissances de l’IA devraient être globales et aussi éloignées que possible». Musk a précédemment positionné Grok comme une alternative de vérité aux chatbots accusés d'être «réveillé» par des commentateurs de droite.
Mais au-delà du dernier scandale du nazisme, Grok a fait la une des journaux pour générer des menaces de violence sexuelle, élever un «génocide blanc» en Afrique du Sud et faire des déclarations insultantes sur les politiciens. Ce dernier a conduit à son interdiction en Turquie.
Alors, comment les développeurs imprégnent-ils une IA avec de telles valeurs et de la forme du comportement du chatbot? Les chatbots d'aujourd'hui sont construits à l'aide de grands modèles de langue (LLMS), qui offrent plusieurs leviers que les développeurs peuvent s'appuyer.
Pré-formation
Premièrement, les développeurs organisent les données utilisées pendant la pré-formation - la première étape de la construction d'un chatbot. Cela implique non seulement de filtrer le contenu indésirable, mais aussi de souligner le matériel souhaité.
Le GPT-3 a été montré Wikipedia jusqu'à six fois plus que d'autres ensembles de données, car OpenAI le considérait comme une qualité supérieure. Grok est formé sur diverses sources, y compris des articles de X, qui pourraient expliquer pourquoi Grok a été signalé pour vérifier l'opinion d'Elon Musk sur des sujets controversés.
Musk a partagé que XAI conserve les données de formation de Grok, par exemple pour améliorer les connaissances juridiques et supprimer le contenu généré par LLM pour un contrôle de la qualité. Il a également fait appel à la communauté X pour des problèmes et des faits difficiles du «cerveau de la galaxie» qui sont «politiquement incorrects, mais néanmoins vrais».
Nous ne savons pas si ces données ont été utilisées, ni quelles mesures de contrôle de la qualité ont été appliquées.
Réglage fin
La deuxième étape, ajustée, ajuste le comportement de LLM en utilisant la rétroaction. Les développeurs créent des manuels détaillés décrivant leurs positions éthiques préférées, que les examinateurs humains ou les systèmes d'IA utilisent ensuite comme rubrique pour évaluer et améliorer les réponses du chatbot, codant efficacement ces valeurs dans la machine.
Une enquête d’initié d’affaires a révélé que les instructions de XAI aux «tuteurs d’IA» humaines leur ont demandé de rechercher «l’idéologie réveillée» et «annuler la culture». Bien que les documents d'intégration aient déclaré que Grok ne devrait pas "imposer une opinion qui confirme ou refuse le biais d'un utilisateur", ils ont également déclaré qu'il devrait éviter les réponses qui prétendent que les deux côtés d'un débat ont du mérite lorsqu'ils ne le font pas.
Invites du système
L'invite du système - instructions fournies avant chaque conversation - guide le comportement une fois le modèle déployé.
À son crédit, XAI publie le système de Grok. Ses instructions pour «supposer que les points de vue subjectifs provenant des médias sont biaisés» et «pas hésité à faire des réclamations qui sont politiquement incorrectes, tant qu'elles sont bien étayées» étaient probablement des facteurs clés dans la dernière controverse.
Ces invites sont mises à jour quotidiennement au moment de la rédaction, et leur évolution est une étude de cas fascinante en soi.
Garde-corps
Enfin, les développeurs peuvent également ajouter des garde-corps - des filtres qui bloquent certaines demandes ou réponses. Openai affirme qu'il ne permet pas à Chatgpt «de générer du contenu haineux, harcelant, violent ou adulte». Pendant ce temps, le modèle chinois Deepseek Censors Discussion de Tianamen Square.
Les tests ad hoc lors de la rédaction de cet article suggèrent que Grok est beaucoup moins restreint à cet égard que les produits concurrents.
La controverse nazie de Grok met en évidence un problème éthique plus profond: préférerions-nous les entreprises d'IA à être explicitement idéologiques et honnêtes à ce sujet, ou maintenir la fiction de la neutralité tout en intégrant secrètement leurs valeurs?
Chaque grand système d’IA reflète la vision du monde de son créateur - de la perspective d’entreprise opposée au risque de Microsoft Copilot à l’éthique axée sur la sécurité d’Anthropic Claude. La différence est la transparence.
Les déclarations publiques de Musk permettent de retracer facilement les comportements de Grok aux croyances déclarées de Musk sur «l'idéologie réveillée» et le biais des médias. Pendant ce temps, lorsque d'autres plates-formes ont mal raté de façon spectaculaire, nous devions si cela reflète les opinions du leadership, l'aversion au risque des entreprises, la pression réglementaire ou l'accident.
Cela semble familier. Grok ressemble à Tay Chatbot de la haine de Microsoft en 2016, également formé sur les données Twitter et se déchaîne sur Twitter avant d'être fermé.
Mais il y a une différence cruciale. Le racisme de Tay a émergé de la manipulation des utilisateurs et des mauvaises garanties - une conséquence involontaire. Le comportement de Grok semble provenir au moins partiellement de sa conception.
La véritable leçon de Grok concerne l'honnêteté dans le développement de l'IA. À mesure que ces systèmes deviennent plus puissants et répandus (le support de Grok dans les véhicules Tesla vient d'être annoncé), la question n'est pas de savoir si l'IA reflètera les valeurs humaines. C’est de savoir si les entreprises seront transparentes sur les valeurs qu’elles encodant et pourquoi.
L'approche de Musk est simultanément plus honnête (nous pouvons voir son influence) et plus trompeuse (revendiquant l'objectivité lors de la programmation de subjectivité) que ses concurrents.
Dans une industrie construite sur le mythe des algorithmes neutres, Grok révèle ce qui a été vrai tout au long: il n'y a rien de tel que l'IA impartiale - seulement l'IA dont nous pouvons voir les biais avec divers degrés de clarté.