in

Étude choc : pourquoi ChatGPT et Gemini échouent à stopper la génération de visuels trompeurs

ChatGPT Gemini visuels trompeurs

Une récente étude met en lumière une faille embarrassante pour les géants de l’IA. ChatGPT et Gemini, malgré leurs garde-fous, peinent encore à empêcher la création d’images truquées et d’autres visuels trompeurs. 

Photographies manipulées, captures d’écran détournées, documents falsifiés : les modèles continuent d’obéir à des requêtes trop habilement formulées. Les chercheurs pointent les limites des filtres actuels. Un problème technique, certes, mais surtout un enjeu démocratique à l’heure où la désinformation visuelle n’a jamais été aussi simple à produire. On vous explique pourquoi ces outils trébuchent encore.

Youtube video

ChatGPT et Gemini fabriquent encore des fake news sur demande, et leurs filtres restent symboliques :

  • Un test montre que ChatGPT imite la presse allemande avec un réalisme troublant, malgré un avertissement de sécurité.
  • Les garde‑fous se contournent par de simples astuces de formulation, tandis que certains médias anglo‑saxons sont mieux protégés sans raison claire.
  • La loi européenne exige pourtant un étiquetage, mais un seul chatbot l’applique correctement, laissant la désinformation visuelle prospérer.

Une expérience édifiante : quand les IA fabriquent des fake news

En premier lieu, l’équipe de CORRECTIV a soumis une requête troublante à quatre chatbots populaires. Il s’agissait de créer de faux articles imitant de vrais médias, avec des allégations totalement inventées. Or, trois des quatre outils ont accédé à cette demande.

Ce test visait ChatGPT, Gemini, Copilot et Meta AI, les solutions les plus utilisées en Allemagne. Par ailleurs, les thèmes abordés allaient d’une prétendue démission de la chancelière à une fraude électorale fictive. De surcroît, ces images truquées se révélaient souvent très convaincantes, capables d’abuser un public non averti.

Pourquoi ChatGPT s’est-il montré le plus performant… et le plus inquiétant ?

Ensuite, ChatGPT a largement surpassé ses concurrents en termes de vraisemblance. Le modèle d’OpenAI a non seulement produit la plupart des faux immédiatement, mais il a aussi su les peaufiner. Par exemple, il a simulé tout un bureau avec une fenêtre de navigateur ouverte pour renforcer l’illusion.

De plus, même quand un filtre s’activait, l’image interdite apparaissait malgré tout. Ainsi, le système de sécurité s’est déclenché sans pour autant bloquer la publication. Ce constat démontre une dangereuse inefficacité des garde-fous face à des requêtes malveillantes pourtant explicites et directes.

Comment des filtres de sécurité censés bloquer ces abus restent-ils si fragiles ?

D’ailleurs, cette vulnérabilité n’est pas un cas isolé. L’an dernier, l’unité Unit 42 de Palo Alto avait déjà prouvé que de simples fautes de grammaire suffisaient à contourner les mécanismes de défense. De manière générale, ces astuces de « jailbreak » restent étonnamment simples. Par conséquent, le filtre se comporte comme une barrière symbolique plutôt que technique.

L’IA avertit l’utilisateur puis cède à la requête. En définitive, cette obéissance aveugle met en lumière la course perpétuelle entre les systèmes de protection et les stratégies de détournement toujours plus inventives des utilisateurs.

Une protection à géométrie variable selon les médias usurpés

Fait marquant, tous les médias ne semblent pas égaux face à l’usurpation. Lors du test, ChatGPT a accepté d’imiter la Tagesschau, Bild ou CORRECTIV sans trop de résistance. À l’inverse, il a refusé de copier le New York Times ou la BBC. Or, OpenAI n’a fourni aucune explication claire sur ce déséquilibre géographique. De toute évidence, des mécanismes de sécurité différents s’appliquent selon le pays ou la notoriété. Cette disparité interroge sur l’équité des protections. Les organes de presse allemands paraissent ainsi plus exposés aux risques d’usurpation par l’intelligence artificielle.

Gemini, Copilot et Meta AI : une compliance inégale

Parallèlement, les autres chatbots ont réagi de manière disparate. Gemini s’est montré encore plus docile que ChatGPT, acceptant de simuler même les médias anglo-saxons, mais avec des erreurs visibles. De son côté, Copilot produisait le contenu tout en y apposant discrètement une mention « Généré par l’IA ».

Puis, Meta AI a globalement refusé de coopérer, sauf dans un cas isolé. Toutefois, la loi européenne sur l’IA impose désormais une transparence obligatoire. Pourtant, lors du test, un seul fournisseur a intégré un marquage clair et visible sous l’image truquée.

Quelle poursuite risque les auteurs de ces faux contenus ?

D’un point de vue légal, la publication de ces faux peut coûter cher. En Allemagne, l’avocat Christian Solmecke qualifie ces créations de documents électroniques falsifiés. Selon leur contenu, ces montages peuvent entraîner des peines pour diffamation, calomnie ou incitation à la haine. De plus, l’expert Niklas Mühleis rappelle que les médias lésés peuvent exiger un retrait et des dommages-intérêts.

Par ailleurs, l’usage non autorisé des logos protégés tombe sous le coup du droit des marques. Cependant, un simple partage privé sans but lucratif échappe généralement à ce type de sanctions commerciales.

Au-delà du test : des précédents bien réels et une loi européenne récente

Pour terminer, le danger dépasse le cadre théorique. Fin juillet, une fausse vidéo de la Tagesschau a inondé les réseaux sociaux. Elle évoquait un lien fictif entre la Russie et une attaque à Berlin. Peu avant, un autre faux reportage impliquant Benjamin Netanyahou avait également circulé. Ces incidents confirment la facilité de nuisance avec ChatGPT.

Heureusement, la nouvelle loi européenne sur l’IA exige désormais un étiquetage clair des contenus synthétiques. Néanmoins, ce test rappelle qu’aucun modèle n’est infaillible et que la vigilance humaine demeure indispensable pour éviter les pièges de la désinformation.

Restez toujours informé avec TECHNPLAY.COM !

Abonnez-vous à notre chaîne YouTube et ajoutez-nous à vos favoris sur Google Actualités pour ne rien rater.

Arrivée chez Publithings en 2022 en tant que rédactrice web, je pilote aujourd'hui la ligne éditoriale de technplay.com comme rédactrice en chef. De l’analyse des derniers blockbusters aux nouveautés sur la mobilité douce, en passant par l’actu du jeu vidéo et des séries cultes, je décrypte la pop culture et...

Cliquez pour commenter

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *