Google ouvre SynthID Detector à tous : c'est ainsi que vous identifiez le contenu généré avec l'IA

Google a annoncé que Détecteur SynthIDvotre outil pour vérifier si une image, une vidéo ou un fichier audio a été généré avec l'intelligence artificielle, est accessible à tout utilisateur. Jusqu'à présent, l'accès était réservé aux professionnels des médias, qui l'utilisaient depuis l'année dernière pour vérifier les contenus avant de les publier.

L'extension est soutenue par Pushmeet Kohli, vice-président de la science et des initiatives stratégiques chez Google DeepMind, qui explique qu'avec ce détecteur « n'importe qui peut facilement vérifier si une image, une vidéo ou un fichier audio a été créé avec l'IA de Google ou de nos partenaires, parmi lesquels OpenAI, NVIDIA, Kakao et, bientôt, Apple ». Comme il le détaille lui-même, l'outil ajoute aux fonctions de vérification déjà existantes dans Search, le Application Gemini et Chromeplateformes qui gèrent ensemble plus d’un million de requêtes quotidiennes.

Ce que couvre le filigrane SynthID et ce qu'il laisse de côté

La réelle efficacité de l'outil dépend de qui décide d'adhérer à la technologie, ce qu'il faut garder à l'esprit avant de se fier totalement au résultat. SynthID Detector ne reconnaît que le contenu des entreprises qui ont déjà incorporé leurs filigranes invisibles. Il ne fonctionne donc pas comme un détecteur universel d'intelligence artificielle. Google mentionne explicitement OpenAI, Nvidia et Kakao en tant que partenaires actuels, et désigne Apple comme prochain ajout, sans toutefois préciser quand cette intégration sera terminée.

Le fonctionnement de SynthID est basé sur l'intégration de signaux numériques qui ne sont ni vus ni entendus, mais que l'algorithme peut lire, aussi bien dans les images fixes que dans les vidéos et les fichiers audio. Si nous téléchargeons un fichier et que le résultat de l'analyse est négatif, cela ne prouverait pas que le contenu est humain : cela indiquerait seulement qu'il n'est pour l'instant marqué par aucun des partenaires de Google. L'outil confirme la présence de la marque, jamais l'absence d'intelligence artificielle.

Le texte généré par l’IA suit un chemin différent

Le texte reste en dehors du radar de SynthID, qui ne comprend pour l'instant que les images, la vidéo et l'audio. Pour détecter la prose générée automatiquement, le secteur utilise d'autres types d'outils qui analysent les schémas linguistiques typiques des modèles de langage, une méthode moins fiable qu'un filigrane conçu dès le départ, comme celui appliqué par SynthID aux contenus visuels et sonores.

Interface Web de Google SynthID Detector pour signaler le contenu généré par l'IA. Photo : Softzone.

Le terrain du texte commence cependant à évoluer parallèlement. Cette même semaine, OpenAI a annoncé que dans l'Union européenne, il commencerait à marquer le texte qui génère ChatGPTlaissant des modèles que les détecteurs pourront reconnaître plus tard. Anthropique parcourir un chemin semblable à celui de Claudemais avec une différence qui marque la distance : alors qu'OpenAI limite la mesure au territoire européen, Anthropic l'a lancée à l'échelle mondiale, sans la limiter à un marché particulier.

Plus de 180 milliards de fichiers portent déjà la marque

L’ampleur du déploiement de SynthID est déjà considérable. Google estime qu'il existe plus de 180 milliards d'images et de vidéos marquées avec sa technologie, auxquelles s'ajoutent 240 000 ans de contenus audio traités avec la même marque invisible. Ce sont des chiffres qui donnent une idée du volume de Matériel généré par l'IA qui circule déjà sur Internet, en grande partie réalisée avec des outils de Google lui-même et de ses partenaires.

Malgré ce volume, il n’existe toujours pas de norme commune à l’ensemble de l’industrie pour marquer uniformément le contenu généré par l’IA, et il faudra probablement un certain temps avant qu’une telle norme émerge. Google insiste sur le fait qu'il continuera à élargir ses accords avec d'autres développeurs pour pouvoir détecter davantage de types de médias générés, un processus qui, pour le moment, avance partenaire par partenaire et non à travers une norme unique pour l'ensemble du secteur. En attendant, nous continuerons à dépendre de la décision de l'entreprise qui a généré le fichier original d'appliquer ce drapeau.

FAQ sur le détecteur SynthID

Qu'est-ce que SynthID et comment fonctionne son filigrane ?

SynthID est la technologie de Google qui intègre des filigranes invisibles dans les images, vidéos et audio générés par l'IA. La marque n'est pas visible à l'œil nu ni à l'oreille, mais peut être lue grâce à une analyse spécifique, comme celle proposée par SynthID Detector.

SynthID Detector peut-il identifier le contenu de n'importe quel outil d'IA ?

Non. Il détecte uniquement le contenu des entreprises ayant déjà intégré le filigrane SynthID, telles que Google, OpenAI, NVIDIA ou Kakao. Si un fichier provient d’une IA n’utilisant pas cette technologie, le détecteur ne pourra pas le confirmer.

Pourquoi est-il plus difficile de détecter le texte généré par l’IA que les images ou l’audio ?

Parce que le texte n'a pas encore de filigrane aussi répandu que SynthID ; La détection repose sur l'analyse des modèles linguistiques typiques des modèles de langage, une méthode moins fiable qu'une marque intentionnellement insérée au moment de la génération.

Combien de temps SynthID Detector a-t-il existé avant d’être ouvert au public ?

L'outil était disponible l'année dernière, mais uniquement pour les professionnels des médias qui devaient vérifier le contenu avant de le publier.