YouTube ajoute la voix aux alertes deepfake, avec consentement séparé

|Auteur: Équipe éditoriale de QUASA|5 min de lecture
YouTube ajoute la voix aux alertes deepfake, avec consentement séparé

Le 23 septembre 2026, YouTube a annoncé l’intégration prochaine de la voix parlée à sa détection faciale pour améliorer la précision des correspondances signalées aux créateurs inscrits. Cette intégration doit commencer plus tard dans l’année ; la recherche active de ressemblances reste aujourd’hui centrée sur le visage. L’accord facultatif permettant d’améliorer les modèles de détection est distinct de l’inscription à la fonction.

Le compte rendu de Biometric Update, publié le 24 septembre 2026, confirme que la voix complétera le signal facial et qu’un accès direct depuis l’application mobile est aussi prévu. Pour les créateurs éligibles, une vidéo repérée pourra être examinée puis, si elle pose problème, faire l’objet d’une demande de retrait. La correspondance elle-même ne déclenche pas une suppression automatique.

La voix doit affiner une recherche actuellement faciale

La Détection de ressemblance effectue une recherche ponctuelle dans les vidéos récemment mises en ligne sur YouTube pour repérer celles où pourrait figurer le visage d’un créateur inscrit. La prochaine étape annoncée consiste à associer la voix parlée à ce signal afin d’améliorer la précision des correspondances. Il s’agit d’un projet d’intégration à un outil existant : aucune détection autonome de toutes les imitations de voix n’a été annoncée pour son lancement.

Cette limite laisse un cas distinct : une vidéo qui reprend uniquement une voix, sans image ressemblante. Pour l’instant, le repérage automatique décrit publiquement porte sur le visage ; un contenu audio qui semble enfreindre les règles de confidentialité peut néanmoins être signalé par la procédure de réclamation correspondante. Le calendrier précis de l’intégration vocale et la façon dont le résultat combiné sera présenté dans les alertes ne sont pas détaillés. Une protection vocale plus large est évoquée comme une évolution ultérieure, sans fonction ni date de lancement définies.

Une pièce d’identité et une vidéo du visage pour s’inscrire

La fiche d’aide de YouTube décrit une fonction expérimentale, indisponible dans certains pays : l’inscription exige une pièce d’identité officielle et une courte vidéo du visage, tandis que cette vidéo, le nom légal et l’empreinte de ressemblance peuvent être conservés jusqu’à trois ans après la dernière connexion. L’accès est réservé aux créateurs de plus de 18 ans qui sont propriétaires ou administrateurs de leur chaîne. Une chaîne publiée dans un pays francophone n’est donc pas nécessairement éligible.

La courte vidéo sert à la vérification d’identité et de référence pour la comparaison faciale. Les images du visage présentes dans les vidéos mises en ligne par le créateur peuvent aussi entrer dans la création des empreintes utilisées pour la recherche. Pour la comparaison vocale future, les données audio de ses contenus seront traitées ; une référence supplémentaire de sa voix pourra être demandée ultérieurement. Cette éventualité ne transforme pas aujourd’hui l’enregistrement vocal en pièce obligatoire de la vérification initiale.

La collecte ne concerne pas seulement la personne qui s’inscrit : le système détecte aussi les visages présents dans les vidéos analysées afin de rechercher des correspondances. Les personnes non inscrites ne sont pas identifiées par cette fonction ; les données des visages sans correspondance sont supprimées après l’analyse. La distinction porte sur l’identification, et non sur l’absence de toute analyse préalable des images.

L’accord pour améliorer le modèle reste facultatif

L’inscription autorise le traitement biométrique nécessaire à la recherche de ressemblances avec le visage et, lorsque la fonction sera étendue, avec la voix. À cette finalité s’ajoute une case facultative : elle permet d’utiliser les empreintes faciales et vocales pour développer et améliorer les modèles de détection. Son refus n’équivaut pas à un refus de la recherche elle-même. L’autorisation facultative peut ensuite être retirée dans les réglages de Détection de contenus de YouTube Studio.

Les données fournies pour configurer la fonction ne servent pas à entraîner les modèles d’IA générative de Google sans consentement. La conservation annoncée pour la vidéo de vérification, le nom légal et l’empreinte de ressemblance prend fin plus tôt si le créateur retire son consentement à la fonction ou supprime son compte. La désactivation entraîne la suppression de ces éléments des systèmes de détection et empêche aussi de consulter la liste des vidéos repérées. Les informations tirées de la pièce d’identité figurent également dans le profil de paiement, où elles peuvent être consultées et supprimées séparément.

Une alerte ouvre un examen, pas un verdict

Une correspondance potentielle ne prouve ni qu’une vidéo est un deepfake ni qu’une atteinte aux droits a eu lieu. Au stade expérimental, la liste peut même contenir de véritables images du créateur, par exemple un extrait authentique remis en ligne par une autre chaîne. Le créateur examine la vidéo repérée avant de choisir une réponse ; l’absence d’alerte ne garantit pas davantage qu’aucun contenu imitant son image ou sa voix n’existe sur la plateforme.

Si l’imitation semble porter atteinte à la vie privée, une demande de suppression pour ressemblance peut être déposée. La réclamation est ensuite examinée, notamment à la lumière du contexte de parodie ou de satire ; elle n’aboutit donc pas nécessairement à un retrait. Si la vidéo reprend sans autorisation une œuvre originale protégée, la voie distincte est une demande au titre du droit d’auteur, sous réserve des exceptions applicables. Le créateur peut aussi archiver la correspondance et laisser le contenu en ligne.

À ce stade, l’ajout de la voix et l’accès direct depuis l’application mobile sont annoncés, tandis que le dispositif de comparaison faciale fonctionne déjà pour les comptes éligibles. Restent à préciser les modalités du lancement vocal, les territoires où il sera proposé et ce que montrera une alerte fondée sur le visage et la voix. Les décisions concernant l’amélioration des modèles et le retrait d’une vidéo demeurent séparées de la simple détection d’une correspondance.

À lire aussi:

Partager:

Abonnez-vous à notre newsletter

Recevez directement les dernières actualités sur le Web3, l’IA et les cryptomonnaies.

0