L’avatar de Tavus a paru humain à 26 participants sur 54
Tavus annonce que 26 participants sur 54 ont pris son avatar pour une personne. Le protocole d’une minute ne mesure pas, à lui seul, une illusion durable.
Dans cet article
Un appel vidéo d’une minute a suffi à créer une confusion chez certains participants. Tavus, une entreprise qui développe des avatars vidéo conversationnels, annonce 26 personnes sur 54 convaincues d’avoir rencontré une humaine. Leur interlocutrice était Griffin-Lite, la version préliminaire de son nouvel avatar d’intelligence artificielle.
Ce résultat mesure une impression dans un cadre précis. La durée, la présentation de l’appel et les questions posées limitent sa portée.
Les participants s’attendaient à rencontrer une personne
Dans son rapport du 1er octobre 2026, Tavus détaille le déroulement du test. Une plateforme de recherche indépendante a recruté les participants aux États-Unis et en Europe. On leur annonçait une rencontre avec un autre participant.
Le sujet était ordinaire : parler de ce qu’ils attendaient avec impatience cette année. L’échange avec Griffin-Lite durait une minute. Les participants abordaient donc une conversation sociale, avec l’attente préalable d’un interlocuteur humain.
Après l’appel, ils devaient restituer la réponse de leur interlocutrice. Ils évaluaient aussi son naturel, sa fiabilité, la fluidité de l’échange et leur impression d’avoir été écoutés. La question sur un éventuel soupçon concernant son identité humaine arrivait seulement à la fin. La révélation de l’IA suivait.
Cet ordre compte : le protocole recueille une impression après une rencontre présentée comme humaine. Il ne demande pas aux participants de rechercher une IA dès le début.
Le progrès annoncé concerne ce protocole précis
Tavus compare Griffin-Lite à son précédent système, évalué selon le même protocole. Celui-ci avait été identifié comme humain par une personne sur 41, soit 2,4 %. Griffin-Lite atteint 48 % dans le nouveau groupe.
L’écart annoncé est marqué. Il suggère que le nouvel avatar produit une première impression plus convaincante dans cette situation. Les effectifs restent toutefois modestes : chaque réponse pèse dans le pourcentage final.
Les participants ayant soupçonné une IA tendaient à le faire dans les vingt premières secondes. Ce constat renseigne sur la rapidité de certains soupçons. Il ne dit pas combien de temps les autres auraient conservé leur impression.
Une minute ne mesure pas une illusion durable
Le test s’arrête avant de pouvoir observer la persistance de la confusion. Il ne permet donc pas d’établir qu’un interlocuteur resterait convaincu après cinq ou quinze minutes.
Une conversation prolongée multiplierait les occasions de vérifier la cohérence des réponses et des réactions. Le résultat disponible ne mesure pas davantage l’effet d’appels répétés ou de sujets plus exigeants.
La présentation initiale constitue une autre limite. Une personne avertie qu’elle pourrait rencontrer une IA aborderait l’échange avec une attente différente. Le dossier ne chiffre pas l’effet de cette modification : 48 % reste le résultat du scénario testé.
Comparer avec un humain change la tâche
Une étude publiée le 19 mai 2026 illustre une autre manière d’évaluer la confusion. Les juges échangeaient simultanément par écrit avec un humain et une IA pendant cinq minutes. Ils devaient ensuite désigner l’interlocuteur humain.
Cette comparaison directe donne au juge un repère concret. Le test de Tavus lui demande plutôt d’évaluer une interlocutrice unique selon sa représentation du comportement humain. Les deux dispositifs posent donc des questions différentes.
L’étude écrite comprenait aussi une expérience imposant quinze minutes complètes d’échange. Ses auteurs observaient des résultats différents selon les instructions de personnalité données aux modèles. Cela rappelle que la durée et la mise en scène doivent accompagner tout chiffre de réussite. Ces expériences écrites ne valident pas les performances vidéo de Griffin-Lite.
La première impression est mesurée, sa persistance reste à vérifier
Griffin-Lite a été pris pour une personne par près de la moitié d’un groupe de 54 participants. Ce résultat annoncé par Tavus concerne un appel bref, présenté comme une rencontre entre participants.
Pour juger sa capacité à entretenir cette impression, il reste à tester des échanges plus longs. Des interlocuteurs avertis et une comparaison directe avec des humains permettraient aussi d’en préciser les limites. Pour l’instant, le chiffre décrit la crédibilité d’une première rencontre dans les conditions publiées.