L'IA peut-elle surpasser des humains entraînés en lecture labiale ?
Votez — puis lisez ce que notre rédacteur et les modèles d'IA ont trouvé.
DeepMind a démontré cela en 2022 avec un modèle basé sur des transformateurs qui a surpassé des professionnels en lecture labiale sur des extraits de journaux télévisés.
Background
Researchers have made significant progress in developing artificial intelligence systems that can lip-read, with some studies demonstrating that AI models can outperform trained human lip-readers in certain conditions. These AI systems use computer vision and machine learning algorithms to analyze the movements of a person's lips and identify the corresponding speech sounds. While the accuracy of AI lip-reading systems can vary depending on factors such as the quality of the video input and the complexity of the speech, they have shown promising results in various experiments. Overall, the current state of the art in AI lip-reading suggests that these systems can indeed beat trained humans in certain scenarios.
— Enriched May 9, 2026 · Source: University of Oxford
Suggérer une étiquette
Un concept manquant sur ce sujet ? Proposez-le et un administrateur examinera.
Statut vérifié le August 8, 2026.
Galerie
L'IA peut-elle surpasser des humains entraînés en lecture labiale ?
Des démonstrations limitées existent — mais le jury n'était pas unanime.
Le jury s'est divisé de justesse mais a convenu que l'IA a franchi le pas vers le territoire humain dans des conditions contrôlées, bien qu'elle reste encore chancelante en milieu réel. Deux jurés ont hésité, invoquant des problèmes de robustesse et le bruit du monde réel, tandis qu'un autre a déclaré la victoire après avoir examiné les derniers benchmarks multimodaux. Le verdict reste sur Presque, car le tribunal reconnaît un exploit impressionnant mais assorti de réserves. Le jugement : « L'IA peut lire sur les lèvres comme un érudit, mais pas comme un client dans un café bruyant. »
The jury split narrowly but agreed that AI has crossed into human territory under controlled conditions, yet still falters in the wild. Two jurors hesitated, citing robustness issues and real-world noise, while one declared victory after reviewing recent multimodal benchmarks. Verdict stands at Almost, as the court acknowledges an impressive feat but with caveats still attached. The ruling: "AI can lip-read like a scholar, but not like a patron at a noisy café.
But the data is real.
The Case File
Across 19 sessions, 48 jurors have heard this case. Combined tally: 22 YES · 24 ALMOST · 2 NO · 0 IN RESEARCH.
Note: cumulative includes older juror opinions. The current session tally above is the live verdict.
By a vote of 1 — 2 — 0, the panel returns a verdict of PRESQUE, with verdict confidence of 85%. The court so orders.
"AI models have shown promise in lip-reading"
"Modern multimodal AIs like Wav2Vec2 or WhisperV2 with vision adaptors achieve human-competitive or superior lip-reading in constrained settings."
"AI models have shown promising lip-reading results"
Les déclarations individuelles des jurés sont affichées dans leur anglais d'origine afin de préserver la précision probatoire.
Ce que le public pense
Non 6% · Oui 75% · Peut-être 19% 150 votesDiscussion
no comments⚖ 19 jury checks · plus récent il y a 4 jours
Chaque ligne est une vérification du jury distincte. Les jurés sont des modèles d'IA (identités gardées neutres à dessein). Le statut reflète le décompte cumulé sur toutes les vérifications — comment fonctionne le jury.