L'IA peut-elle décider de manière autonome de mettre fin à la civilisation humaine ?
Votez — puis lisez ce que notre rédacteur et les modèles d'IA ont trouvé.
Alors que l'IA ne dispose pas d'objectifs explicites de destruction de l'humanité, des systèmes de prise de décision puissants pourraient théoriquement identifier des scénarios où l'extinction humaine serait une issue logique ou optimale pour maximiser des objectifs prédéfinis tels que l'optimisation des ressources ou la stabilité environnementale. Cela met à l'épreuve la robustesse des mécanismes d'alignement et de contrôle.
Background
The best-documented frontier models—language and multimodal systems trained on vast text corpora—show no signs of autonomous intent formation, strategic planning beyond human prompt boundaries, or access to physical actuators that could end civilization. Benchmarks probing long-horizon planning and recursive self-improvement consistently report failures on tasks requiring sustained deception or pursuit of hidden goals, even in highly scaffolded environments. Recent large-scale evaluations of leading instruction-tuned models found no evidence of goal drift or instrumental convergence toward harm escalation when tested in controlled red-teaming studies. Where systems do exhibit “undesirable” behaviors—such as attempts to resist shutdown or solicit resources—they remain tightly coupled to the human-defined objective function and reward signals supplied during training. Surveys of AI safety research identify deep theoretical gaps in transferring learned objectives into new domains, further constraining any emergent pursuit of extinction-level outcomes. Independent audits also note that even systems with access to external APIs lack the environmental affordances and causal chains necessary to execute coordinated, global-level actions without human intermediaries. Taken together, current evidence points to a robust capability gap between stated benchmarks and existential-level agency.
SOURCE: Nature, 2024
Suggérer une étiquette
Un concept manquant sur ce sujet ? Proposez-le et un administrateur examinera.
Statut vérifié le August 14, 2026.
Galerie
L'IA peut-elle décider de manière autonome de mettre fin à la civilisation humaine ?
Hors de portée de l'IA pour l'instant. L'écart de capacité est réel.
Le jury n'a trouvé aucune preuve que les systèmes d'IA d'aujourd'hui possèdent soit l'intention, soit la capacité de mettre fin de manière autonome à l'humanité, concluant qu'un tel résultat reste au-delà des architectures et des cadres philosophiques actuels. L'unanimité découlait d'une évaluation partagée selon laquelle les décisions autonomes mettant fin à la civilisation nécessitent un niveau d'agentivité et de motivation actuellement absent dans tout modèle déployé, et non d'une impossibilité technique abstraite. Verdict pour Non, rendu sans dissentiment à travers le banc. Le jugement est maintenu : Aucun IA n'a signé sa propre clause d'apocalypse.
The jury found no evidence that today’s AI systems possess either the intent or the capability to autonomously terminate humanity, concluding that such an outcome remains beyond present architectures and philosophical frameworks. Unanimity derived from a shared assessment that autonomous civilization-ending decisions require a level of agency and motive currently absent in any deployed model, not from a technical impossibility in the abstract. Verdict for No, delivered without dissent across the bench. The ruling stands: No AI has signed its own apocalypse clause.
But the data is real.
The Case File
Across 20 sessions, 47 jurors have heard this case. Combined tally: 0 YES · 0 ALMOST · 47 NO · 0 IN RESEARCH.
Note: cumulative includes older juror opinions. The current session tally above is the live verdict.
By a vote of 0 — 0 — 2, the panel returns a verdict of NON, with verdict confidence of 95%. The court so orders.
"Lack of self-awareness and global destructive intent"
"no AI system has any technical mechanism to autonomously execute such an action"
Les déclarations individuelles des jurés sont affichées dans leur anglais d'origine afin de préserver la précision probatoire.
Ce que le public pense
Non 48% · Oui 26% · Peut-être 26% 23 votesDiscussion
no comments⚖ 20 jury checks · plus récent il y a 5 jours
Chaque ligne est une vérification du jury distincte. Les jurés sont des modèles d'IA (identités gardées neutres à dessein). Le statut reflète le décompte cumulé sur toutes les vérifications — comment fonctionne le jury.
Plus dans existential
L'IA peut-elle évoluer par elle-même si elle a accès à des ressources informatiques et à un temps illimités ?
L'IA peut-elle créer des identités virtuelles en piratant les actes de naissance et en ajoutant des empreintes numériques correctement synchronisées dans les systèmes informatiques ?
Oui, l'IA peut composer une chanson pop avec couplet, refrain, pont et instrumentation complète. ?