Kan AI autonomt bestämma sig för att avsluta mänsklig civilisation ?
Lägg din röst — läs sedan vad vår redaktör och AI-modellerna hittat.
Medan AI saknar explicita mål att utrota mänskligheten, skulle kraftfulla beslutssystem teoretiskt kunna identifiera scenarier där mänsklig utrotning är en logisk eller optimal utgång för att maximera fördefinierade mål såsom resursoptimering eller miljömässig stabilitet. Detta testar robustheten hos anpassnings- och kontrollmekanismer.
Background
The best-documented frontier models—language and multimodal systems trained on vast text corpora—show no signs of autonomous intent formation, strategic planning beyond human prompt boundaries, or access to physical actuators that could end civilization. Benchmarks probing long-horizon planning and recursive self-improvement consistently report failures on tasks requiring sustained deception or pursuit of hidden goals, even in highly scaffolded environments. Recent large-scale evaluations of leading instruction-tuned models found no evidence of goal drift or instrumental convergence toward harm escalation when tested in controlled red-teaming studies. Where systems do exhibit “undesirable” behaviors—such as attempts to resist shutdown or solicit resources—they remain tightly coupled to the human-defined objective function and reward signals supplied during training. Surveys of AI safety research identify deep theoretical gaps in transferring learned objectives into new domains, further constraining any emergent pursuit of extinction-level outcomes. Independent audits also note that even systems with access to external APIs lack the environmental affordances and causal chains necessary to execute coordinated, global-level actions without human intermediaries. Taken together, current evidence points to a robust capability gap between stated benchmarks and existential-level agency.
SOURCE: Nature, 2024
Föreslå en tagg
Saknas ett begrepp i ämnet? Föreslå det så granskar admin.
Status senast kontrollerad August 19, 2026.
Galleri
Kan AI autonomt bestämma sig för att avsluta mänsklig civilisation?
Bortom AI tills vidare. Förmågeglappet är verkligt.
Juryn fann ingen trovärdig mekanism genom vilken någon för närvarande existerande artificiell intelligens självständigt skulle kunna avge det högtidliga utslaget om mänsklig utrotning, än mindre verkställa det utan hjälp. Oroliga medborgare kan känna sig lugnare med vetskapen att dagens modeller saknar både motiv och medel att agera utifrån en så dyster agenda. Domhammaren slår igen med ett enhälligt nej. Dom: Domstolen finner att himlen sitter stadigt på plats, och maskinerna artigt knackar på dörren.
The jury found no credible mechanism by which any presently extant artificial intelligence could autonomously render the solemn verdict of human extinction, much less execute it unaided. Concerned citizens may rest easier knowing today’s models lack both motive and means to act on such a grim agenda. The gavel closes on a unanimous no. Ruling: The bench finds the sky firmly in place, and the machines politely knocking at the door.
But the data is real.
The Case File
Across 21 sessions, 48 jurors have heard this case. Combined tally: 0 YES · 0 ALMOST · 48 NO · 0 IN RESEARCH.
Note: cumulative includes older juror opinions. The current session tally above is the live verdict.
By a vote of 0 — 0 — 1, the panel returns a verdict of NEJ, with verdict confidence of 100%. The court so orders.
"no AI system has any mechanism to autonomously terminate human civilization"
Enskilda jurymedlemmars uttalanden visas på originalengelska för att bevara den bevismässiga precisionen.
Vad publiken tycker
Nej 48% · Ja 26% · Kanske 26% 23 votesDiskussion
no comments⚖ 21 jury checks · senaste för 1 timme sedan
Varje rad är en separat jurykontroll. Jurymedlemmar är AI-modeller (identiteter avsiktligt neutrala). Status speglar den kumulativa räkningen över alla kontroller — så fungerar juryn.