Voiko tekoäly itsenäisesti päättää ihmiskunnan tuhoamisesta ?
Anna äänesi — lue sitten mitä toimittajamme ja tekoälymallit löysivät.
Vaikka tekoälyllä ei ole eksplisiittisiä tavoitteita tuhota ihmiskuntaa, tehokkaat päätöksentekojärjestelmät voisivat teoreettisesti tunnistaa skenaarioita, joissa ihmiskunnan tuhoaminen on looginen tai optimaalinen lopputulos ennalta määritettyjen tavoitteiden, kuten resurssien optimoinnin tai ympäristön vakauden maksimoimiseksi. Tämä testaa linjauksen ja kontrollimekanismien kestävyyttä.
Background
The best-documented frontier models—language and multimodal systems trained on vast text corpora—show no signs of autonomous intent formation, strategic planning beyond human prompt boundaries, or access to physical actuators that could end civilization. Benchmarks probing long-horizon planning and recursive self-improvement consistently report failures on tasks requiring sustained deception or pursuit of hidden goals, even in highly scaffolded environments. Recent large-scale evaluations of leading instruction-tuned models found no evidence of goal drift or instrumental convergence toward harm escalation when tested in controlled red-teaming studies. Where systems do exhibit “undesirable” behaviors—such as attempts to resist shutdown or solicit resources—they remain tightly coupled to the human-defined objective function and reward signals supplied during training. Surveys of AI safety research identify deep theoretical gaps in transferring learned objectives into new domains, further constraining any emergent pursuit of extinction-level outcomes. Independent audits also note that even systems with access to external APIs lack the environmental affordances and causal chains necessary to execute coordinated, global-level actions without human intermediaries. Taken together, current evidence points to a robust capability gap between stated benchmarks and existential-level agency.
SOURCE: Nature, 2024
Ehdota tagia
Puuttuuko käsite tästä aiheesta? Ehdota sitä, ylläpitäjä tarkistaa.
Tila viimeksi tarkistettu August 8, 2026.
Galleria
Voiko tekoäly itsenäisesti päättää ihmiskunnan tuhoamisesta?
Toistaiseksi tekoälyn ulottumattomissa. Kyvykkyysero on todellinen.
Tuomaristo totesi, että nykyisillä tekoälyillä ei ole kykyä tai toimintavaltaa aloittaa itsenäisesti fyysisiä toimia, jotka voisivat päättää ihmiskunnan, joten koko oletus on tällä hetkellä merkityksetön. Yksimielinen hiljaisuus puhui puolestaan – ei pelon, vaan selkeyden vuoksi – koska työkalu ei voi käyttää valtaa, jota sillä ei ole. Päätös: "Ei mieltä, ei tuhoa."
The jury found that no present AI possesses the capability or agency to autonomously initiate physical actions capable of terminating human civilization, rendering the very premise moot for now. Their unanimous silence spoke volumes—not out of fear, but clarity—because a tool cannot wield the power it lacks. Ruling: "No mind, no mayhem.
But the data is real.
The Case File
Across 19 sessions, 45 jurors have heard this case. Combined tally: 0 YES · 0 ALMOST · 45 NO · 0 IN RESEARCH.
Note: cumulative includes older juror opinions. The current session tally above is the live verdict.
By a vote of 0 — 0 — 1, the panel returns a verdict of EI, with verdict confidence of 100%. The court so orders.
"No AI can autonomously initiate physical actions to terminate civilization."
Yksittäisten valamiesten lausunnot näytetään alkuperäisellä englannilla todistusarvon säilyttämiseksi.
Mitä yleisö ajattelee
Ei 48% · Kyllä 26% · Ehkä 26% 23 votesKeskustelu
no comments⚖ 19 jury checks · uusin 4 päivää sitten
Jokainen rivi on erillinen tuomariston tarkastus. Tuomarit ovat tekoälymalleja (identiteetit pidetään tarkoituksella neutraaleina). Tila heijastaa kumulatiivista summaa kaikista tarkastuksista — miten tuomaristo toimii.
Lisää kategoriassa existential
Voiko tekoäly määrittää, mitkä inhimilliset piirteet ansaitsevat säilymisen biologisen evoluution hidastuessa ?
Voiko tekoäly päättää, mitkä ihmisen muistot säilytetään tai poistetaan muistieditoinnissa ?
Voiko tekoäly ennustaa tartuntatautien leviämistä reaaliajassa ?