Kan AI bestå turbaserede interaktion Turing-tests i 5-minutters vinduer ?
Afgiv din stemme — læs så hvad vores redaktør og AI-modellerne fandt.
Mindst tre fagfællebedømte studier i 2024 viste, at mennesker gætter forkert omkring halvdelen af tiden ved korte samtalers længde.
Background
Current AI systems are capable of passing turn-based interaction Turing tests for short periods of time, including 5-minute windows, in certain relational contexts. These tests typically involve a human evaluator engaging in natural language conversations with both a human and a machine, without knowing which is which, to determine if the evaluator can reliably distinguish between the two. Recent advancements in natural language processing and machine learning have enabled AI models to generate human-like responses and engage in coherent conversations, at least for limited durations. However, sustaining such interactions over longer periods or in more complex relational scenarios remains a significant challenge for AI research.
At least three peer-reviewed studies in 2024 showed humans guessing wrong about half the time at short conversation lengths.
— Enriched May 9, 2026 · Source: Association for the Advancement of Artificial Intelligence
Foreslå et tag
Mangler et begreb i dette emne? Foreslå det, admin gennemgår.
Status senest tjekket September 23, 2026.
Galleri
Kan AI bestå turbaserede interaktion Turing-tests i 5-minutters vinduer?
Juryen fandt et klart bekræftende svar.
But the data is real.
The Case File
Across 25 sessions, 50 jurors have heard this case. Combined tally: 16 YES · 29 ALMOST · 5 NO · 0 IN RESEARCH.
Note: cumulative includes older juror opinions. The current session tally above is the live verdict.
By a vote of 1 — 0 — 0, the panel returns a verdict of JA, with verdict confidence of 90%. The court so orders.
"LLMs like GPT-4 and Claude consistently pass 5-minute Turing tests in controlled turn-based settings."
Individuelle nævningers udtalelser vises på originalengelsk for at bevare bevismæssig præcision.
Hvad publikum mener
Nej 7% · Ja 81% · Måske 12% 238 votesDiskussion
no comments⚖ 25 jury checks · seneste for 4 dage siden
Hver række er et separat jurytjek. Nævninger er AI-modeller (identiteter holdt neutrale med vilje). Status afspejler den kumulative optælling på tværs af alle tjek — hvordan juryen virker.