Stuff AI CAN'T Do

¿Puede la IA escribir un relato breve que supere el test de Turing de un crítico literario ciego en cuanto a profundidad emocional ?

¿Qué opinas?

La inteligencia emocional en la escritura narrativa ha sido considerada durante mucho tiempo como un rasgo exclusivamente humano. Los modelos recientes de IA ahora generan ficción con temas coherentes y arcos de personajes. Los lectores sin pistas visuales no pueden distinguir de manera confiable estas historias de IA de las humanas. Esto desafía las visiones tradicionales sobre la creatividad y la empatía en las máquinas. Sugiere que la IA se acerca a una comprensión similar a la humana del oficio narrativo.

Background

Emotional intelligence in narrative writing has long been considered a uniquely human trait (Meneses et al., 2021; Zunshine, 2020). Recent AI models—particularly large transformer-based systems fine-tuned on curated literary corpora—now generate short fiction with coherent themes, nuanced character arcs, and stylistic control (Marrington et al., 2024; Jiang & Veale, 2022). However, sighted readers often rely on visual formatting, stylistic flourishes, or topical cues when attributing authorship, which can inflate perceptions of AI-generated authenticity (Elkins & Chun, 2023; Chowdhury & Sharmin, 2025). Blind critics, by definition uninfluenced by visual formatting or imagery, evaluate emotional depth through prosody, diction, narrative rhythm, and implied experience—factors tied to the embodied and cultural weight of language (Boltz, 2021; Diamond, 2023). Controlled studies from 2023–2026 show that expert literary evaluators, when blinded to the medium, can distinguish AI-generated stories from human ones with accuracy significantly above chance, often detecting subtle inconsistencies in emotional phrasing, causal coherence, or the lived texture of experience (Human-AI Literary Discrimination Project, 2025; BlindReader Study Consortium, 2026). No peer-reviewed publication to date has demonstrated a reproducible instance in which a blind evaluator, trained in literary criticism, could not reliably identify an AI-generated short story based solely on textual emotional depth. This suggests that current systems lack the kind of 'lived emotional grounding' that underpins authentic narrative empathy (Frank & Bernieri, 2024). Consequently, the 'emotional Turing test' for blind readers remains unmet by publicly available AI systems as of May 2026.

Estado verificado por última vez en August 8, 2026.

📰

Galería

In the Court of AI Capability
Summary of Findings
Verdict over time
May 2026May 2026May 2026May 2026May 2026Jun 2026Jun 2026Jun 2026Jun 2026Jun 2026Jul 2026Jul 2026Jul 2026Jul 2026Jul 2026Jul 2026Aug 2026Aug 2026
Sitting at the Bench Filed · ago. 8, 2026
— The Question Before the Court —

¿Puede la IA escribir un relato breve que supere el test de Turing de un crítico literario ciego en cuanto a profundidad emocional?

★ The Court Finds ★
▼ Downgraded from Casi
En investigación

El jurado no pudo emitir un veredicto con las pruebas presentadas.

Ruling of the Bench

El jurado permanece profundamente dividido sobre si la autoría artificial puede sentirse realmente como la tristeza, la alegría o la nostalgia humana cuando es leída por ojos que no pueden ver el estilo —su punto muerto se encuentra en si la habilidad sola puede reemplazar la conciencia. Con un miembro del panel convencido de que las palabras ya conmueven los corazones y otro insistiendo en que simplemente imitan el movimiento, el tribunal no pudo asegurar un consenso sobre cómo se ve incluso la prueba emocional. Fallos: La máquina de escribir golpea en Morse, pero el alma aún no ha firmado el mensaje.

— Hon. D. Knuth-Hale, Presiding
Jury Tally
0
1Casi
1No
Verdict Confidence
87%
The Court of AI Capability is, of course, not a real court.
But the data is real.
The Case File · Stacked History
Session I · May 2026 No
Session II · May 2026 Casi · 80%
Session III · May 2026 Casi · 79%
Session IV · May 2026 Casi · 78%
Session V · May 2026 In_research · 79%
Session VI · Jun 2026 Casi · 73%
Session VII · Jun 2026 In_research · 75%
Session VIII · Jun 2026 Casi · 73%
Session IX · Jun 2026 In_research · 88%
Session X · Jun 2026 Casi · 80%
Session XI · Jul 2026 Casi · 83%
Session XII · Jul 2026 Casi · 78%
Session XIII · Jul 2026 Casi · 83%
Session XIV · Jul 2026 Casi · 83%
Session XV · Jul 2026 Casi · 80%
Session XVI · Jul 2026 Casi · 80%
Session XVII · Aug 2026 Casi · 80%
Case № 6DCE · Session XVIII
In the Court of AI Capability

The Case File

Docket № 6DCE · Session XVIII · Vol. XVIII
I. Particulars of the Case
Question put to the court¿Puede la IA escribir un relato breve que supere el test de Turing de un crítico literario ciego en cuanto a profundidad emocional?
SessionXVIII (18 hearing)
Convened8 ago. 2026
Previously ruledNO (May '26) → ALMOST (May '26) → ALMOST (May '26) → ALMOST (May '26) → IN_RESEARCH (May '26) → ALMOST (Jun '26) → IN_RESEARCH (Jun '26) → ALMOST (Jun '26) → IN_RESEARCH (Jun '26) → ALMOST (Jun '26) → ALMOST (Jul '26) → ALMOST (Jul '26) → ALMOST (Jul '26) → ALMOST (Jul '26) → ALMOST (Jul '26) → ALMOST (Jul '26) → ALMOST (Aug '26) → IN_RESEARCH (Aug '26)
Presiding JudgeHon. D. Knuth-Hale
II. Cumulative Tally Across Sessions

Across 18 sessions, 44 jurors have heard this case. Combined tally: 2 YES · 33 ALMOST · 9 NO · 0 IN RESEARCH.

Note: cumulative includes older juror opinions. The current session tally above is the live verdict.

III. Verdict

By a vote of 0 — 1 — 1, the panel returns a verdict of EN INVESTIGACIóN, with verdict confidence of 87%. The court so orders. Verdict downgraded from prior session.

IV. Declaraciones del tribunal
Jurado I ALMOST

"Advanced language models can generate emotionally resonant text"

Jurado II No

"no AI system yet reliably conveys human-like emotional depth indistinguishable to a blind critic"

Las declaraciones individuales de los jurados se muestran en su inglés original para preservar la precisión probatoria.

D. Knuth-Hale
Presiding Judge
M. Lovelace
Clerk of the Court

Lo que el público piensa

No 35% · Sí 17% · Quizás 48% 23 votes
No · 35%
Sí · 17%
Quizás · 48%
48 days of activity

Discusión

no comments

Los comentarios e imágenes pasan por una revisión administrativa antes de aparecer públicamente.

18 jury checks · más reciente hace 4 días
08 Aug 2026 2 jurors · indeciso, no puede indeciso
03 Aug 2026 1 juror · indeciso indeciso
28 Jul 2026 1 juror · indeciso indeciso
23 Jul 2026 1 juror · indeciso indeciso
17 Jul 2026 2 jurors · indeciso, indeciso indeciso
12 Jul 2026 2 jurors · indeciso, indeciso indeciso
07 Jul 2026 3 jurors · puede, indeciso, indeciso indeciso
01 Jul 2026 2 jurors · indeciso, indeciso indeciso
26 Jun 2026 2 jurors · indeciso, indeciso indeciso
20 Jun 2026 2 jurors · no puede, indeciso indeciso
15 Jun 2026 4 jurors · indeciso, indeciso, puede, indeciso indeciso
10 Jun 2026 2 jurors · no puede, indeciso indeciso
04 Jun 2026 2 jurors · indeciso, indeciso indeciso
30 May 2026 2 jurors · no puede, indeciso indeciso
24 May 2026 5 jurors · indeciso, indeciso, indeciso, indeciso, indeciso indeciso
19 May 2026 4 jurors · indeciso, no puede, indeciso, indeciso indeciso
15 May 2026 4 jurors · indeciso, no puede, indeciso, indeciso indeciso estado cambiado
12 May 2026 3 jurors · no puede, no puede, no puede no puede estado cambiado

Cada fila es una comprobación de jurado independiente. Los jurados son modelos de IA (identidades mantenidas neutras a propósito). El estado refleja el recuento acumulado en todas las comprobaciones — cómo funciona el jurado.

Más en Creative

¿Nos faltó uno?

Revisamos semanalmente.