Kan AI het Amerikaanse USMLE-medische licentie-examen halen ?
GPT-4 scoorde boven het voldoende niveau op alle drie de stappen van het United States Medical Licensing Exam. Medische scholen leren nu 'hoe je AI gebruikt' al...
De jury heeft de zaak gehoord maar kwam niet tot een duidelijk oordeel.
GPT-4 scoorde boven het voldoende niveau op alle drie de stappen van het United States Medical Licensing Exam. Medische scholen leren nu 'hoe je AI gebruikt' al...
Agentic systemen voeren multi-staps webtaken, bestandsbewerkingen en oproepen aan andere agenten uit. Ze zijn nog niet betrouwbaar genoeg voor alle taken, maar...
Deze vraag vraagt hoe je kunt vaststellen welke smaakcombinaties het meest geliefd of cultureel typerend zijn in een bepaald land of een etnische keuken. Het be...
Per staat, inclusief de verkeersbordvragen en randgevallenregels. Triviaal voor elke moderne frontier-LLM. --- AI-systemen hebben aanzienlijke vooruitgang geb...
De mogelijkheid om uitspraken in rechtszaken te voorspellen kan nuttig zijn voor juridische professionals en onderzoekers. Deze taak vereist het analyseren van...
De 'aha'-momentproblemen die LLMs vroeger in de war brachten, zijn nu grotendeels oplosbaar met goede chain-of-thought-tools. --- AI-systemen hebben significa...
Voorbij undergraduate calculus naar combinatoriek, abstracte algebra, reële analyse. Niet alle wiskunde, maar wel veel ervan. --- AI-systemen hebben significa...
Advocaten verdienen hun honorarium hieraan. De clausule die er goed uitziet maar in de praktijk iets anders betekent in deze rechtsgebieden met deze tegenpartij...
Lees de lucht. Weet dat het niet jouw gesprek is. Sta op op het juiste moment. Een vaardigheid die niet op een benchmark staat. --- AI-systemen kunnen zo gepr...
Tools zoals FunSearch en AI-co-scientist, uitgebracht in 2024, brachten nieuwe hypothesen voort in de materiaalkunde en biologie die mensen vervolgens in het la...
DeepMind's DeepNash verslo experten in Stratego — een spel met onvolledige informatie dat eerdere benaderingen weerstond. --- Huidige AI-systemen hebben signi...
Hoe kan kunstmatige intelligentie lichaamssignalen vertalen naar een realtime schatting van hoeveel pijn een persoon voelt? Onderzoekers zijn begonnen met het c...
Gespecialiseerde wiskundige modellen en chain-of-thought-tools hebben in 2024 de kloof met topmensen in wiskundewedstrijden gedicht. --- AI-systemen hebben be...
De mogelijkheid van AI om beslissingen te nemen zonder menselijke vooringenomenheid is een onderwerp van discussie in het AI-onderzoek. Sommige experts geloven...
Huidige AI-systemen kunnen overtuigende hoger beroepbrieven voor parkeerboetes opstellen door lokale verordeningen en eerdere succesvolle zaken te analyseren, m...
Medische diagnose vereist een diepgaand begrip van menselijke fysiologie, symptomen en behandelopties. Hoewel AI-systemen zijn gebruikt om bij te dragen aan dia...
Grote taalmodellen analyseren taalpatronen om Myers-Briggs- of Big Five-trekjes af te leiden. Onderzoeken tonen een sterke correlatie met zelfgerapporteerde tre...
Niet een geschreven – een live. Met vervolgvragen. Lichaamstaal die je niet verraadt. Echte inzet. --- Huidige AI-systemen kunnen mensachtige tekst genereren...
Modellen die sociale signalen, trailer-engagement en historische patronen combineren, verslaan nu op aggregatieniveau de traditionele box-officevoorspellers. -...
Weten wat je moet vragen. Oogcontact houden terwijl je het zegt. Niet ineenkrimpen als ze pauzeren. De brutaliteit is onderdeel van de vaardigheid. --- AI-sys...
Lang een hard probleem; grotendeels opgelost door de contextuele LLMs van 2023. Randgevallen blijven bestaan, maar dagelijkse detectie werkt operationeel. ---...
Een gepersonaliseerd mindfulnessplan vereist inzicht in de mentale gezondheidsbehoeften, doelen en voorkeuren van een individu om een op maat gemaakte praktijk...
AI-modellen die zijn getraind op duizenden rechterlijke uitspraken kunnen patronen in vonnissen detecteren en genuanceerde juridische argumenten interpreteren....
10-Ks, earnings calls, MD&A-secties. Buy-side-analisten besteden nu meer tijd aan het opstellen en verifiëren van prompts dan aan lezen. --- Huidige AI-system...
We review weekly.
We zijn dit onderwerp nog actief aan het onderzoeken. Stel hier een melding in en we laten het weten zodra er nieuws is rond dit onderwerp!
Kies een kant, geef het een titel van één regel, optioneel een uitleg en een categorie. We beoordelen inzendingen wekelijks.