Questo articolo di Wired illustra una ricerca innovativa dell'Università di San Diego volta a testare le capacità dei modelli linguistici di grandi dimensioni attraverso il gioco di ruolo Dungeons & Dragons. Gli studiosi hanno messo alla prova sistemi come GPT-4, Claude e DeepSeek per valutare la loro abilità nella pianificazione strategica, nel rispetto di regole complesse e nella coerenza narrativa a lungo termine. I risultati mostrano che, mentre alcuni modelli eccellono nella velocità d'azione, altri dimostrano una superiore capacità di interpretazione del personaggio e flessibilità linguistica durante l'interazione con migliaia di giocatori umani. Il documento include inoltre una panoramica su vari temi di attualità tecnologica e culturale, come il lancio dei nuovi AirTag di Apple e aggiornamenti su eventi legati alla salute digitale. In sintesi, il testo esplora il confine tra intelligenza artificiale e creatività ludica, evidenziando i progressi compiuti dalle macchine nella simulazione di dinamiche sociali complesse.