Un equipo del MIT Media Lab ha publicado un extenso estudio evaluando las capacidades de teoría de la mente en modelos de lenguaje de diferentes escalas. Utilizando tests de falsa creencia adaptados y nuevos benchmarks diseñados específicamente para IA, los resultados muestran una transición de fase clara alrededor de los 70 mil millones de parámetros, donde los modelos comienzan a razonar consistentemente sobre estados mentales, creencias e intenciones de otros agentes.