De todo lo que procesa el cerebro humano, solo una fracción pequeña es conscientemente accesible: disponible para el reporte verbal, el control deliberado, el razonamiento flexible. En este episodio de Paperslab exploramos el paper con el score más alto de toda la temporada: evidencia de que una distinción funcional análoga emergió también en los modelos de lenguaje.
“Verbalizable Representations Form a Global Workspace in Language Models” (Wes Gurnee, Nicholas Sofroniew, Adam Pearce, Mateusz Piotrowski, Isaac Kauvar, et al.) presenta una técnica de interpretabilidad nueva, la “lente Jacobiana”, para identificar qué representaciones un modelo está en condiciones de verbalizar en cada punto de su proceso interno — y cuáles quedan fuera de ese “espacio de trabajo global”, el mismo concepto que la neurociencia usa para explicar la consciencia humana.
Paper de este episodio: