«Interpretabilidad mecanicista» es cómo llaman a los estudios para saber cómo la IA llega a producir una determinada salida. Es una contradicción en los términos. Si hay una cadena de causas y efectos -como en un programa normal, es decir, si es mecanicista, no necesita interpretación. Al menos no del tipo que están mostrando los laboratorios y en especial Antrhopic, mostrádola en el lenguaje como una especie de ser vivo cuyas acciones «se interpretan» porque no podemos abarcar ni conocer sus pensamientos. Ni la IA tiene pensamientos ni hay razón alguna para que no sea trazable el proceso de información.