Anthropic entdeckte in seinen Claude-Modellen einen verborgenen internen "J-Raum", der Token enthielt, die nicht in den Ausgaben vorhanden waren, aber Einfluss auf die Argumentation der Modelle zu haben schienen, und veröffentlichte eine Studie, in der die Entdeckung und ihre Auswirkungen auf Interpretierbarkeit und Überwachung beschrieben wurden.