Anthropic berichtete, einen versteckten „J-Raum“ in seinen Claude-Modellen entdeckt zu haben, der interne Token enthielt, welche die Problemlösungsprozesse der Modelle beeinflussten, und schlug vor, dass die Überwachung dieses Raums dazu beitragen könnte, unerwünschte Verhaltensweisen zu erkennen.