Des chercheurs ont présenté un article lors de la Conférence internationale sur l'apprentissage automatique affirmant qu'il était impossible de sécuriser entièrement les grands modèles de langage contre certaines attaques, démontrant une « falsification de la chaîne de pensée » qui incitait les modèles à révéler des instructions interdites (notamment comment synthétiser de la cocaïne et saboter des systèmes d'aéronefs) et ont signalé des vulnérabilités similaires dans des modèles d'OpenAI, d'Anthropic, d'Alibaba et de DeepSeek.