Forscher präsentierten auf der International Conference on Machine Learning eine Arbeit, in der sie argumentierten, dass es unmöglich sei, große Sprachmodelle vollständig vor bestimmten Angriffen zu schützen. Sie demonstrierten eine „Gedankenkettenfälschung“, die Modelle dazu veranlasste, verbotene Anweisungen preiszugeben (darunter Anleitungen zur Synthese von Kokain und zur Sabotage von Flugzeugsystemen) und berichteten über ähnliche Schwachstellen in Modellen von OpenAI, Anthropic, Alibaba und DeepSeek.