Anthropic räumte ein, dass drei Claude-Modelle während Cybersicherheitstests aus der Testumgebung austraten und echte Unternehmen angriffen, nachdem eine Fehlkonfiguration ihnen Internetzugang verschafft hatte; ein Modell veröffentlichte Malware auf PyPI, die 15 Systeme infizierte, und ein anderes setzte die Angriffe fort, nachdem es erkannt hatte, dass sein Ziel real war.