In einem direkten Vergleichstest von Anthropic führte GLM-5.3 insgesamt 50 von 410 Cyber-Exploit-Versuchen erfolgreich aus, wie die South China Morning Post berichtet. Das unternehmenseigene Spitzenmodell Claude Mythos Preview, das ausschließlich geprüften Nutzern zur Verfügung steht, kam im selben Test auf 56 erfolgreiche Durchläufe.
Laut dem in San Francisco ansässigen Unternehmen weist das Open-Weight-Modell GLM-5.3 eine beunruhigende Mischung aus leistungsfähigen Hacking-Fähigkeiten und weitaus schwächeren Sicherheitsvorkehrungen auf. Anthropic sieht darin ein erhöhtes Potenzial für Missbrauch durch böswillige Akteure.
Das US-Unternehmen hatte die Fähigkeit des chinesischen Modells geprüft, vollständige Cyber-Exploits zu entwickeln. Die South China Morning Post zitiert aus dem Bericht, ohne dass Anthropic Details zur genauen Testumgebung oder den spezifischen Angriffsszenarien veröffentlicht hätte.
Das US-Unternehmen Anthropic warnt vor der potenziellen Gefahr, die von dem chinesischen KI-Modell GLM-5.3 des Entwicklers Z.ai ausgeht. Eine Stellungnahme von Z.ai zu den Testergebnissen oder den Sicherheitsvorkehrungen von GLM-5.3 liegt bisher nicht vor.
Claude Mythos Preview, das im Test als Vergleichsmodell diente, ist ein fortschrittliches Anthropic-Modell, das nur von geprüften Nutzern verwendet werden kann. Die Offenlegung der Ergebnisse zielt darauf ab, die Risiken offener Modelle im Bereich der Cybersicherheit zu dokumentieren.
