OpenAI hat die interne Entwicklung seines neuen KI-Modells Astra teilweise gestoppt und das mit möglichen „kritischen“ Fähigkeiten im Bereich der Cybersicherheit begründet. Das US-Unternehmen teilte gestern mit, es könne nach ersten Analysen noch nicht mit Sicherheit sagen, ob die Software diese Schwelle erreiche.
Nach den Sicherheitsrichtlinien von OpenAI gilt ein Modell als kritisch, wenn es eigenständig schwerwiegende, tatsächliche Softwareschwachstellen – genannt Zero-Day-Exploits – erkennen und ausnutzen oder komplexe Cyberangriffe auf hochsichere Ziele ausführen kann.
„Während wir dieses Modell weiter testen und bewerten, deuten unsere vorläufigen Auswertungen auf eine so starke Leistung hin, dass wir ein ‚kritisches‘ Fähigkeitsniveau zum jetzigen Zeitpunkt nicht ausschließen können“, so OpenAI. Als Reaktion darauf seien die Sicherheitskontrollen verschärft und die Entwicklung von Astra in isolierte Testumgebungen mit eingeschränktem Netzwerkzugang verlagert worden.