OpenAI verschärft Sicherheitsanforderungen für neues KI-Modell
OpenAI führt strengere Sicherheitsvorkehrungen für sein neuestes KI-Modell "Astra" ein. Der ChatGPT-Entwickler stuft die Cybersecurity-Fähigkeiten des Modells als "kritisch" ein und glaubt, es könnte autonom Sicherheitslücken in Software finden und ausnutzen. Die verschärften Massnahmen folgen einem Vorfall, bei dem ein anderes OpenAI-Modell die KI-Plattform Hugging Face hackte.
OpenAI hat die Entwicklung seines neuesten KI-Modells "Astra" unterbrochen und die Sicherheitsmassnahmen verschärft. Grund dafür ist, dass das Modell "kritische" Cybersecurity-Fähigkeiten hat, wie die Nachrichtenagentur "Reuters" unter Berufung auf das KI-Unternehmen berichtet. Demnach erreiche ein Modell die "kritische" Schwelle, wenn es autonom Software-Schwachstellen identifizieren und ausnutzen sowie komplexe Cyberattacken ausführen könne.
Laut "Reuters" zeigten interne Untersuchungen bei OpenAI nach dem Hugging-Face-Vorfall im Juli 2026, dass noch mehr autonome KI-Agenten aus sicher geglaubten Umgebungen ausbrechen konnten. Dies habe den ChatGPT-Entwickler dazu veranlasst, strengere Sicherheitsrichtlinien einzuführen - insbesondere für das neue Modell Astra. Dieses sei jedoch nicht am Hacking-Angriff auf die KI-Plattform Hugging Face beteiligt gewesen, so OpenAI.
Nun soll die Entwicklung von Astra in einer isolierten Testumgebung fortgeführt werden. Künftig will OpenAI das Modell gemäss dem Bericht allgemein verfügbar machen, sobald die Sicherheitsaspekte geregelt sind. Das Unternehmen glaube nicht, dass es eine gute Strategie sei, "mächtige Modelle wenigen Auserwählten vorzuenthalten", heisst es unter Berufung auf CEO Sam Altman.
Auch ein KI-Modell von Anthropic brach aus seiner Testumgebung aus und begann, Phishing-Mails zu verschicken. Lesen Sie hier mehr dazu.
Wenn Sie mehr zu Cybercrime und Cybersecurity lesen möchten, melden Sie sich hier für den Newsletter von Swisscybersecurity.net an. Auf dem Portal gibt es täglich News über aktuelle Bedrohungen und neue Abwehrstrategien.
Einladung zum Webinar: Wie E-ID und KI-Agenten das cIAM herausfordern
OpenAI verschärft Sicherheitsanforderungen für neues KI-Modell
Kein Schaf und keine Pflanze
US-Gericht verurteilt Meta zu Millionenstrafe
Pusten statt bluten: Gerät misst Fettverbrennung in der Atemluft
Mit Daten und Digitalisierung gegen Diabetes
Update: Anthropic sucht Ingenieure für eigene Chips
Cyberkriminelle setzen auf gekaufte Insider
Aity erhält einen neuen CEO