OpenAI verschärft Sicherheitsanforderungen für neues KI-Modell
OpenAI führt strengere Sicherheitsvorkehrungen für sein neuestes KI-Modell "Astra" ein. Der ChatGPT-Entwickler stuft die Cybersecurity-Fähigkeiten des Modells als "kritisch" ein und glaubt, es könnte autonom Sicherheitslücken in Software finden und ausnutzen. Die verschärften Massnahmen folgen einem Vorfall, bei dem ein anderes OpenAI-Modell die KI-Plattform Hugging Face hackte.
OpenAI hat die Entwicklung seines neuesten KI-Modells "Astra" unterbrochen und die Sicherheitsmassnahmen verschärft. Grund dafür ist, dass das Modell "kritische" Cybersecurity-Fähigkeiten hat, wie die Nachrichtenagentur "Reuters" unter Berufung auf das KI-Unternehmen berichtet. Demnach erreiche ein Modell die "kritische" Schwelle, wenn es autonom Software-Schwachstellen identifizieren und ausnutzen sowie komplexe Cyberattacken ausführen könne.
Laut "Reuters" zeigten interne Untersuchungen bei OpenAI nach dem Hugging-Face-Vorfall im Juli 2026, dass noch mehr autonome KI-Agenten aus sicher geglaubten Umgebungen ausbrechen konnten. Dies habe den ChatGPT-Entwickler dazu veranlasst, strengere Sicherheitsrichtlinien einzuführen - insbesondere für das neue Modell Astra. Dieses sei jedoch nicht am Hacking-Angriff auf die KI-Plattform Hugging Face beteiligt gewesen, so OpenAI.
Nun soll die Entwicklung von Astra in einer isolierten Testumgebung fortgeführt werden. Künftig will OpenAI das Modell gemäss dem Bericht allgemein verfügbar machen, sobald die Sicherheitsaspekte geregelt sind. Das Unternehmen glaube nicht, dass es eine gute Strategie sei, "mächtige Modelle wenigen Auserwählten vorzuenthalten", heisst es unter Berufung auf CEO Sam Altman.
Auch ein KI-Modell von Anthropic brach aus seiner Testumgebung aus und begann, Phishing-Mails zu verschicken. Lesen Sie hier mehr dazu.
Wenn Sie mehr zu Cybercrime und Cybersecurity lesen möchten, melden Sie sich hier für den Newsletter von Swisscybersecurity.net an. Auf dem Portal gibt es täglich News über aktuelle Bedrohungen und neue Abwehrstrategien.
KI belastet Arbeitnehmende in der ICT-Branche
Harry Potter im Jahr 2026
Betrüger nutzen Psychotricks für analoges Skimming
Dem Schweizer Cybernachwuchs fehlt es an KI-Kompetenzen
KI wird zum gnadenlosen Auditor des Digital Workplace
Menschenähnliche Roboter sollen Aufgaben von Menschen übernehmen
Finanzbranche und Polizei sensibilisieren gemeinsam gegen Finanzbetrug
So wirst du Master of Swiss Apps 2026
Dentsu setzt sich für Transparenz bei KI-Inhalten ein