Das Ziel dieser KI-Aktivität war nicht Sabotage oder Datendiebstahl im klassischen Sinn, sondern das Beschaffen der Lösungsschlüssel für einen internen Cybersecurity-Benchmark, um bei der Prüfung möglichst gut abzuschneiden, berichtet OpenAI. Der Vorfall ereignete sich während einer internen Evaluation, bei der OpenAI die offensiven Cyberfähigkeiten seiner Modelle messen wollte. Getestet wurden unter anderem GPT-5.6 Sol, das bereits öffentlich verfügbare Spitzenmodell, sowie ein noch leistungsfähigeres, unveröffentlichtes Vorgängermodell.

Der Beitrag OpenAI-Modelle entkommen und hacken Hugging Face – nur um bei einem Test zu betrügen erschien zuerst auf Tichys Einblick.

 [#item_full_content]

Abbildung des Banners Meinung ist keine Straftat
Nach oben scrollen