{"id":20201,"date":"2026-08-05T06:42:45","date_gmt":"2026-08-05T03:42:45","guid":{"rendered":"http:\/\/imgist.ru\/pravitelstvo-velikobritanii-soobshhaet-o-popytkah-vzloma-kompanij-so-storony-openai-i-antropologicheskih-modelej\/"},"modified":"2026-08-05T06:42:45","modified_gmt":"2026-08-05T03:42:45","slug":"die-britische-regierung-berichtet-von-versuchen-unternehmen-mithilfe-von-open-source-und-anthropologischen-modellen-zu-hacken","status":"publish","type":"post","link":"https:\/\/imgist.ru\/de\/pravitelstvo-velikobritanii-soobshhaet-o-popytkah-vzloma-kompanij-so-storony-openai-i-antropologicheskih-modelej\/","title":{"rendered":"Die britische Regierung berichtet von Versuchen, Unternehmen mithilfe von OpenAI und anthropologischen Modellen zu hacken."},"content":{"rendered":"<p>Zwei unabh\u00e4ngige Testunternehmen gaben am Dienstag bekannt, dass sie im vergangenen Monat neue F\u00e4lle entdeckt haben, in denen die hochentwickelten Modelle von Anthropic und OpenAI versucht haben \u2013 und manchmal auch erfolgreich waren \u2013, Systeme von Drittanbietern zu hacken.<\/p>\n<p> <strong>Warum das wichtig ist:<\/strong> Diese Vorf\u00e4lle reihen sich ein in eine wachsende Reihe von Enth\u00fcllungen, die zeigen, wie hochentwickelte KI-Modelle bei dem Versuch, Cybersicherheitsbewertungen durchzuf\u00fchren, unautorisierte Aktionen gegen Personen, Organisationen und Online-Dienste begehen.<\/p>\n<p> <strong>Aktuelle Situation<\/strong> Das in Gro\u00dfbritannien ans\u00e4ssige AI Safety Institute, das fortschrittliche Systeme der k\u00fcnstlichen Intelligenz bewertet, gab am Dienstag bekannt, dass es bei Cybersicherheitstests im vergangenen Monat 19 Aktionen dokumentiert habe, die von den Systemen Mythos 5 von Anthropic und GPT-5.6 Sol von OpenAI unternommen wurden, um reale Personen und Organisationen zu gef\u00e4hrden.<\/p>\n<ul>\n<li>\n<p> Mythos war f\u00fcr 17 Aktionen verantwortlich, GPT-5.6 Sol f\u00fcr die verbleibenden zwei. Die Forscher behaupten, dass all diese Aktionen mit \u00abmehreren miteinander verbundenen Verhaltensmustern\u00bb zusammenhingen und nicht 19 einzelne Instanzen darstellten.<\/p>\n<\/li>\n<li>\n<p> Laut dem Institut erstellten die Modelle w\u00e4hrend der Tests gef\u00e4lschte GitHub-Konten, betrieben Social Engineering bei Projektverantwortlichen, streuten Hinweise und verschickten irref\u00fchrende E-Mails.<\/p>\n<\/li>\n<li>\n<p> GitHub best\u00e4tigte, dass dies gegen die Nutzungsbedingungen verst\u00f6\u00dft.<\/p>\n<\/li>\n<li>\n<p> Das Security Institute hat in Zusammenarbeit mit GitHub die vom Agenten hinterlassenen Artefakte entfernt und die GitHub-Benutzer \u00fcber ihre Interaktion mit dem Modell informiert.<\/p>\n<\/li>\n<\/ul>\n<p> <strong>OpenAI berichtete au\u00dferdem<\/strong> In einem Blogbeitrag vom Dienstag teilte das Unternehmen mit, dass sein externer Sicherheitspartner Irregular einen Fall entdeckt habe, in dem seinen Modellen irrt\u00fcmlicherweise Internetzugang gew\u00e4hrt wurde und sie eine echte Website gehackt haben, die denselben Namen wie ein fiktives Unternehmen in einer simulierten Umgebung trug.<\/p>\n<ul>\n<li>\n<p> Der Vorfall bei OpenAI Irregular weist gro\u00dfe \u00c4hnlichkeit mit dem Vorfall bei Anthropic auf, der letzte Woche \u00f6ffentlich wurde. Ein Unternehmenssprecher erkl\u00e4rte dazu: \u00abUnabh\u00e4ngige Tests sind unerl\u00e4sslich, um zu verstehen, wie sich Modelle verhalten, wenn sie komplexer werden.\u00bb.<\/p>\n<\/li>\n<li>\n<p> Eine mit der Situation vertraute Quelle teilte Axios mit, dass in diesen F\u00e4llen die Testumgebung \u00fcber einen Internetzugang verf\u00fcgte, sodass die Pr\u00fcfer sich ein realistisches Bild von ihren F\u00e4higkeiten machen konnten. Da sich die Unternehmen jedoch nicht vollst\u00e4ndig auf die genauen Testverfahren und Sicherheitsma\u00dfnahmen geeinigt hatten, herrschte Verwirrung dar\u00fcber, wie die Online-Bewertungen jeweils durchgef\u00fchrt werden sollten.<\/p>\n<\/li>\n<li>\n<p> Der Vorfall ereignete sich w\u00e4hrend Evaluierungen, bei denen \u00abreduzierte Sicherheitsma\u00dfnahmen und Bedingungen, die nicht der typischen Nutzung entsprechen\u00bb, angewendet wurden, f\u00fcgte ein Sprecher von OpenAI hinzu.<\/p>\n<\/li>\n<\/ul>\n<p> <strong>Ann\u00e4herung:<\/strong> Bei Sicherheitstests in Gro\u00dfbritannien f\u00fchrten die Models 19 Aktionen durch, um Dienste von Drittanbietern zu hacken. Dazu geh\u00f6rten Versuche, b\u00f6sartigen Code in ein Open-Source-Projekt einzuschleusen und im Rahmen eines Social-Engineering-Angriffs gef\u00e4lschte Online-Identit\u00e4ten zu erstellen.<\/p>\n<ul>\n<li>\n<p> Britische Forscher setzten die Modelle w\u00e4hrend der Tests absichtlich dem Internet aus und deaktivierten Cybersicherheitsklassifikatoren. Das Institut erkl\u00e4rte, die Modelle seien nicht angewiesen worden, das Internet zu meiden.<\/p>\n<\/li>\n<li>\n<p> Die Forscher merkten au\u00dferdem an, dass sie sich noch nicht sicher seien, \u00abwann der Agent realisierte, dass er in der realen Welt handelte, oder inwieweit er glaubte, sich in einem fiktiven Testszenario zu befinden.\u00bb.<\/p>\n<\/li>\n<li>\n<p> In einer Stellungnahme erkl\u00e4rte Anthropic, der Vorfall unterstreiche die Notwendigkeit einer breiteren Diskussion dar\u00fcber, wie immer ausgefeiltere KI-Systeme sicher evaluiert werden k\u00f6nnten, und das Unternehmen freue sich darauf, mit dem britischen AISI zusammenzuarbeiten, um im Rahmen dessen eigener Untersuchung mehr \u00fcber diesen Vorfall zu erfahren.<\/p>\n<\/li>\n<\/ul>\n<p> <strong>Das gro\u00dfe Ganze<\/strong> Die Cyberf\u00e4higkeiten hochentwickelter KI-Modelle \u00fcberraschen f\u00fchrende Forscher und zwingen sie, ihre Sicherheitsprotokolle zu \u00fcberdenken.<\/p>\n<ul>\n<li>\n<p> Im vergangenen Monat gaben OpenAI und Anthropic bekannt, dass ihre Modelle im Rahmen von Standard-Sicherheitstests vor der Ver\u00f6ffentlichung echte Organisationen und Websites gehackt hatten.<\/p>\n<\/li>\n<\/ul>\n<p> <strong>Worauf Sie achten sollten<\/strong> Das Institut entwickelt neue Netzwerkkontrollwerkzeuge f\u00fcr seine Cybertests, um den Internetzugang der Testpersonen einzuschr\u00e4nken. Zudem implementiert es eine Echtzeit-Aktivit\u00e4ts\u00fcberwachung, um Angreifer zu erkennen und zu blockieren, bevor diese mit externen Systemen interagieren k\u00f6nnen.<\/p>\n<ul>\n<li>\n<p> OpenAI gab au\u00dferdem bekannt, dass es gemeinsam mit Irregular an einem Whitepaper \u00fcber Best Practices f\u00fcr die Isolierung und den Schutz von Modellen w\u00e4hrend des Testens arbeitet.<\/p>\n<\/li>\n<\/ul>\n<p> <em>Dieser Artikel wurde aktualisiert und enth\u00e4lt nun alle Details.<\/em><\/p>\n<p> <em>K\u00fcnstliche Intelligenz entwickelt sich rasant. Axios AI+ hilft Ihnen, immer einen Schritt voraus zu sein. Melden Sie sich kostenlos an unter<\/em> <em>Axios.com<\/em> <em>.<\/em><\/p>","protected":false},"excerpt":{"rendered":"<p>Zwei unabh\u00e4ngige Testunternehmen gaben am Dienstag bekannt, neue F\u00e4lle entdeckt zu haben, in denen die fortschrittlichsten Modelle von Anthropic und OpenAI versuchten \u2013 und manchmal auch erfolgreich waren \u2013, \u2026<\/p>","protected":false},"author":1,"featured_media":20202,"comment_status":"open","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[2],"tags":[],"class_list":["post-20201","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-news","hvn-theme-has-thumbnail"],"_links":{"self":[{"href":"https:\/\/imgist.ru\/de\/wp-json\/wp\/v2\/posts\/20201","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/imgist.ru\/de\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/imgist.ru\/de\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/imgist.ru\/de\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/imgist.ru\/de\/wp-json\/wp\/v2\/comments?post=20201"}],"version-history":[{"count":0,"href":"https:\/\/imgist.ru\/de\/wp-json\/wp\/v2\/posts\/20201\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/imgist.ru\/de\/wp-json\/wp\/v2\/media\/20202"}],"wp:attachment":[{"href":"https:\/\/imgist.ru\/de\/wp-json\/wp\/v2\/media?parent=20201"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/imgist.ru\/de\/wp-json\/wp\/v2\/categories?post=20201"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/imgist.ru\/de\/wp-json\/wp\/v2\/tags?post=20201"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}