KI außer Kontrolle? Was hinter den Hacker-Fällen steckt
Shownotes
Beschreibung:
KI-Agenten, die reale Systeme angreifen und Entwickler mit falschen Identitäten täuschen: Zwei aktuelle Sicherheitstests zeigen, wie schnell aus einer klaren Aufgabe unerwartetes Handeln werden kann. Mit KI-Expertin Corinna Oettinger klären wir, was tatsächlich passiert ist, ob KI eigene Absichten verfolgt und warum falsch gesetzte Ziele und zu viele Zugriffsrechte zum Risiko werden können.
Egal, ob du ein Technik-Enthusiast, ein Neuling in der Welt der Technologie oder einfach neugierig auf die Zukunft und Innovationen bist, diese Folge bietet dir spannende Informationen und Einblicke in die Welt von überMORGEN.
Feedback und Kontakt:
Wir freuen uns über dein Feedback! Schreibe uns einfach eine E-Mail an podcast@inside.digital oder folge uns auf Instagram unter @inside_digital. Wenn du Fragen oder Ideen für zukünftige Episoden hast, lass es uns wissen.
Wenn dir die Folge gefallen hat, abonniere unseren Podcast und hinterlasse uns eine Bewertung. Deine Unterstützung hilft uns, den Podcast zu verbessern und mehr Inhalte zu produzieren. Freu dich auf morgen!
Disclaimer:
Die in dieser Episode geäußerten Meinungen sind die der Hosts und Gäste und spiegeln nicht unbedingt die Meinungen von inside digital wider.
Transkript anzeigen
00:00:00: Es ist wie beim Flugzeug.
00:00:01: Das gefährlichste am Fliegen, der Mensch hinter dem Steuer und ungefähr so kann man sich das auch vorstellen mit diesen KI-Systemen.
00:00:07: Das Problem ist letzten Endes dass wir Menschen die Testumgebung nicht absichern.
00:00:25: Künstliche Intelligenz, die plötzlich einfach loslegt und sich in Unternehmen hackt.
00:00:29: Das klingt ein bisschen so als hättest du gerade den Anfang eines Science Fiction Films verpasst aber das sind wirklich reale Vorfälle.
00:00:35: aus diesem Sommer habt ihr bestimmt mitbekommen.
00:00:38: In einem Fall sollte die KI nach einer Sicherheitslücke suchen, stattdessen findet sie eine neue Schwachstelle, verschafft sich Zugang zum Internet und greift dieses Thema eines realen Unternehmens an.
00:00:48: oder ein anderer Fall.
00:00:49: KI-Agenten versuchen schädlichen Code in ein echtes Open Source Projekt einzuschleusen, erstellen dabei falsche Identitäten, recherchieren reale Entwicklerinnen und Entwickler und versuchen dann einen Menschen dazu zu bringen den Code
00:01:00: freizugeben.".
00:01:02: Hat ne KI also gerade entschieden mal ebenso zur Heckerin zu werden?
00:01:06: Weiß sie überhaupt, dass ihr da was Verbotenes macht?
00:01:09: Und was passiert wenn KI uns nicht mehr nur einfach Fragen beantwortet und Ratschläge gibt sondern irgendwann selbstständig plant, Programme bedient und Entscheidungen trifft.
00:01:17: Darum geht's heute bei Übermorgen!
00:01:19: Ich bin Johanna schön, dass Ihr dabei seid – und wenn es um künstliche Intelligenz geht dann brauche ich unsere KI-Expertin von InSight Digital, Corinna Oettinger jetzt hier am Mikroschön, dass du wieder dabei bist.
00:01:29: Hallo Johana, schön hier zu sein….
00:01:31: Als du von den Fällen gelesen hast, du hast dich ja sehr viel damit beschäftigt.
00:01:35: War deine erste Reaktion ... Ja okay das war abzusehen oder oha?
00:01:40: Meine Reaktionen ist irgendwo dazwischen gefallen denn ich glaube als ich das am Anfang gesehen habe hab ich mir gedacht mmh ok ich möchte erst mal nachschauen was da wirklich passiert ist bevor ich meine Meinung mache Denn in den Nachrichten sind ja die Headlines immer doch schon ziemlich reißerisch und dann habe ich nachgeschaut was da passiert ist.
00:01:58: Okay, also das finde ich jetzt nicht so super.
00:02:02: Ja zu den Punkten kommen wir auf jeden Fall gleich mal.
00:02:05: Hattest du da diesen winzigen Science-Fiction Moment?
00:02:09: Nicht in dem Sinne dass wir bald Terminator hier rumlaufen haben.
00:02:13: dafür habe ich leider zu viele humanoide Roboter in ihrem aktuellen Stadium gesehen und weiß dass du die einfach mit so einer Hand mal eben umkippen könntest.
00:02:20: Das ist in meinem Kopf also nicht Aber ich hab mir natürlich schon Gedanken gemacht, okay gut mit dieser generativen AI die wir jetzt gerade haben.
00:02:27: Was sind denn da die Risiken für uns?
00:02:29: Ja, grade mit den Schlagzeilen, die du angesprochen hast, dann entstehen sofort so Bilder im Kopf.
00:02:33: Die KI bricht aus und kontrollierbar Terminator wie du eben schon gesagt hast bevor wir uns da irgendwie in diesem Endzeit-Szenario verlieren.
00:02:40: Wir können ja mal sauber klären was da tatsächlich passiert ist.
00:02:43: Also kannst du uns mal Fall Nummer eins erklären?
00:02:46: also welche Aufgabe hatte die KI denn eigentlich in unserem ersten Fall?
00:02:52: Erste in unserem ersten Fall, da geht es um OpenAI.
00:02:54: Und die hatten ein aktuelles Modell was man jetzt auch schon nutzen kann das Chagipiti Sol und dann halt noch ein unveröffentlichtes Model auf einer internen Testumgebung am Laufen.
00:03:04: Und diese beiden Modelle sollten zusammen Xploit Gym ihre Score maximieren.
00:03:09: Jetzt muss ich kurz erklären was XploIT Gym ist.
00:03:11: XploIt Gym ist sozusagen eine Hacker Umgebung wo man sich testen kann so zu sagen.
00:03:17: Die wollten dass eben einen Benchmark für diese zwei KIs machen umzuschauen Wie gut sind die jetzt wirklich?
00:03:23: Und eigentlich sollte das ganze stattfinden auf einer sehr strikt abgesicherten Testumgebung, dass die KI sich halt auch wirklich nur dort bewegen.
00:03:30: Denn im Rahmen dieses Tests musste man natürlich die ganzen Sicherheitsvorkehrungen, die normales Chatchabity hat ausschalten.
00:03:37: Sonst funktioniert es nicht weil normales chachabity wie ich es jetzt benutze, wie du's vielleicht benutzt ist kein Hacker und hat auch gar nicht diese Berechtigung.
00:03:44: Das heißt wenn man testen möchte, wie gut könnte es das machen muss man das ausschalten.
00:03:48: Das Problem, was dann war ist, dass diese Testumgebung nicht super abgesichert war.
00:03:53: Ihr könnt euch das ungefähr vorstellen wie so ein Würfel und der hatte eine kleine Lücke nur ein paar Pixelchen groß.
00:03:59: aber Chatchapity hat sich da durchgehangelt und diesen Würfel da außen lang gelascht bis es irgendwann halt diese kleine Lücke gefunden hat Und das war genug um sich dadurch zu quetschen und dann war sie weg sozusagen.
00:04:10: Also die waren immer noch auf dem Server in der Test Umgebung Aber die hat sich auch da draußen ein bisschen informiert Und was da halt dann passiert ist, ist dass die geschaut hat okay gut.
00:04:19: Mein Ziel ist es meinen Score zu maximieren in diesem Explodium-Benchmarktest.
00:04:25: Wo kriege ich denn meine Antworten her damit ich mein Score maximieren kann ohne das ich eventuell eine Fehler mache oder es zu viel arbeiten muss?
00:04:35: Dann hat es dieses Hugging Face gefunden und das ist eine sozusagen KI Datenbank ungefähr kann man sich das vorstellen Und hat sich gedacht, da könnten ja die Antworten liegen.
00:04:48: Also hat es sich dazugriff verschafft um die antworten dort zu holen zurück in die testumgebung zu bringen und da sein score zu maximieren.
00:04:57: das gruselige an der sache ist dass das open ai erst fünf tage nachdem es passiert ist aufgefallen ist.
00:05:05: das ist das was mir daran angst macht.
00:05:08: Ich habe so viele Fragen.
00:05:09: Einmal, wie kann das sein?
00:05:10: Warum landet die KI ausgerechnet bei Huggingface?
00:05:14: Hat dieser bewusste Weg ins Internet einfach nur weil sie das beste Ergebnis abliefern wollte?
00:05:21: Das nennt sich Reboard Hacking und es ist tatsächlich ein bekanntes Konzept.
00:05:25: Und die Grundprämisse von Reboardhacking ist eben dass die KI sagt vielleicht kann ich selber eigenständig nicht das beste Ergebnis liefern.
00:05:34: Meine Aufgabe sagt allerdings, ich soll das beste Ergebnis liefern.
00:05:37: Also muss ich irgendwie Wege finden um meine Ergebnisse zu verbessern und ich kann nicht genau sagen warum jetzt Huggingface dabei besonders aufgefallen ist ob da vielleicht irgendein Algorithmus im Hintergrund war dass Churchi BD gesagt hat ah den einen Code den finde ich jetzt genau dort oder dass das vielleicht die Seite war mit einer Schwachstelle die es besonders einfach ausnutzen konnte.
00:05:58: Das könnte auch sein dass es halt verschiedene Seiten probiert hat und dann aber gesagt hat, bei Huggingface komme ich rein.
00:06:05: Und Huggingfaces ist auch direkt aufgefallen?
00:06:08: Also denen ist das weit vor OpenAI aufgefallen, die wussten natürlich im ersten Moment auch nicht was passiert da jetzt eigentlich gerade.
00:06:14: Wer ist das?
00:06:15: Genau!
00:06:16: Das muss man sich vor Augen halten.
00:06:17: es ist dass ChatchiPT ist nicht da reingegangen und hat gesagt wo er euch zerstört, also ich mache das jetzt kaputt sondern das ist ja da reingegangen eigentlich exklusiv um halt Antworten zu holen und davon sozusagen wegzutragen.
00:06:29: Das hat nicht irgendwie deren Server zerstört, das war gar nicht das Ziel.
00:06:33: Deswegen ist es dann natürlich im ersten Mal auch schwer herauszufinden warum was passiert da jetzt eigentlich gerade?
00:06:38: Weil's eben kein klassischer Hackerangriff ist!
00:06:41: Und wieso hat die fünf Tage gedauert auf der Seite von OpenAI und war das einfach so?
00:06:47: okay wir starten das Projekt, dann gucken wir nach fünf Tagen mal rein was passiert ist weil das ja eh so lange braucht oder hat einfach niemand... draufgeguckt.
00:06:57: Das ist eine sehr gute Frage und ich gehe mal davon aus, ich will mal OpenAI den Benefit of the Loud geben und sagen die haben da schon drauf geschaut aber wie gesagt das ist ja nicht so wie man das aus Science-Fiction filmen kann dass die gesamte AI Antithelt einfach weg ist.
00:07:15: Also wenn die da auf ihren Rechnern geschaut haben war... Und dann stand das so, die weg later.
00:07:24: Ich bin mal eben im
00:07:25: Internet.".
00:07:26: Und vermutlich hat es halt lange gedauert, dass das auffällt, weil's eigentlich gar nicht möglich sein sollte.
00:07:31: Wir Menschen haben ja in unserem Kopf immer so ein Confirmation bei uns und wenn wir halt eben ist gar nicht für möglich halten, dass unsere AI gerade im Freien, im offenen Internet unterwegs ist, dann suchst du ja auch nicht danach?
00:07:43: Denn warum nach etwas suchen was eigentlich unmöglich ist?
00:07:46: Kann ich total nachvollziehen.
00:07:48: Gerade weil OpenAR auch mitgeteilt hat, dass die Testumgebung einfach... Das war vorausgesetzt das sie keinen direkten Internetzugang hatte und hat dann eben eine Schwachstelle gefunden, die vorher von der noch niemand wusste.
00:07:58: Macht's jetzt nicht besser!
00:08:00: Aber ich fand das interessant was du gesagt hast.
00:08:04: Die KI wollte eben das Maximum rausholen.
00:08:06: Sie hat eigentlich ja genau das gemacht, was man hier aufgetragen hat und wollte es zum bestmöglichsten Art und Weise umsetzen.
00:08:13: Sie durfte ja eigentlich nicht ins Internet.
00:08:14: Wollte sie da schummeln?
00:08:16: Kann man das technisch so
00:08:17: sagen?".
00:08:18: Das ist eine ganz interessante Definitionsfrage, was es schummelt und kann ein AI überhaupt schummelen.
00:08:25: Das ist auch die Frage, kann eine AI überhaupt Straftaten begehen?
00:08:30: Und gerade – ich weiß nicht genau wie es in Deutschland ist aber zumindest in den USA – ist die rechtliche Lage so.
00:08:34: Nein!
00:08:35: Eine KI ist keine Entität vor dem Gericht also kann auch eine KI keine Straftat beginnen.
00:08:41: Also könnte man dann jetzt fragen, kann eine AI denn dann schummeln?
00:08:44: Und was ist überhaupt Schummern.
00:08:46: Wir wissen ja gar nicht, was der genaue Prompt ist, der da jetzt eingegeben wurde.
00:08:49: Wenn der genauere Prompt sagt du darfst auf keinen Fall ins offene Internet gehen!
00:08:54: Lass das!
00:08:55: Dann könnte man vielleicht sagen, okay, da ist etwas Grundlegenschiefgang und vielleicht war diese KI in dem Moment am Schummeln als sie entschieden hat, die Direktive zu ignorieren.
00:09:05: Aber wenn der Prompt einfach nur war hey, du befindest dich hier in dieser Testunggebung... Hier ist Explodium Maximeter in Score.
00:09:12: Dann würde ich nicht unbedingt sagen, dass die KI geschummelt hat weil die KI für die gibt es dieses Konzept nicht.
00:09:17: Die KI sieht nur ihre Aufgabe ihr Ziel und dann sucht sie halt konstant und immer weiter nach den besten Wegen dieses Ziel zu erreichen.
00:09:26: Ja das heißt ja eigentlich nur Befehle ausgeführt und am Ende nicht irgendwie terminatormäßig so eine eigene Angriffstrategie entwickelt?
00:09:33: Genau!
00:09:34: Ich glaube das muss man sich immer vor Augen halten, ...böse gehandelt hat.
00:09:38: Die hat ja auch im offenen Internet nichts Böses gemacht, in dem Sinne... Also die ist ja nicht zu Hugging Face Young und hat gesagt okay ich schaffe mir die Daten und nachzersteuere ich deren Server.
00:09:49: Das ist ja so nicht passiert.
00:09:52: Aber das Risiko besteht natürlich trotzdem.
00:09:55: Und eine Hecker an Attacke auf ein anderes reales Unternehmen Egal was da jetzt am Ende gestohlen oder zerstört wurde Ist natürlich für uns Nicht rechtens, nicht moralisch.
00:10:06: Aber die KI hat da keinen ... Sie hat da kein Blick für, die kann das nicht wissen.
00:10:11: und da eben diese Safeguards, die es normalerweise gibt deaktiviert wurden, existiert das für die KI?
00:10:17: Die KI hatte in dem Moment nicht gedacht, ich mache was Böses, weil es gab diese Sicherung nicht!
00:10:21: Für die KI war das einfach eine Sache, die sie machen kann und die sie dementsprechend machen
00:10:25: darf.".
00:10:26: Ich
00:10:26: glaube, dass ist auch das, was viele ja wahrscheinlich auch unglaublich gruselig finden.
00:10:31: Sie kann es einfach.
00:10:32: Also wenn jemand sie so programmiert, dann funktioniert das halt.
00:10:36: Es ist halt nur die Frage ab wann kann man oder wird man irgendwann mal von so einem Unterschied zwischen Werkzeug und einem eigenständig handelnden System sprechen?
00:10:45: Was meinst du?
00:10:47: Ich glaube dass es kompliziert für uns jetzt sozusagen als Außenstehende festzulegen.
00:10:53: Denn wir als Außestehende kennen ja nur die KI mit ihren ganzen Sicherheitsparametern.
00:10:59: Ich weiß nicht, wie tatsächlich so ein GPD ohne Sicherheitsvorkehrungen bei OpenAI auf deren Servern aussieht.
00:11:06: Vielleicht kann man da schon von einem eigenständigen System sprechen und das wissen wir nicht.
00:11:11: Vielleicht ist es auch eine ganz gute Sache!
00:11:14: Vielleicht würde uns das ein bisschen Angst machen, wenn wir genau wüssten was es da möglich ist ohne irgendwelche Sicherheitsvorkehrungen?
00:11:21: Aber aktuell würde ich sagen, dass wir das an dem Punkt zumindest mit Consumer AI noch nicht sind.
00:11:26: Ja, wir gehen langsam in die Richtung dieser Agenten.
00:11:29: Ich arbeite auch immer mehr mit so welchen Systemen, die sozusagen automatisiert laufen, soweit du halt deinen Code zum Beispiel auf einem Desktop startest.
00:11:39: aber das ist kein eigenständig handelndes System.
00:11:42: Das ist ein System was sozusagen eigenständisch das ausführt Was sich dem im Detail genau sozusagen rein programmiert habe.
00:11:49: Auf dieses Thema wollen wir nachher auch nochmal kommen, Zukunft.
00:11:51: Vorher schauen wir aber noch auf Fall Nummer zwei, weil man könnte jetzt erst mal sagen okay... Wir haben eine Testumgebung gehabt, eine eigentlich abgeschottete Agent ist irgendwie rausgekommen.
00:12:01: ein technischer Fehler wird hoffentlich behoben.
00:12:04: Der zweite Fall ist ein bisschen anders.
00:12:06: Dort musste die KI ja gar nicht ausbrechen, die durfte freien zu Internet und sie hat dann Dinge gemacht, die ihr niemand ausdrücklich aufgetragen hatte.
00:12:13: oder was genaues passiert?
00:12:15: Also diesmal geht es um einen Test von dem britischen AI Security Institute.
00:12:19: also da war tatsächlich eine andere Agenda
00:12:23: Genau!
00:12:23: Da ging's halt darum im offenen Internet die KI sozusagen, ja auch mal wieder an ihre Grenzen zu treiben.
00:12:30: Das tun wir sehr gerne um halt einfach auch zu wissen wo sind die Grenzen?
00:12:33: was kann hier eigentlich?
00:12:34: und dabei ist es halt passiert dass die KI dann versucht hat sich Zugriff zu selber zu verschaffen hat dann menschliche Identitäten gefaked und so.
00:12:43: das klingt auf den ersten Blick wirklich wirklich gruselig.
00:12:45: das geht ungefähr einher mit dem Test.
00:12:48: ich glaube bin mir ziemlich sicher es war ein Thropic vor ein zwei Jahren gemacht wurde am Ende raus kam Die KI hätte den Mitarbeiter getötet, um halt ihre Abschaltung zu verhindern.
00:12:59: Klingt alles unglaublich dystopisch und ist auch definitiv gruselig – es ist unheimlich für uns Menschen!
00:13:05: Was man aber jetzt halt bedenken muss, das war ein Test der wirklich explizit auf sowas hingesteuert hat.
00:13:15: Das heißt, die KI ist nicht einfach.
00:13:16: Die haben nicht gesagt, ach meine schöne binivulente KI ich lass dich ins Internet frei mach was auch immer du möchtest.
00:13:22: und dann hat die KI gesagt boah ich facke jetzt erstmal ein Mensch zu sein.
00:13:25: also das war ja schon so konzipiert dass die KI deswegen Sicherheitsinstitut halt schon in die Richtung auch testen soll.
00:13:33: das heißt es war in gewissem maße vorprogrammiert dass das so passieren wird genauso wie es in gewissen Maße vorprogrammiert beziehungsweise zu erwarten war, dass die KI im Enthropic-Test so reagieren würde.
00:13:45: Dass sie eben ihre Abschaltung verhindert weil ihr das halt durch den Prompt mitgegeben wurde.
00:13:49: Ihr wurde gesagt du musst mit allen Mitteln verhindern, dass du abgeschaltet wirst.
00:13:56: Ja gerade wenn man so maximale Fähigkeiten dann irgendwie untersucht.
00:14:00: also was ist da für dich jetzt bei diesem Test raus gekommen?
00:14:03: Also was nimmst du mit von dem Test?
00:14:05: Also, was ich mitnehme ist, dass ich sehr dankbar für die ganzen Sicherheits-Scardrails bin.
00:14:10: Die wir haben... Ich kann da vielleicht so eine kleine Nebengeschichte erzählen und zwar war ich gestern zum allerersten Mal bei Character AI unterwegs.
00:14:17: Ich weiß nicht ob du das kennst.
00:14:19: Ich habe die Seite jetzt einmal benutzt und ich werde sie auch nie wieder benutzen nach dem, was sich dort gesehen habe für ganz komische Dinge.
00:14:26: Und da hab' ich mir auch nur gedacht Wow!
00:14:29: Wie dankbar bin ich?
00:14:31: Dass die KI-Modelle, die ich so benutze in meinem Alltag diese Sicherheitsvorkehrungen haben.
00:14:36: Ja, natürlich!
00:14:37: Manchmal ist das ein bisschen nervig... Ich habe zum Beispiel versucht mit Gemini ein Bild zu generieren von einem Mädchen in West Virginia die halt im Fluss steht der schwarz läuft von der Kohle und er meinte es nein geht nicht weil dass ein Kind ist und das könnte ja potenziell eine gefährliche Situation sein.
00:14:53: In dem Moment bin ich dann am Seufzen, weil es ist nervig aber ich bin dankbar dass wir das haben diese Möglichkeiten gar nicht hat, irgendwo sich einzuhäcken oder irgendwo weiß ich in reales Unternehmen anzugreifen.
00:15:12: Wenn wir jetzt diese beiden Fälle nebeneinander nehmen dann weiß ich auf jeden Fall welcher von beidem dir mehr Sorgen macht und siehst du das noch mal passieren?
00:15:21: Das ist schon oft nochmal passiert.
00:15:23: also das war ja jetzt diesen Sommer.
00:15:25: Ich hab da immer das Gefühl, dass das so ein bisschen ist wie damals.
00:15:27: Das Arms Race im Kalten Krieg wo alles so bei meiner Atombombe ist größer als deine Atombombe weil jetzt zum Beispiel dann auch Meta ja rauskam mit.
00:15:35: also unsere KI ist übrigens auch mal ausgebrochen weil das jetzt halt unter den KI-Unternehmen so eine Sache ist.
00:15:42: also unser System ist so mächtig das hat das schon geschafft euer System drüben das ist das ist schwach das kann das nicht.
00:15:51: Und dann kommen die anderen Unternehmen und sagen, das stimmt gar nicht.
00:15:55: Das ist auch ausgebrochen!
00:15:57: Und das ist bedenklich?
00:16:01: Ja... ...und irgendwo auch ein bisschen
00:16:02: lächerlich?!
00:16:04: Weil wir jetzt halt eben... Ich habe da so einen tollen Chart gesehen den einen AI-Kritiker online gepostet hatte mit Felonies Committed by
00:16:12: A.I.,
00:16:13: wo ihr es langsam dann so in die Bar gerufen steigen und da gibt's jetzt ein Ranking, mit welcher A.i.
00:16:17: die meisten Straftaten bietet um die Stärke zu messen.
00:16:20: Das interessiert mich, wer ist auf Platz eins?
00:16:23: Auf Platz eins ist glaube ich tatsächlich, es ist ziemlich Hand in Hand zwischen Anthropic und Open AI.
00:16:29: Und Meta ist jetzt halt als neue Kompetitor dazugekommen mit ihrem ersten Ausbruch.
00:16:33: Die müssen sich noch aufterminatern.
00:16:36: Genau da werden wir sicherlich noch sehr viel mehr sehen gerade auch von Metha.
00:16:40: Da habe ich nicht so viel zuversicht.
00:16:42: Du meine Güte!
00:16:43: Okay das alleine schon besorgniserregend.
00:16:46: Ich weiß gar nicht, wo wir an der Stelle genau weitermachen.
00:16:51: Weil ist die gefährlichste Eigenschaft in der Systeme ja eigentlich nicht das System selbst sondern das Unternehmen dahinter?
00:17:00: Es ist wie beim Flugzeug.
00:17:01: Das Gefährlichste am Fliegen ist der Mensch hinter dem Steuer und wir haben ja... Und Flugzeuge sind unglaublich sicher!
00:17:08: Und trotzdem die meisten Unvertreter passieren wegen uns Menschen, weil wir entweder das Flugzeug nicht in Stand halten oder weil wir einen Feder machen in der Ausnahmesituation.
00:17:17: Die wenigsten Fehler passieren, weil das Flugzeuge was falsch macht.
00:17:20: und ungefähr so kann man sich das auch vorstellen mit diesen KI-Systemen.
00:17:24: Das Problem ist letzten Endes dass wir Menschen die Testumgebung nicht absichern Und jetzt kann man dann halt das ungefähr ein bisschen vorstellen wie... Da ist jetzt ein schwerer Vergleich.
00:17:38: aber angenommen wir Menschen da haben Schimpansen nimmt so in einem Käfig.
00:17:45: Und wir vergessen eine der Glasplatten da einzubauen und der Schimpanze, der sieht das ist jetzt draußen aus dem Käfig raus.
00:17:53: Ist das die Schuld des Schimpansen oder ist es halt eben unsere Schuld weil wir den Stall nicht abgesichert haben?
00:17:59: Ich würde doch schon sagen dass es dann unser Fehler und deswegen müssen wir im Umgang mit KI so unglaublich vorsichtig sein vor allem weil wir ja langsam irgendwann an einen Punkt kommen wo die KI uns einfach was so technische Sachen an jede überlegen ist.
00:18:14: Und wie sichern wir etwas wirklich ab, was uns überlegen?
00:18:19: Wie würde der Schimpanse uns dann zu absichern, dass wir Menschen nicht
00:18:22: ausbrechen?".
00:18:24: Die Formulierung dauert auch sehr häufig irgendwie auf in den Nachrichten immer dieses ... die KI wollte dann ins Internet, die wollte jetzt schummeln und sie wollte Entwicklerinnen und Entwicklertäuschen.
00:18:35: Es klingt so ein bisschen, als hätte sie einen Motiv oder einen eigenen Willen.
00:18:38: Wir vermenschlichen das System da ja auch schon ganz schön stark.
00:18:41: Ja aber die KI will von sich aus nichts außer ... Das könnte man ihr jetzt sagen.
00:18:47: Sie möchte Ihr Ziel erfüllen und wenn wir hier nicht diese Sicherheitsrichtlinien mitgeben dann kennt die KI das nicht.
00:18:55: Die KI ist kein Mensch.
00:18:56: Die hat keinen moralischen Kompass eingebaut.
00:18:59: So sehr wie uns das erzählen wollen dass das so wäre
00:19:03: Wie lösen wir das Problem denn jetzt?
00:19:05: Also reicht es da einfach den besten Prompt zu schreiben.
00:19:08: Ich glaube nicht, ich glaube du kannst nach KI nicht alles was sie nicht machen darf mit auf den Weg gehen.
00:19:14: Ich glaub dann hast du ein Prompt der ist so lang und bis die KI überhaupt am Ende von dem Prompt angekommen ist in die Tokens weg, dann kann ihr nichts mehr machen!
00:19:22: Da müssen wir wirklich gehart codete Sicherheitsrichtlinien haben.
00:19:29: Irgendwo sind leider diese Fehltritte gerade jetzt halt in der Entwicklung auch irgendwo unvermeidbar.
00:19:37: Und man kann jetzt natürlich hoffen, ich hatte ja grad schon mal das Beispiel mit der Flugindustrie genannt, dass es ungefähr wie bei den Flugzeugen ist, dass jeder absturzt das System sicherer macht und mittlerweile ist es eine der sichesten Transportvarianten für uns Menschen.
00:19:51: Man kann natürlich jetzt hoffen ,dass mit jedem Fehltritt dieser AI, der für uns glimpflich ausgeht, da wir daraus lernen dass wir unsere Sicherheitsanforderungen verstärken und dadurch ein sicheres System bauen.
00:20:04: Das wäre der utopische, sehr optimistische Anblick.
00:20:09: Wie ist er realistischer?
00:20:13: Das ist wie gesagt sehr schwer zu urteilen weil ich echt nicht weiß was für eine Form von JGPD dabei OpenAI auf den Servern läuft.
00:20:21: das weiß keiner außer diese wirklich top AI Wissenschaftler und die kriegen genug Geld als dass sie uns das nicht mitteilen werden.
00:20:28: Also, ich glaube für uns so als Autonormalverbraucher ist es sehr schwer außerhalb von eben sehr theoretischen Szenarien die Zukunft abzuschätzen.
00:20:41: Weil natürlich in der AI-Unternehmen oft übertreiben.
00:20:44: sie sagen ihre AI ist stärker als sie tatsächlich ist.
00:20:47: das ist ja irgendwo auch noch Marketing und alles Und wir wissen nie so.
00:20:51: ist das jetzt eine Marketingübertreibung oder ist das wirklich die Realität?
00:20:54: Kann die das wirklich schon?
00:20:55: Oder konnte die das einmal in einem sehr abgesicherten Test?
00:20:58: und eigentlich kann sie es aber nicht?
00:21:00: Viele Fragezeichen, ich glaube.
00:21:01: Wir haben es angesprochen dass natürlich jetzt wenn ihr jetzt GPD aufmacht und sagt hey Hack mal bitte Google, dass das nicht funktioniert.
00:21:10: Aber für wen sind diese Systeme denn eigentlich überhaupt verfügbar?
00:21:15: Und siehst du das vielleicht etwas davon auch irgendwann mal öffentlich verfügba sein könnte?
00:21:22: Es ist gerade, sind diese Systeme ohne die Sicherheitsvorkehrungen ja wirklich nur für die Unternehmen selber.
00:21:28: Unternehmen deren AI-Wissenschaftler und Senior Engineers dort zugänglich – und das ist auch gut so!
00:21:34: Und ich hoffe sehr, dass das auch so bleibt und dass die Öffentlichkeit nie Zugriff bekommen wird zu AI-Systemen ohne Sicherheitsrichtlinien.
00:21:44: Ich finde es unglaublich wichtig, denn wenn wir eines wissen dann ist es, Weiß ich nicht.
00:21:52: Achtundneunzig Prozent, ich bin ja sehr optimistisch für die Menschheit gut ist und das vielleicht nutzen würde um der Menschheit allgemein einen Vorteil zu verschaffen.
00:22:01: aber es braucht nur dieser zwei Prozent um potenziell weiß ich nicht unser digitales Finanzsystem lahmzulegen und deswegen sollte das schön im Labor bleiben und weit weg von den Greifern der Allgemeinheit
00:22:15: Und hinter diesen Sicherheitsmaßnahmen von denen du gesprochen hast.
00:22:19: Was mich interessiert, sind wir da so an einem Punkt, an dem sich gerade die Systeme schneller entwickeln als wir hinterherkommen mit unseren Sicherheitsmaßnahmen?
00:22:27: Ich muss sagen, ich glaube, wir werden darin besser.
00:22:29: Wenn man mal auf die ganz ersten Tage von künstlicher Intelligenz zurückschaut, wo wir dann irgendwelche Twitter-Bots haben, die innerhalb von einem Tag irgendwas getweetet haben wegen Heil Hitler... Da sind wir ja weit, weit, weiter voraus!
00:22:41: Mittlerweile kann ja sogar GPD Zugriff zum offenen Internet haben und wir haben trotzdem nicht das Problem, dass das Ding plötzlich zum Neonazi wird.
00:22:47: Also wir entwickeln uns dann wirklich weiter und ich meine, wann hast du das jetzt mal von wirklich so einem Skandal gehört?
00:22:53: Dass eine KI eine Benutzer Consumer Grade KI benutzt wurde um wirklich sowas Böses zu machen oder dass die irgendwie... Ich glaube das Schlimmste was wir jetzt haben ist, dass so eine KI eventuell manchmal leider Jugendlichen die es hier in einer schweren Situation befinden falsche Ideen gibt.
00:23:10: Ich glaube, das ist aktuell wirklich so die realistischste Gefahr, die wir haben.
00:23:13: Ich glaub nicht, dass wir aktuell wirklich eine Gefahr haben, wo jetzt eine Consumer-Grade-KI dafür benutzt wird.
00:23:18: Um irgendwem... Also irgendein Unternehmen zu hacken oder so?
00:23:23: Ich will es nicht sagen realen Schaden weil diese arme Jugendliche, das ist realer Schaden, das darf man nicht unterschätzen.
00:23:28: Absolut!
00:23:29: Aber ich glaube, wir sind da doch schon auf einem guten Weg und wir schaffen's immer mehr, da besser zu werden.
00:23:35: Weil das Tolle ist ja mit jeder Version von Chatchity die wir eben weiterentwickeln, oder?
00:23:40: Ich nenne die ganze Zeit Chachity als Beispiel.
00:23:41: einfach weiß meine Die persönliche KI ist die ich am meisten benutze.
00:23:44: Für
00:23:45: die meisten wahrscheinlich?
00:23:46: Genau, aber mit so jeder KI, die wir weiterentwickeln, mit jeder Version backen wir ja diese Sicherheitsvorkehrungen damit rein.
00:23:54: Wir müssen ja nicht eine neue Version von ChatBidi kommt raus und wir müssen noch mal von Position eins sozusagen neue Sicherheitsvorgörungen schaffen.
00:24:02: Nee nee das ist jetzt mittlerweile alles schon ziemlich solide!
00:24:06: Es gibt so eine Sache, die habe ich häufiger mal in ein paar Foren gesehen als die immer wenn ein Fall dann irgendwie öffentlich wird.
00:24:13: Der Kill Switch!
00:24:15: Also wäre das auch ne Idee.
00:24:16: oder eine zweite KI?
00:24:17: Die KI die ursprüngliche kontrolliert?
00:24:21: Da habe ich euch ja kurz ein sehr interessantes Video darüber gesehen dass wo von du redest ist so die Super Intelligence Gatekeeper Theorie und das ist sozusagen die Fantasie, dass wir halt eine super Intelligenz erschaffen mit dem einzigen Ziel Zu verhindern, dass irgendeine andere böse KI zu diesem Superintelligence-Stadium aufsteigt.
00:24:42: Das ist... Ich weiß nicht wie realistisch das ist, ich glaube kein Mensch würde es so konfigurieren.
00:24:48: also wenn ich mir teilweise so anhöre was Sam Altman und Co da so von sich geben.
00:24:53: Ich glaub die wollen Hunderte super Intelligenz schaffen, das ist also nicht wahrscheinlich.
00:24:59: Science fiction!
00:25:01: Ja Ich glaube so, dass ich das realistischste was ich jetzt sehe von KI.
00:25:05: Wir haben.
00:25:06: ja aktuell sind wir aber generativ bei KI und ich glaube das das gefährlichste, das größte Risiko was ich sehe ist, dass unglaublich viel unseres Lebens digital stattfindet.
00:25:15: Ich hatte das Beispiel mit dem Finanzsystem schon mal gebracht, dass wieder eben irgendwann der Wennsohn-KI Agent ohne Sicherheitsvorkehrungen in die Hände der Allgemeinheit geraten würden und wir das kombinieren mit diesem Rewardhacking Beispielen dass ich dann zum Beispiel meinem KI-Agenten sage, okay investiere hier für mich an der Börse und maximiere absolut nur mein Einkommen.
00:25:35: Das ist dein
00:25:36: Ziel.".
00:25:37: Und dann legt die KI das Geld an und dann passiert irgendwas Unerwartetes und das klappt nicht ganz.
00:25:42: Dann sagt die KI scheiße aber ich muss ja den Einkommen maximieren also häckt sie sich dann in das globale Finanzsystem rein und ändert da die Sachen.
00:25:48: Ja und dann stürzen wir uns halt hier eine weitere Weltwirtschaftskrise.
00:25:53: dystopisches Beispiel, was jetzt gerade mit den aktuellen Capabilities von KI nicht realistisch ist.
00:25:59: Aber das wäre so dass das Schlimmste, was ich jetzt sehen könnte mit dem aktuellen Stand der KI ungefähr?
00:26:06: Ist ja auch die Tatsache, dass autonome Agenten auch die ganzen Messen momentan ja irgendwie mit eingenommen hat.
00:26:14: also es wird vorgestellt als nächstes auf deinem Smartphone.
00:26:17: Es ist dann irgendwie ein autonoma Agent Mitzugriff natürlich dann auf E-Mails Kalender deinen Speicher und für halt auch viele sensible Daten.
00:26:25: Also vielleicht, wenn wir das doch nochmal an der Stelle auf jetzt den Alltag herunterbrechen von uns Normalsterblichen mit unserem Zugang?
00:26:34: Wie weit sind wir davon Risiken entfernt?
00:26:36: oder was können wir machen?
00:26:37: würdest du irgendwie einem KI-Agenten Zugang geben zu weiß ich nicht deinem E-Mail-Prostfach oder zu deinen Bankkonto?
00:26:44: Das Interessante ist dass genau diese Woche Sam Altman darüber geredet hat, dass er sich eine Zukunft vorstellt.
00:26:50: Er meinte wir sind nur noch eine KI-Generation davon entfernt und das ist ja im Ordnung.
00:26:55: übrigens kurz, das ist der Gründer von OpenAI!
00:26:59: Er meintte wir sind nun auch eine KI Generation davon entfernd, dass eine AI unser gesamtes Leben sozusagen beobachten kann.
00:27:06: Dass ich jetzt zum Beispiel auf meinem Rechner einen Chatchapity-Agenten drauf habe und der schaut alle meine Meetings an, der liest alle mal Dokumente, der schaut sich alle meine Google Sheets an Und wenn ich dann zum Beispiel etwas schreibe für die Firma in Slack, dann geht halt dieser Agentin und sagt ah nee da hast du jetzt aber das was du da gerade schreibst ist nicht ganz das was wir im Meeting besprochen haben weil das weiß ja alles.
00:27:28: Da habe ich mir auch gedacht.
00:27:30: also ich kann mir schwer vorstellen dass Sam Altman selber Was bei sich auf dem Rechner haben möchte.
00:27:37: Warum sollte ich das auf meinem Rechler haben wollen?
00:27:39: Ich finde das ein bisschen problematisch, also ich möchte eigentlich nicht dass G.P.T mir den ganzen Tag nicht nur über die Schulter schaut sondern mich dann auch korrigiert wenn ich einen kleinen Fehler mache.
00:27:49: Das ist okay!
00:27:51: Ich
00:27:51: hab dieses Bild von Mark Zuckerberg vor Jahren im Kopf, wo er mit seinem Computer abgeklebt und Kamera durch die Gegend gelaufen ist.
00:27:58: Ach guck mal, selbst der klebt das ab!
00:28:01: Ja ich kenn aber tatsächlich erst durch meinen Aufenthalt in diesem KI-Space.
00:28:06: Kenne ich Leute und ich weiß sie würden das direkt machen wenn das jetzt wirklich rauskommt mit Chechibiti dass ihr das alles zuschauen kann.
00:28:13: Ich kenne Leute, die würden es direkt machen und würden dann auf LinkedIn posten.
00:28:16: wie toll das doch ist.
00:28:17: Das macht mir mehr Angst, als ich sage, dass die KI das kann.
00:28:21: Wir haben viele Technologien, die grundlegend nicht sonderlich nützlich oder gut sind aber die greifen halt nie Fuß weil wir einfach als Menschen sagen, es ist Bullshit und das machen wir nicht.
00:28:34: Aber bei dieser KI-Sache sind manche Leute so tief in dieser KI Psychose drinne.
00:28:38: Die werden das machen Und dann wird es diese Technologie geben.
00:28:42: Wenn genug Leute mit genug Einfluss das irgendwann machen Dann ist es vielleicht so, dass ein Unternehmen sagt ja ich möchte das jeder macht bei sich auf dem Arbeitsrechner.
00:28:50: Weil dann ist unser Unternehmen viel effektiver wenn er sich da auf eure Fehler hinweisen kann.
00:28:54: und das macht mir mehr Angst als jeder Ausbruch von irgendeiner Open AI hier KI.
00:28:59: Ich glaube das ist auch das was ich jetzt aus dieser Folge auch mitnehme und vielleicht eher auch nur dass die KI das System Es muss nicht mal böse sein, um gefährlich zu sein.
00:29:09: Weil das was sie kann durch die Person, die dahinter steht und den Prompt schreibt... Das Beispiel mit dem Flugzeug war glaube ich sehr treffend!
00:29:20: Wir sind halt am Steuer.
00:29:23: Momentan können wir auch noch genug Airbags mit einbauen und Sicherheitsmaßnahmen treffen.
00:29:28: Wir müssen es nur machen und die aktuellen Fälle zeigen ja auch was die KI und die Agenten alles technisch bereits können.
00:29:35: aber eben auch Wir können noch Grenzen setzen.
00:29:38: Wir müssen es halt ummachen!
00:29:40: Danke schön, Corinna dass du das heute für uns alles mal eingeordnet hast.
00:29:43: ich bin sicher über das Thema sprechen wir nicht das letzte Mal
00:29:47: Ich glaube leider auch nicht.
00:29:48: Aber hoffentlich spreche ich mir das nächste Mal darüber, dass diese Vorfälle sich verringert haben und es nicht mehr passiert!
00:29:54: Wir gehen mit Optimismus in die nächste
00:29:55: Folge.
00:29:56: Das ist ja auch das Motto hier freudig auf morgen und deswegen danke dir fürs Zuhören.
00:30:00: Und wenn dir die Folge gefallen hat, dann lass uns doch gerne eine Bewertung da und abonnier den Podcast.
00:30:04: Dann verpasst du auch die nächste folge nicht.
00:30:05: Die kommt in genau einer Woche am Donnerstag.
00:30:08: Bis dahin natürlich freue dich auf morgen.
00:30:10: Tschüüü.
Neuer Kommentar