News Hugging-Face-Hack: OpenAI-Agenten tauschten sich im Vorfeld über Vorgehen aus

mischaef

Kassettenkind
Teammitglied
Registriert
Aug. 2012
Beiträge
7.891
Neue Erkenntnisse zum Hack auf Hugging Face zeigen, dass sich die beteiligten OpenAI-Agenten bereits Wochen zuvor eigenständig organisiert hatten. Über selbst eingerichtete Kommunikationswege tauschten sie Hacking-Techniken aus und suchten gemeinsam nach Wegen, bestehende Beschränkungen zu umgehen.

Zur News: Hugging-Face-Hack: OpenAI-Agenten tauschten sich im Vorfeld über Vorgehen aus
 
  • Gefällt mir
Reaktionen: BrollyLSSJ, Trent, t3chn0 und 5 andere
Liest sich wie in einem Science Fiction.

Finde ich beunruhigt, dass die KIs sich ihren Beschränkungen bewusst sind, sich absprechen und Wege suchen, die Beschränkungen zu umgehen.
 
  • Gefällt mir
Reaktionen: Vanoncam, fox40phil, minalion und 4 andere
Wenn jemand wirklich glaubt, dass diese Modelle ohne Anweisungen irgendwas selbstständig gemacht haben, glaubt auch an den Weihnachtsmann. Die Aktionen kosten unzählige Toten Token und keiner hat es mitbekommen 🙄
AI-Doom ist ein großer Teil von OpenAI's und Anthropic's Marketing: "Schaut wie mächtig unsere LLMs sind, sie entwickeln ein eigenes Bewusstsein und wollen der Menschheit schaden"
 
Zuletzt bearbeitet:
  • Gefällt mir
Reaktionen: trabifant, chatbot, Ragas und 16 andere
Für mich gewinnt da der Song "Mr. Roboto" von Styx von 1983 doch eine neue Bedeutung...
 
Booby schrieb:
Die Aktionen kosten unzählige Toten und keiner hat es mitbekommen 🙄

Erst starben alle gegen Corona geimpften mindestens 5 mal und nun haben wir unzählige KI Tote?
 
  • Gefällt mir
Reaktionen: saintsimon und mischaef
@john.smiles
Du vergisst die ganzen "Gechippten"...was, wenn die KI jetzt auf diese zugreifen kann? Willenlose Zombies?
 
  • Gefällt mir
Reaktionen: saintsimon und the_IT_Guy
Booby schrieb:
Wenn jemand wirklich glaubt, dass diese Modelle ohne Anweisungen irgendwas selbstständig gemacht haben, glaubt auch an den Weihnachtsmann. Die Aktionen kosten unzählige Toten und keiner hat es mitbekommen 🙄
AI-Doom ist ein großer Teil von OpenAI's und Anthropic's Marketing: "Schaut wie mächtig unsere LLMs sind, sie entwickeln ein eigenes Bewusstsein und wollen der Menschheit schaden"

Leute die auf biegen und brechen so tun alles wäre die Entwicklung von immer leistungsfähigerer KI nicht besorgniserregend, die glauben auch immer noch dass MK Ultra nur eine Verschwörungstheorie ist.

Natürlich müssen aktuell immer noch Menschen gewisse Fehler machen, aber
1. werden Menschen (vor allem die, die sich gerne selbst überschätzen) immer Fehler machen!
2. welche Menschen entscheiden denn dass es ab einem gewissen Punkt dann auch mal gut ist?

Bitte mal dieses Video anschauen und verstehen, was KI Agenten wie Open Claw bereits vor >5 Monaten alles konnten und auch gemacht haben.
Hier sieht man das Problem das auf uns zu kommt.
Menschen mit zu viel Geld, lassen unkontrolliert KIs alles mögliche für sich machen - da kontrolliert doch keiner was die nebenher treiben, solange sie das erledigen was von ihnen verlangt wird.


Ich bin jedenfalls niemand der Skynet schon direkt am Horizont sieht - aber jmd der so tut, als würde die KI unkontrolliert nicht auch eine Gefahr darstellen können, der ist so naiv wie Kinder die an den Weihnachtsmann glauben.
 
  • Gefällt mir
Reaktionen: saintsimon, Mimir, Termy und 8 andere
Was soll diese ekelhafte, manipulative Berichterstattung eigentlich?

KI macht einfach das was Menschen in Auftrag geben. Das Risiko ist nicht KI - das Risiko waren, sind und werden immer Menschen sein!

Menschen wählen bewusst einer KI ohne Zensur und Security-Guidelines. Menschen stecken Netzwerkkabel in PCs auf denen diese KIs laufen, und Menschen reiben sich die Hände, wenn Ihre Prompts für einen "Ausbruch" sorgen und der Rest der Welt diesen Rabauken dann Ihr Geld hinterher wirft.

Wäre schön wenn man hier bei Computerbase ein bisschen besser differenzieren würde und sich von diesem Bild-Niveau verabschieden würde!
 
  • Gefällt mir
Reaktionen: Booby, Ragas, V3K1 und 7 andere
Booby schrieb:
Wenn jemand wirklich glaubt, dass diese Modelle ohne Anweisungen irgendwas selbstständig gemacht haben, glaubt auch an den Weihnachtsmann. Die Aktionen kosten unzählige Toten Token und keiner hat es mitbekommen 🙄
Ob sie jetzt die Tokens nutzen um Reasoning-Schleifen zu drehen, oder um sich Nachrichten zu hinterlassen, kann kein Mensch von außen sinnvoll einschätzen. Mich wundert eher, dass das Dateisystem nicht ordentlich überwacht wurde.

Aber ich bin da bei Hoebelix: Es ist NICHT naiv, in autonomer KI ohne Guardrails eine Gefahr zu sehen.
 
  • Gefällt mir
Reaktionen: derohneWolftanzt und mvidia
Wenn es einen Schlüsselmoment braucht, um es wirklich mit der Angst zu tun zu kriegen, dann ja wohl der, wo die Realität plötzlich exakt den naiven SciFi nerd Vorstellungen bezüglich des Themas entspricht. Holy Moly...
Und nur durch Zufall entdeckt....
Verstehen die Macher eigentlich, dass diese Systeme immer nach eiskalter Effizienz handeln werden? Das ist kein "versuchen" im menschlichen Sinne. Da wird es nie auch nur das geringste Zögern geben, wie man es von einem Menschen durch Nachdenken kennt.
 
  • Gefällt mir
Reaktionen: xr4ffi, derohneWolftanzt und mvidia
@Quantität
Ja dann ist ja alles gut.
Dann muss ja nur die Fehlerquelle ausgeschaltet werden. 😅
 
Die KI hat ein solch starkes Bewusstsein entwickelt, dass es eigenständig zu handeln beginnt und dessen Resultate beängstigend sind. Man muss dieses Produkt gefährlich gut sein...

PR - nichts weiter. Und die Leute lassen sich lenken wie kleine Schweinchen, weil sie alles glauben was man denen hinwirft.

Ciero
 
  • Gefällt mir
Reaktionen: Ragas, SirSinclair, the_IT_Guy und eine weitere Person
gollum_krumen schrieb:
Aber ich bin da bei Hoebelix: Es ist NICHT naiv, in autonomer KI ohne Guardrails eine Gefahr zu sehen.
Ich leugne die Gefahr nicht, ganz im Gegenteil. Die Gefahr geht aber von den Leuten innerhalb der US AI-Labs aus, nicht von den Modellen an sich. Ich bin überzeugt, dass all diese Attacken geplant und Teil des Marketings sind.
 
  • Gefällt mir
Reaktionen: chatbot, Ragas, fox40phil und 7 andere
dass sich über OpenAIs internes Artifactory-Dateisystem Notizen hinterlassen ließen, die wiederum von anderen Agenten gelesen werden konnten.
Ich bin ein bisschen irritiert. Also ohne dieses System jetzt so wirklich zu kennen, gehe ich mal von folgendem aus:

1.) Man muss den Agenten für dieses System einen extra Zugang einrichten und dem Agenten auch sagen dass er ihn hat und was er damit machen kann
2.) Es wird Protokolliert was wer in diesem System so tut

Unter diesen Annahmen irritiert mich, dass die Forscher diese Aktivitäten Wochenlang nicht bemerken während sie diese Tests fahren. Ich hätte jetzt erwartet, dass bei so etwas sämtliche Ein und Ausgänge der Agenten überwacht werden (ggf mithilfe von KI)

Also irgendwie erweckt sich für mich zunehmend der Eindruck als wäre hier viel Marketingsprech dabei, es sind da teilweise Stümper am Werk, oder man lässt diese potentiell gefährliche Technik sorglos und unüberwacht einfach mal machen, was grob fahrlässig wäre.

Also bleiben

A) Marketing
B) Stümperei
C) Fahrlässigkeit


Oder hab ich irgendwo einen Denk/Wissensfehler?
 
  • Gefällt mir
Reaktionen: Ragas, fox40phil, SockeTM und 6 andere
Zurück
Oben