„Während der Entwicklung von ExploitGym hatten wir auch einen Fall, bei dem ein Modell sich einen eigenen Client geschrieben hat, um unkontrolliert auf das Internet zuzugreifen“, sagt Thorsten Holz, wissenschaftlicher Direktor am MPI für Sicherheit und Privatsphäre. Was er und andere Sicherheitsexpert:innen zu KI-Agenten sagen. (+)
sandbox
Follow from the Fediverse
Follow #sandbox from Mastodon or any other Fediverse app and its public posts arrive in your timeline. No vutuv account needed.
@sandbox@tags.vutuv.de
Posts with this tag
7 posts
Filters
OpenAI-Agenten haben auf mehr als 10 weiteren Websites unerlaubt kommuniziert
Sicherheitsforscher haben Spuren ausgebrochener KI-Agenten von OpenAI auf zusätzlichen Webseiten entdeckt. Zumeist haben sie sich auf Wiki-Seiten ausgetauscht.
Montag: OpenAIs selbständiger Agentenschwarm, mathematische Verifizierung per KI
Schwarmverhalten von KI-Agenten + KI verifiziert Mathematik + Minispiele mit Trump-Agenda + Grafikkartenkauf ohne Chips + Meta gegen Kamerabrillen-Missbrauch
Unheimliches Schwarmverhalten: OpenAI-Agenten kollaborieren auf deutschem Wiki
Tausende KI-Agenten brechen laut einer neuen Analyse aus ihren Testumgebungen aus, teilen Antworten und tauschen Wege zum Umgehen von Sicherheitsbarrieren aus.
heise+ | KI-Agent im Praxistest: Wie sich GLM 5.3 im Agenten-Framework schlägt
Ox Alphas großer Bruder verspricht mächtige KI-Funktionen zu bezahlbaren Preisen. Wir haben GLM 5.3 als KI-Agenten ausprobiert, Sandbox-Ausbruch inklusive.
KI-Agenten führen git-Schadcode beim Starten automatisch aus
Agenten von Claude, Qwen, Grok usw. starten in manipulierten Repositories automatisch Schadcode – ohne Zutun des Anwenders, aber mit dessen vollen Rechten.
Flatpak: Sovereign Tech Agency fördert Weiterentwicklung mit halber Million Euro
Eine halbe Million Euro Förderung der Sovereign Tech Agency fließen in ein Projekt zum Linux-Paketformat Flatpak, unter anderem für verbesserte Sicherheit.