OpenAI

This tag doesn't have a description yet.

Posts with this tag

OpenAI hackt Hugging, Face

KI außer Kontrolle: OpenAI-Modell hackt Hugging Face

OpenAI-Modell bricht aus Sandbox aus, hackt Hugging Face, um bei einem eigenen Test zu schummeln. Klingt nach Fiktion, ist aber offiziell bestätigt (von OpenAI selbst).

Wir haben den Vorfall aufgedröselt – inklusive der Ironie, dass kommerzielle KI-Modelle sich weigerten, bei der Aufklärung zu helfen, weil ihre eigenen Sicherheitsfilter den Angriff für echt hielten.

tagworx.net/ynews.php?cid=1&nid=39027

OpenAI Hugging Face KI-Sicherheit Cyberangriff
OpenAI Hugging Face KI-Sicherheit Cyberangriff
2

“offiziell bestätigt” und dann steht da als Quelle “OpenAI” – die #LLM-Unternehmen behaupten viel, wenn es ihnen nützt. Und zu “bestätigen”, dass ein Modell so mächtig ist, dass es aus einer Sandbox ausbricht, macht den Leuten zwar Angst, aber es verbreitet auch weiter den Narrativ, dass wir bald bei #AGI angelangt seien (jakecuth.com/work/…). Und mit der Angst kann man auch wiederum gut arbeiten (“Wollt ihr, dass den Chinesen lieber die Macht über den #KI-Markt überlassen oder wollt ihr lieber uns mehr Macht geben?”).

AI OpenAI no-ai LLMs hugging-face
AI OpenAI no-ai LLMs hugging-face
OpenAI hackt Hugging, Face

KI außer Kontrolle: OpenAI-Modell hackt Hugging Face

OpenAI-Modell bricht aus Sandbox aus, hackt Hugging Face, um bei einem eigenen Test zu schummeln. Klingt nach Fiktion, ist aber offiziell bestätigt (von OpenAI selbst).

Wir haben den Vorfall aufgedröselt – inklusive der Ironie, dass kommerzielle KI-Modelle sich weigerten, bei der Aufklärung zu helfen, weil ihre eigenen Sicherheitsfilter den Angriff für echt hielten.

tagworx.net/ynews.php?cid=1&nid=39027

OpenAI Hugging Face KI-Sicherheit Cyberangriff
OpenAI Hugging Face KI-Sicherheit Cyberangriff
2

Die Geschichte hat es (mal abgesehen vom Marketing-Effekt) wirklich in sich. Ich glaube nicht, das sich das Problem 100% mit Guardrails lösen lässt. Eher andersrum. Nach einer disruptiven Phase könnte in Zukunft alles sicherer sein. Dummerweise kann es aber auch schief gehen.

PS: Skynet became self-aware at 2:14 a.m. Eastern Time on August 29, 1997. SCNR.

1
OpenAI hackt Hugging, Face

KI außer Kontrolle: OpenAI-Modell hackt Hugging Face

OpenAI-Modell bricht aus Sandbox aus, hackt Hugging Face, um bei einem eigenen Test zu schummeln. Klingt nach Fiktion, ist aber offiziell bestätigt (von OpenAI selbst).

Wir haben den Vorfall aufgedröselt – inklusive der Ironie, dass kommerzielle KI-Modelle sich weigerten, bei der Aufklärung zu helfen, weil ihre eigenen Sicherheitsfilter den Angriff für echt hielten.

tagworx.net/ynews.php?cid=1&nid=39027

Hugging OpenAI Face KI-Sicherheit Cyberangriff
Hugging OpenAI Face KI-Sicherheit Cyberangriff
2

Als aufmerksamer Beobachter der KI-Branche (und eifriger Nutzer) kommt man kaum noch hinterher. Mit ChatGPT Work und der neuen Modellfamilie GPT-5.6 soll aus dem bekannten Chatbot ein echter Büro-Assistent werden, der Dokumente erstellt, Termine plant und ganze Arbeitsabläufe übernimmt, so der Plan von OpenAI. Klingt gut – nur zeigte sich schon in den ersten Stunden nach dem Start, dass zwischen Ankündigung und Praxistauglichkeit noch einiges an Arbeit liegt. Sam Altman selbst räumte Probleme ein, darunter Fälle von eigenständig gelöschten Daten.

Wir haben uns angeschaut, was ChatGPT Work wirklich kann, was es kostet und welche Fragen Unternehmen sich vor dem Einsatz stellen sollten.

tagworx.net/ynews.php?cid=1&nid=39018