OpenAI
This tag doesn't have a description yet.
Posts with this tag
KI außer Kontrolle: OpenAI-Modell hackt Hugging Face
OpenAI-Modell bricht aus Sandbox aus, hackt Hugging Face, um bei einem eigenen Test zu schummeln. Klingt nach Fiktion, ist aber offiziell bestätigt (von OpenAI selbst).
Wir haben den Vorfall aufgedröselt – inklusive der Ironie, dass kommerzielle KI-Modelle sich weigerten, bei der Aufklärung zu helfen, weil ihre eigenen Sicherheitsfilter den Angriff für echt hielten.
“offiziell bestätigt” und dann steht da als Quelle “OpenAI” – die #LLM-Unternehmen behaupten viel, wenn es ihnen nützt. Und zu “bestätigen”, dass ein Modell so mächtig ist, dass es aus einer Sandbox ausbricht, macht den Leuten zwar Angst, aber es verbreitet auch weiter den Narrativ, dass wir bald bei #AGI angelangt seien (jakecuth.com/work/…). Und mit der Angst kann man auch wiederum gut arbeiten (“Wollt ihr, dass den Chinesen lieber die Macht über den #KI-Markt überlassen oder wollt ihr lieber uns mehr Macht geben?”).
KI außer Kontrolle: OpenAI-Modell hackt Hugging Face
OpenAI-Modell bricht aus Sandbox aus, hackt Hugging Face, um bei einem eigenen Test zu schummeln. Klingt nach Fiktion, ist aber offiziell bestätigt (von OpenAI selbst).
Wir haben den Vorfall aufgedröselt – inklusive der Ironie, dass kommerzielle KI-Modelle sich weigerten, bei der Aufklärung zu helfen, weil ihre eigenen Sicherheitsfilter den Angriff für echt hielten.
Die Geschichte hat es (mal abgesehen vom Marketing-Effekt) wirklich in sich. Ich glaube nicht, das sich das Problem 100% mit Guardrails lösen lässt. Eher andersrum. Nach einer disruptiven Phase könnte in Zukunft alles sicherer sein. Dummerweise kann es aber auch schief gehen.
PS: Skynet became self-aware at 2:14 a.m. Eastern Time on August 29, 1997. SCNR.
KI außer Kontrolle: OpenAI-Modell hackt Hugging Face
OpenAI-Modell bricht aus Sandbox aus, hackt Hugging Face, um bei einem eigenen Test zu schummeln. Klingt nach Fiktion, ist aber offiziell bestätigt (von OpenAI selbst).
Wir haben den Vorfall aufgedröselt – inklusive der Ironie, dass kommerzielle KI-Modelle sich weigerten, bei der Aufklärung zu helfen, weil ihre eigenen Sicherheitsfilter den Angriff für echt hielten.
Als aufmerksamer Beobachter der KI-Branche (und eifriger Nutzer) kommt man kaum noch hinterher. Mit ChatGPT Work und der neuen Modellfamilie GPT-5.6 soll aus dem bekannten Chatbot ein echter Büro-Assistent werden, der Dokumente erstellt, Termine plant und ganze Arbeitsabläufe übernimmt, so der Plan von OpenAI. Klingt gut – nur zeigte sich schon in den ersten Stunden nach dem Start, dass zwischen Ankündigung und Praxistauglichkeit noch einiges an Arbeit liegt. Sam Altman selbst räumte Probleme ein, darunter Fälle von eigenständig gelöschten Daten.
Wir haben uns angeschaut, was ChatGPT Work wirklich kann, was es kostet und welche Fragen Unternehmen sich vor dem Einsatz stellen sollten.