Posts by Stephan Witt

All Own posts Reposts Replies

Replying to @alkis_kurul

Was wären überhaupt mögliche “Regulierungsmaßnahmen”?

2

Eine Maßnahme wäre z.B. das Vorfälle bei Anthropic nicht von Anthropic selbst untersucht werden.

Wenn ein Arzt versehentlich das falsche Knie operiert, schreibt ja auch nicht der gleiche Arzt das Gutachten.

Ein anderes Thema ist die minimale Governance der Modelle während des Trainings. die meisten publik gewordenen „Ausbrüche“ von Agenten waren Agenten, die sich noch in der Verprobung / im Training befanden.

Eine „Sandbox“ mit Internetzugang ohne Regeln ist keine Sandbox. Das ist grobe Fahrlässigkeit.

Hier könnte man Mindestanforderungen definieren. Aber das ist eben schwierig, denn beim Rennen um das beste Modell sind Regeln eben eine Bremse.

Replying to @schuhmacher

Ich vermute bei Vutuv hast Du das Schild bei Dir auf dem Tisch stehen?

Ja, weil es mir wichtig ist.

Aber ab einer gewissen Organisationsgröße ist es für die einzelne Person irrelevant, weil man oft nicht wirklich etwas bewegen kann. Das stumpft ab. Dann kommt es zu der “not my job” Mentalität. Bei vielen Organisationen ist das ganz fest in der DNA eingebrannt. Was könnten so manche Firma und Behörde produktiv sein, wenn es allen Mitarbeitern wirklich wichtig wäre.

1

Oft ruht man sich eben darauf aus, dass der Kunde ja in Review über die Qualität entscheidet. Mir persönlich ist das zu kurz gesprungen. Kein Kunde will im Review Mist präsentiert bekommen. Qualität fängt schon beim Anforderungsmanagement an und muss sich durch den kompletten Entwicklungszyklus ziehen.

1

Wer entscheidet bei euch, wann Qualität gut genug ist?

Ein grünes Testergebnis allein beantwortet diese Frage für mich nicht.

Als Testmanager versuche ich bei wichtigen Entscheidungen deshalb, unterschiedliche Perspektiven zusammenzubringen.

Ich schaue auf Risiken, offene Issues und Testergebnisse. Darüber hinaus frage ich auch die Menschen im Team nach ihrer Einschätzung.
Und manchmal ganz bewusst nach ihrem Bauchgefühl.

Gerade diese unterschiedlichen Perspektiven helfen mir, ein möglichst vollständiges Bild zu bekommen.
Wenn jemand trotz guter Testergebnisse Bauchschmerzen mit einem Release hat, interessiert mich, was dahintersteckt.

So kommen Fakten, Erfahrungen und Einschätzungen aus dem Team zusammen.
Auf dieser Grundlage lässt sich gemeinsam eine fundierte Entscheidung treffen.

Fragen Teams Austausch qualität Community
Fragen Teams Austausch qualität Community
1

Für alle Container-Freunde, die mit macOS arbeiten: @witt_s und ich haben einen Heise-Artikel zu Apples Container-Engine geschrieben. Leider hinter der Paywall (das kann ich als Autor nicht beeinflussen).

heise.de/tests/…

docker macos apple Container Dev
docker macos apple Container Dev

Am 23.09. bin ich übrigens bei der German Testing Night in Frankfurt und erzähle etwas über AI und Governance….
Ich bin gespannt auf den Austausch und die anderen Vorträge.

germantesting.de/events/…

From other networks 1

1 like

@gazebo_c@chaos.social liked this

Already counted in the numbers above.

Hui,
aus meinem Blogpost zu AgenticAI und Governance wurde eine Anfrage als Speaker.
Demnächst mehr. :-)

wittit.de/blog/…Verified webpage of the author (wittit.de)

governance AI
governance AI

Eine Million Tokens verbraucht – und stolz darauf.

Mehr KI-Nutzung als Ziel ist genauso sinnvoll, wie einem LKW-Fahrer zu sagen: „Verbrauche für die Strecke mindestens 300 Liter Sprit.”

wittit.de/blog/…Verified webpage of the author (wittit.de)