Ein Ethik-Workshop, der Widerspruch zulässt: Rollen, Macht, Gegenargumente und Beschluss
Ein Unterrichtsformat für Weiterbildung und berufliche Praxis: drei Einheiten à 90 Minuten, ein fiktiver Fall, eine begründete und revidierbare Entscheidung.

Worum es hier geht
Ein Ethik-Workshop zu KI scheitert leicht an einem vertrauten Muster: Eine Gruppe sammelt Werte, findet schnell eine Formulierung, die niemand offen ablehnen möchte, und nennt das Ergebnis Konsens. Danach bleibt oft unklar, wer die Entscheidung getroffen hat, wessen Erfahrung fehlte und was geschieht, wenn die Praxis dem Beschluss widerspricht. Die freundlichste Fassung eines Leitbilds kann Machtunterschiede verdecken, statt sie bearbeitbar zu machen.
Dieser Beitrag schlägt deshalb einen anderen Arbeitsauftrag vor. Die Gruppe soll nicht beweisen, dass sie einer Meinung ist. Sie soll eine begrenzte Entscheidung so bearbeiten, dass Annahmen, Gegenargumente, Betroffene, Zuständigkeiten und Bedingungen für eine spätere Revision sichtbar bleiben. Ein Beschluss ist dann kein Schlussstrich über abweichende Positionen. Er ist eine vorläufige Handlungsregel mit einem dokumentierten Widerspruch und einem Weg zurück an den Tisch.
Das ist insbesondere dort wichtig, wo KI Arbeit vorbereitet, aber nicht vollständig automatisiert. Der Satz „Ein Mensch prüft ja noch einmal“ beantwortet weder die Frage, ob diese Prüfung unter realem Zeitdruck möglich ist, noch wer die Kosten eines Fehlers trägt. Auch ein freiwilliges Opt-out löst nicht automatisch das Problem: Wer die Alternative wählen kann, muss sie verstehen, ohne Nachteile nutzen können und darf nicht unter Rechtfertigungsdruck geraten.
Das Workshopdesign ist ein redaktioneller Entwurf, kein Bericht über eine bereits erprobte Unterrichtseinheit. Die nachfolgende Fallarbeit ist vollständig fiktiv und keine Nacherzählung einer realen Kurs- oder Betriebssituation.
Lernergebnisse
Nach drei Einheiten können die Teilnehmenden eine KI-bezogene Entscheidung so formulieren, dass Ziel, Begriffsklärung und vermutete Ursache getrennt sichtbar sind. Sie können in F-B mindestens zwei konkurrierende Hypothesen und eine Meta-Frage zu Nutzen, Macht oder Fehlerkosten entwickeln. Sie unterscheiden eine belegte Aussage von einer Annahme, einer Wertung und einer offenen Evidenzlücke. Im K-Kernzyklus können sie Betroffene und abwesende Perspektiven kartieren, ein Gegenargument fair wiedergeben und eine Empfehlung mit Verantwortung, Einspruch und Evaluation formulieren. Sie können erklären, weshalb ein menschlicher Review nur unter konkreten zeitlichen und fachlichen Bedingungen Aufsicht bedeutet, und sie können eine nicht KI-gestützte Alternative gleichwertig prüfen. Ihr abschließendes Produkt ist kein Konsenspapier, sondern eine revidierte Leitfrage, ein vorläufiger Beschluss und ein nachvollziehbarer Rückkehrpunkt.
Der einzige Fall: Entwürfe für Feedback in einem Weiterbildungskurs
Ein Weiterbildungskurs erwägt, für schriftliche Reflexionen der Teilnehmenden KI-generierte erste Entwürfe von Feedback zu erstellen. Ein Trainer oder eine Trainerin liest und überarbeitet jeden Entwurf, bevor ein Feedback verschickt wird. Es wird kein Score automatisiert, keine Teilnahmeentscheidung automatisiert und keine Bewertung durch das System vergeben. Teilnehmende können der Nutzung ihrer Reflexionen für diesen Zweck widersprechen und erhalten dann Feedback ohne KI-Entwurf.
Der Vorschlag klingt vorsichtig. Gerade deshalb eignet er sich für einen Ethik-Workshop. Die Frage lautet nicht schlicht: „Ist das erlaubt?“ oder „Ist KI gut für Feedback?“ Sie lautet: Unter welchen Bedingungen wäre dieses Vorgehen gegenüber Teilnehmenden und Beschäftigten begründbar, und wann wäre eine nicht KI-gestützte Lösung die bessere Entscheidung?
Mehrere Konflikte liegen schon in dieser Frage. Erstens: Ein erster Entwurf kann Zeit sparen, aber auch einen Ton oder eine Deutung vorprägen. Der menschliche Review kann sorgfältig sein oder zu einer routinierten Abnahme werden. Zweitens: Die Teilnehmenden sind nicht bloß Datenquellen. Ihre Reflexionen können Unsicherheit, Kritik oder persönliche Lernerfahrungen enthalten. Drittens: Der Nutzen einer Beschleunigung verteilt sich möglicherweise anders als die Arbeit. Trainerinnen und Trainer müssen Entwürfe prüfen, Fehler erkennen und bei jeder Rückfrage Verantwortung übernehmen. Viertens: Ein Opt-out ist nur dann eine echte Option, wenn die nicht KI-gestützte Rückmeldung gleichwertig, zugänglich und ohne Stigma erreichbar ist.
Der Workshop behandelt diesen Fall nicht als abstrakte Abstimmung über Technik. Er fragt nach der Entscheidungssituation: Wer ist von der Verarbeitung und vom Feedback betroffen? Wer kann einen Fehler erkennen, stoppen und korrigieren? Wer entscheidet über Ziel, Datenfluss und Ausstieg? Welche Menschen fehlen im Raum, obwohl sie Folgen tragen? Und welche Behauptung über Zeitgewinn, Qualität oder Belastung ist bislang nur eine Annahme?
Zwei Arbeitsmodelle, zwei verschiedene Aufgaben
Die Workshopsequenz nutzt zwei Modelle mit getrennten Funktionen. Keines von beiden liefert eine ethische Antwort. Beide helfen, die Arbeit so zu ordnen, dass eine Gruppe ihre Begründungen prüfen und verändern kann.
Das F-v5-Fragenmodell folgt der Reihenfolge A → B → D → C. In A klärt die Gruppe Begriffe, Ziele und vermutete Ursachen: Was meint „besseres Feedback“? Für wen soll es besser werden? Welcher Engpass soll gelöst werden? B öffnet dann den Raum für konkurrierende Hypothesen und Meta-Fragen. Hier wird nicht nur nach einer technischen Variante gesucht. Die Gruppe fragt etwa: Könnte das tatsächliche Problem zu wenig geschützte Feedbackzeit sein? Würde ein klareres Raster für menschliches Feedback denselben Nutzen bringen? Wer profitiert von der Kennzahl „schneller“ und wer trägt die Kosten einer Fehlinterpretation? In B darf eine Gruppe mehrere plausible, einander widersprechende Deutungen stehen lassen.
D ist die Revisionsschleife. Neue Rückmeldungen, fehlende Belege oder ein übersehenes Risiko ändern die Arbeitsfrage und die Optionen. Die Revision wird knapp protokolliert: Auslöser, geänderte Annahme oder Frage und gewählte Iteration oder Fallback. Erst C bündelt die derzeit beste Leitfrage oder den angepassten Arbeitsauftrag, die offenen Punkte, Kriterien und einen nächsten überprüfbaren Schritt. Zur Übergabe gehören außerdem eine transparente Prozessspur — Ausgangsfrage, wichtige Alternativen, Rückmeldung, Änderung und offene Lücken — sowie ein konkreter GROW-Plan: Ziel (Goal), Ausgangslage (Reality), Optionen (Options) und nächster Weg (Way Forward). Das ist eine Planungsstruktur, kein Ethik-Siegel. Die Reihenfolge ist entscheidend: Der Beschluss kommt nicht unmittelbar nach einem Brainstorming. Rückmeldung läuft in D zurück, bevor C eine Handlungsfrage fixiert.
Das K-Konsultations- und Governance-Modell strukturiert die soziale und organisatorische Seite. Sein vierstufiger Kern lautet: Exploration → Reflexion/Analyse → Entscheidung/Empfehlung → Feedback/Evaluation. Exploration macht Beteiligte, Daten, Ziele, Arbeitsabläufe und fehlende Perspektiven sichtbar. Reflexion/Analyse untersucht Gründe, Machtverhältnisse, Risiken und Optionen. Entscheidung/Empfehlung ordnet Verantwortlichkeiten, Grenzen und eine begründete Regel zu. Feedback/Evaluation prüft, was tatsächlich geschieht, und gibt die Sache bei Bedarf zurück in die Fragearbeit.
Für einen späteren, klar abgegrenzten Fall kann eine fünfstufige Szenarioerweiterung verwendet werden: Nach Exploration, Reflexion/Analyse und Entscheidung folgt ein begrenzter Implementierungs- oder Pilotschritt; den Abschluss bildet die Evaluation. Diese fünf Schritte sind nicht der Kern des K-Modells und nicht mit einem anderen Fünfphasenmodell gleichzusetzen. Im Workshop dient die Erweiterung nur dazu, die beschlossene Regel als reversiblen Versuch zu denken. Die Kerngrammatik bleibt der vierstufige Zyklus.
Die Modelle greifen ineinander. F-B hält konkurrierende Hypothesen und Meta-Fragen offen. K-Exploration und K-Reflexion/Analyse machen daraus eine Beratung, in der Rollen, Stimmen und Folgen nicht verschwinden. Wenn Feedback eine Annahme widerlegt oder eine betroffene Perspektive die Entscheidung verändert, geht die Gruppe über F-D zurück in die Revision. Erst dann erstellt sie in F-C den aktuellen Arbeitsauftrag oder Prompt, die Prozessspur und den GROW-Nächsterschritt; im K-Zyklus formuliert sie eine Empfehlung.

Warum Rollen allein Macht nicht lösen
Rollen sind sinnvoll, aber nicht neutral. Eine Moderation, die Redezeit verteilt, kann verhindern, dass eine einzelne Person den Workshop bestimmt. Sie kann zugleich die falsche Annahme stärken, alle hätten dieselbe Freiheit, Risiko oder Sprache, um zu widersprechen. In einem Kurs können Teilnehmende ihre Zustimmung anders äußern als Lehrende oder Programmverantwortliche, weil sie von Bewertung, Zugang zu Zertifikaten oder künftigen Angeboten abhängig sind. Auch die Person, die den technischen Prozess pflegt, verfügt über Wissen, das andere nicht ohne Weiteres prüfen können.
Wertepluralismus heißt nicht, dass jede Behauptung gleich gut begründet ist oder Entscheidungen unmöglich werden. Er bedeutet, dass wichtige Güter — etwa Zugang zu hilfreichem Feedback, Privatsphäre, Autonomie und faire Arbeitsbedingungen — in Spannung geraten können, ohne sich auf eine einzige gemeinsame Kennzahl reduzieren zu lassen. Isaiah Berlin entwickelt diese Idee in „The Pursuit of the Ideal“ als philosophisches Argument über menschliche Zwecke. Für die Übung folgt daraus keine beliebige Wahl: Die Gruppe muss Gründe prüfen, Kosten sichtbar machen und sagen, wessen Interessen eine Option belastet. Sie darf aber nicht so tun, als gäbe es für jeden Konflikt einen neutralen Gesamtscore. Das ist eine philosophische Linse, kein empirischer Befund über KI-Feedback oder die Wirksamkeit dieses Workshops.
Deshalb sind Rollen im Workshop keine Theateretiketten. Jede Rolle erhält eine begrenzte Aufgabe und ein Recht, etwas anzufechten. Die Rolle „Betroffenenperspektive“ behauptet nicht, für alle Teilnehmenden zu sprechen. Sie prüft, welche Betroffenen nicht anwesend sind und welche Fragen an sie zurückgegeben werden müssen. Die Rolle „Arbeitsfolgen“ fragt nicht nur nach Effizienz, sondern nach Zeit, Qualifikation, verdeckter Zusatzarbeit und der Möglichkeit, eine Prüfung tatsächlich zu verweigern. Die Rolle „Evidenz und Annahmen“ trennt Belegtes von Vermutetem. Sie darf eine Aussage nicht mit einer besseren Vermutung ersetzen; sie markiert die Lücke.
Die Leitung oder eine beauftragte Entscheidungsrolle bleibt in einer realen Organisation entscheidungsfähig und rechenschaftspflichtig. Der Workshop darf diese Zuständigkeit nicht durch einen Stuhlkreis simulieren. Wenn die Person mit Entscheidungsmacht nicht im Raum ist, wird das auf dem Beschlussblatt als Grenze vermerkt. Wenn sie im Raum ist, gilt eine besondere Regel: Sie spricht in der ersten Analysephase zuletzt, darf keine Haltung als erwartete Kursantwort markieren und muss auf die dokumentierte Gegenposition eingehen. So wird Widerspruch nicht folgenlos, auch wenn der Beschluss am Ende nicht einstimmig ist.
Diese Aufmerksamkeit für Differenz lässt sich philosophisch schärfen. Iris Marion Young argumentiert, demokratische Kommunikation müsse unterschiedliche Formen des Ausdrucks und soziale Differenz aufnehmen, statt eine scheinbar neutrale Einheitsstimme zu verlangen. Das ist hier eine Linse, keine Bestätigung des F- oder K-Modells und kein Wirksamkeitsnachweis für dieses Workshopformat. Sie hilft jedoch, eine praktische Frage klarer zu stellen: Welche Gesprächsregel macht abweichendes Erfahrungswissen hörbar, ohne es als bloße „persönliche Meinung“ abzuwerten?
Auch die UNESCO-Empfehlung zur Ethik künstlicher Intelligenz stellt Beteiligung, Transparenz, Verantwortung und den Schutz menschlicher Würde in einen normativen Zusammenhang. Sie macht aus dieser Kurssequenz keine rechtsverbindliche Prüfung und ersetzt keine lokale Analyse von Daten, Rollen oder Zuständigkeiten. Als zweite Linse erinnert sie daran, dass Menschen, die die Folgen eines Systems tragen, nicht erst nach der Entscheidung informiert werden sollten.
Der Ablauf: drei Einheiten à 90 Minuten
Das Format ist für 12 bis 24 Personen ausgelegt. Bei kleineren Gruppen können Rollen zusammengelegt werden, bei größeren arbeiten zwei bis drei parallele Gruppen am gleichen Fall und vergleichen anschließend ihre Beschlüsse. Es gibt bewusst nur diesen einen Fall. Zusätzliche Beispiele würden die Aufmerksamkeit zerstreuen und könnten den Eindruck erzeugen, man müsse für jede Anwendung denselben Beschluss finden.
Vor Beginn bereitet die Moderation einen Fallbogen, Rollenkarten, eine sichtbare Tafel für Evidenz und Annahmen sowie ein Beschluss- und Übertragungsblatt vor. Die Materialien beschreiben keine reale Software und enthalten keine personenbezogenen Reflexionstexte. Als Datenbasis genügt die fiktive Fallbeschreibung. Falls die Gruppe externe Informationen ergänzen soll, werden Herkunft, Datum und Geltungsbereich auf dem Evidenzblatt notiert.
Einheit 1: Die Frage öffnen, bevor über Lösungen gesprochen wird
0–10 Minuten: Schutzrahmen und Ziel. Die Moderation erklärt: Niemand wird danach bewertet, ob er oder sie KI befürwortet. Bewertet wird die Qualität der Begründung, der Umgang mit Gegenargumenten und die Fähigkeit, die eigene Ausgangsposition bei guten Gründen zu prüfen. Aussagen über persönliche Erfahrungen sind freiwillig. Niemand muss private Lern- oder Arbeitssituationen offenlegen. Es gibt drei Beteiligungswege: Sprechen, schriftliche Karte oder vertrauliche Notiz an die Moderation. Die Notizen werden nur in anonymisierter, zusammengefasster Form in die Diskussion eingebracht, sofern dies gewünscht ist.
10–25 Minuten: Fall lesen und Begriffe in F-A klären. Jede Person markiert Begriffe, die im Fall unbestimmt bleiben: „erste Entwürfe“, „Überprüfung“, „gleichwertiges Feedback“, „Opt-out“, „Zeitgewinn“, „vertrauliche Reflexion“. Anschließend entscheidet die Gruppe nicht, was diese Begriffe endgültig bedeuten. Sie schreibt Arbeitsdefinitionen und die dazugehörigen Prüfungsfragen auf. Beispiel: Eine menschliche Prüfung ist erst dann mehr als ein Klick, wenn Prüfdauer, Fachkompetenz, Eingriffsrecht und dokumentierte Korrektur möglich sind.
25–40 Minuten: Ursache und Nicht-KI-Optionen. In Kleingruppen untersucht die Gruppe, welches Problem eigentlich gelöst werden soll. Vielleicht ist der Engpass die Menge der Reflexionen; vielleicht fehlt ein gemeinsames Feedbackraster; vielleicht fehlt bezahlte Vorbereitungszeit. Jede Gruppe muss mindestens eine nicht KI-gestützte Option formulieren. Das kann ein klareres, von Trainerinnen und Trainern genutztes Feedbackraster, eine andere Taktung von Rückmeldungen oder zusätzliche geschützte Arbeitszeit sein. Die Nicht-KI-Option wird nicht als symbolische Pflicht erwähnt, sondern mit denselben Kriterien wie die KI-Option geprüft: Qualität, Zeit, Belastung, Zugang, Fehlerfolgen und Reversibilität.
40–65 Minuten: F-B mit konkurrierenden Hypothesen und Meta-Fragen. Nun öffnen die Gruppen mindestens drei konkurrierende Hypothesen: (1) KI-Entwürfe geben Trainern mehr Zeit für individuelle Ergänzungen. (2) KI-Entwürfe erzeugen eine Vorlage, die den Review vorprägt und damit die Qualität mindern kann. (3) Das Hauptproblem ist organisatorisch; eine KI ändert nur, wo die Arbeit sichtbar wird. Zu jeder Hypothese formuliert die Gruppe eine Meta-Frage über Macht oder Verteilung: Wer setzt die Zielgröße fest? Wer kann die Behauptung über Zeitersparnis prüfen? Welche Person trägt die Folge, wenn ein Feedback einen Lernprozess falsch deutet? Das Ergebnis ist keine Sammlung möglichst vieler Fragen. Es ist ein überschaubarer Raum plausibler Deutungen, die sich widersprechen dürfen.
65–80 Minuten: Evidenz und Annahmen trennen. Auf einer Tafel stehen zwei Spalten: „Belegt im Fall oder durch Quelle“ und „Annahme/noch zu prüfen“. Die Moderation achtet darauf, dass eine gut klingende Erwartung nicht in die erste Spalte rutscht. Im fiktiven Fall ist beispielsweise belegt, dass jeder Entwurf von einem Trainer geprüft werden soll und ein Opt-out vorgesehen ist. Nicht belegt sind Zeitgewinn, Akzeptanz, Fehlerquote, Gleichwertigkeit der Alternative oder die tatsächliche Prüftiefe. Die Gruppe kann Aussagen als „unbekannt“ stehen lassen.
80–90 Minuten: F-D, kurze Revision und Übergabe. Jede Gruppe schreibt ihre Startfrage und eine revidierte Frage. Eine mögliche Revision wäre: „Unter welchen dokumentierten Bedingungen verbessert ein von Trainern vollständig überprüfter KI-Entwurf die Rückmeldung, ohne den gleichwertigen Zugang zu nicht KI-gestütztem Feedback oder die fachliche Verantwortung zu schwächen?“ Die Frage bleibt vorläufig. Die offenen Annahmen und fehlenden Perspektiven werden an Einheit 2 übergeben.
Einheit 2: Konflikt, Betroffene und die Grenze der Abstimmung
0–10 Minuten: Rollen verteilen und rotieren. Für diese Einheit besetzen Gruppen mindestens sechs Rollen: Moderation, Evidenz/Annahmen, Betroffenenperspektive, Arbeitsfolgen, Widerspruch oder Red Team und Entscheidungsdokumentation. Bei sieben oder mehr Personen kommt die Rolle Zugang und Barrieren hinzu. Rollen werden in der dritten Einheit gewechselt. Niemand vertritt zweimal dieselbe Rolle; insbesondere soll die Person, die in Einheit 2 den Widerspruch führt, nicht auch den Beschluss formulieren.
● Nur für Mitglieder
Lies den vollständigen Artikel und lade alle Dateien mit einer Mitgliedschaft herunter.
Vollständigen Artikel + Downloads freischalten → Abonnieren0 Kommentare
● Kommentare werden geladen…