Praxisnahe Orientierung für verantwortungsvolle KI-Programme.

Nach KI-Strategie, Automatisierung oder Governance suchen …
Menü ein- oder ausblenden

KI-Einführung und Arbeitsgestaltung

Rollen mit KI-Unterstützung auf Aufgabenbasis neu gestalten

Ein praxisnaher Leitfaden, um Aufgaben lokal zu erfassen, KI belastbar zu testen, Aufwand neu zuzuordnen und Rollen erst nach einem Pilot anzupassen.

Ein bereichsübergreifendes Team ordnet farbige Aufgabenkarten, Arbeitsproben und Holzmarker auf einem grossen Bürotisch neu.

Eine KI kann die erste Antwort eines Serviceteams beschleunigen und gleichzeitig anderswo neue Arbeit erzeugen: Die Teamleitung erhält mehr Prüfungen, Spezialistinnen bearbeiten schwierigere Eskalationen, und jemand muss fehlerhafte Wissensgrundlagen korrigieren. Wer nur die schnellere Produktion zählt, überschätzt deshalb leicht die verfügbare Kapazität. Eine belastbare Neugestaltung beginnt bei den tatsächlich ausgeführten Aufgaben, verfolgt jeden verschobenen Aufwand bis zu seinem neuen Ziel und setzt Rollen erst neu zusammen, wenn Zuständigkeit, Arbeitslast und Kompetenzaufbau sichtbar sind.

Das Wichtigste in Kürze

  • Gestalten Sie das Aufgabenbündel neu, nicht bloss den Stellentitel.
  • Eingesparte Produktionszeit ist erst nach einer vollständigen Aufwandsrechnung provisorische Kapazität.
  • Testen Sie eine dokumentierte KI-Konfiguration mit repräsentativen Fällen, bevor Sie Arbeit neu zuweisen.
  • Jede verschobene oder neue Pflicht braucht Zuständigkeit, Befugnis, Warteschlange und Kapazität.
  • Ersetzen Sie entfallende Lerngelegenheiten bewusst, bevor Sie eine Rolle dauerhaft verändern.

Warum beginnt eine neue Rollengestaltung bei den Aufgaben?

Dieselbe Servicemitarbeiterin sortiert Unterlagen, prüft einen Ordner und legt eine Mappe an getrennten Stationen ab, während ein Vorgesetzter zusieht.

Die Neugestaltung sollte bei einzelnen Aufgaben beginnen, weil eine Stelle Tätigkeiten mit sehr unterschiedlichen Veränderungsmöglichkeiten bündelt. KI kann einen Arbeitsschritt übernehmen, einen zweiten unterstützen, einen dritten unverändert lassen und einen vierten neu schaffen. Ein Urteil über den ganzen Stellentitel verdeckt diese Unterschiede. Die unmittelbare Frage lautet deshalb: Was verändert sich bei beobachtbaren Aufgaben unter den lokalen Arbeitsbedingungen? Erst danach wird entschieden, wie diese Aufgaben wieder zu vollständigen Rollen und funktionierenden Teams zusammengesetzt werden.

Auch Expositionsdaten beantworten diese lokale Frage nicht. Der verfeinerte ILO-Index nutzt berufsbezogene Aufgabeninformationen und bezeichnet Transformation allgemein als wahrscheinlicher als Ersatz; er misst aber weder die Automatisierung noch den Personalbedarf eines konkreten Betriebs. Die OECD beschreibt ebenfalls, dass viele Beschäftigte KI eher über veränderte Aufgaben und Arbeitsbedingungen als über Stellenverlust erleben dürften. Solche Befunde sind ein Anlass für genauere Untersuchung, nicht eine belastbare Grundlage für Stellenabbau, Produktivitätsversprechen oder pauschale Automatisierungsquoten.

Was gehört in ein Aufgabenbuch zum heutigen Zustand?

Eine sitzende Lagerkoordinatorin vergleicht Unterlagen mit einem Metallbauteil, während ein Beobachter am Werktisch Notizen macht.

Ein belastbares Aufgabenbuch beschreibt die tatsächlich geleistete Arbeit, ihre Nachfrage und ihre Bedingungen so konkret, dass ein späterer Vergleich möglich wird. Formulieren Sie jede Aufgabe als Handlung mit Objekt, etwa «Anfrage klassifizieren» statt «Kundenservice». Erfassen Sie Auslöser, Eingaben, Ergebnis, Abschlusskriterium, heutige Zuständigkeit, Empfänger und Ausnahmeweg. Trennen Sie Schritte, wenn Belege, Urteil, Folgen oder Zuständigkeiten wechseln; fassen Sie kleine Handgriffe nur zusammen, wenn sie gemeinsam verändert und gleich kontrolliert werden.

  • Nachfragevolumen und Schwankungen während eines klar bezeichneten Zeitraums
  • Menschliche Bearbeitungszeit, verstrichene Wartezeit und bestehende Warteschlangen als getrennte Grössen
  • Varianten, Grenzfälle, Nacharbeit, Rückläufe und bekannte Fehlerbilder
  • Abhängigkeiten, Übergaben, Rückfragen, Genehmigungen sowie Folgen von Fehlern oder Verzögerungen
  • Erforderliches Fachwissen, Urteil, Befugnis und selbstständiger Entscheidungsspielraum
  • Lernwege, Übung, Rückmeldung sowie Quelle und Verlässlichkeit jeder Ausgangsschätzung

Interviews mit Mitarbeitenden und Führungskräften, direkte Beobachtung, Arbeitsproben und Systemdaten sollten einander ergänzen. Keine dieser Quellen genügt allein: Erinnerungen können seltene Nebentätigkeiten ausblenden, Aufzeichnungen erklären nicht zwingend das Urteil hinter einer Handlung, und eine Beobachtung bildet saisonale Spitzen kaum vollständig ab. O*NET kann mit berufsbezogenen Aufgabenbeschreibungen, Bewertungen und Kontextdaten als Vokabular- und Vollständigkeitscheck dienen. Als US-Berufsinformationssystem belegt es jedoch nicht, was in einem Schweizer Betrieb tatsächlich vorkommt, wie oft es geschieht oder welchen Aufwand es verursacht.

Wie wird eine Aufgabe vor der Zuweisung an Mensch oder KI getestet?

Eine Qualitätsspezialistin prüft eine Akte mit farbigen Registern, während ein Kollege hölzerne Personenmarker in Schalen sortiert.

Jede Aufgabe sollte mit repräsentativen Fällen gegen eine eindeutig dokumentierte KI-Konfiguration getestet werden, bevor eine künftige Arbeitsteilung festgelegt wird. Halten Sie Modellversion, Werkzeuge, Prompts, Daten, Kontrollen und Testdatum fest. Der Fallbestand braucht häufige Routinefälle ebenso wie legitime Varianten, unklare Grenzen, seltene folgenreiche Fälle, fehlende oder widersprüchliche Eingaben und bekannte historische Fehler. Wo es relevant ist, werden Ergebnisse nach Erfahrung, Produkt, Kanal, Kundengruppe oder Region getrennt ausgewertet statt in einem Teamdurchschnitt versteckt.

  • Bewerten Sie Ergebnisqualität, menschliche Bearbeitungszeit, nötige Verifikation, Ausnahmen und Wiederherstellung gemeinsam.
  • Definieren Sie zulässige Eingaben und Aktionen, Abschlussbefugnis, Prüfpflichten, Eskalation, Stoppbedingungen und Rückfalllösung.
  • Dokumentieren Sie nicht nur gelungene Fälle, sondern auch plausible falsche Antworten und uneindeutige Grenzfälle.
  • Vergeben Sie keine dauerhaften Aufgabenetiketten: Neue Modelle, Daten, Prompts oder Arbeitsbedingungen erfordern eine erneute Prüfung.

Warum diese Vorsicht nötig ist, zeigt ein vorregistriertes Experiment mit 758 Beratenden: Innerhalb der ausgewählten KI-Fähigkeitsgrenze verbesserte die Unterstützung die gemessene Leistung, bei einer ausgewählten komplexen Aufgabe ausserhalb davon sank dagegen die Korrektheit. Die Ergebnisse gelten nur für diese Personen, Aufgaben, Konfiguration und Periode. Die Studie beschreibt die Fähigkeitsgrenze zudem als ungleichmässig und veränderlich. Der freiwillige NIST AI RMF Core ergänzt dazu, dass Mensch-KI-Verantwortlichkeiten, Befähigung und Aufsichtsprozesse differenziert dokumentiert werden sollen.

Vier anpassbare Konfigurationen für getestete Aufgaben
AufgabenkonfigurationVerantwortung des MenschenVerantwortung der KIErforderliche Betriebsgestaltung
Durch Menschen ausgeführtFührt die Aufgabe aus und bleibt zuständig.Keine oder nur nicht operative Unterstützung.Heutige Zuständigkeit und Grund für die Beibehaltung dokumentieren.
KI-unterstützter MenschRahmt die Aufgabe, prüft nötige Belege und entscheidet.Unterstützt innerhalb klarer Grenzen.Zulässige Eingaben, Prüfregeln, Abschlussbefugnis und Delegationsgrenzen festlegen.
KI zuerst, menschlicher Entscheid oder ReviewPrüft definierte Fälle oder trifft den folgenreichen Entscheid.Erstellt oder leitet den ersten Output.Warteschlange, Kriterien, Priorität, Befugnis, Ausnahmen und Spitzenkapazität benennen.
Begrenzte AutomatisierungÜberwacht die Leistung und löst Ausnahmen.Schliesst eine eng abgegrenzte Aufgabe unter erlaubten Bedingungen ab.Grenzen, Stoppbedingungen, Beobachtbarkeit, Änderungsführung und Rückfalllösung definieren.

Welcher Aufwand zählt neben der Produktionszeit?

Büromitarbeiter stellen Unterlagen zusammen, prüfen ein Metallteil, besprechen einen Ordner und übergeben eine Mappe in einem gemeinsamen Arbeitsraum.

Neben der Produktion müssen Verifikation, Urteil, Ausnahmebearbeitung und Koordination separat gemessen werden. Diese fünf Konten sind ein praktisches redaktionelles Buchungsmodell, kein Forschungsstandard. Produktion umfasst das Suchen, Formulieren, Umwandeln, Erfassen oder Ausführen des ersten Arbeitsergebnisses. Verifikation erfasst die Prüfung von Quellenbasis, Berechnungen, Vollständigkeit, Vorgaben und nachgelagerter Verwendbarkeit. Zum Urteil gehören Einordnung, Interpretation, Auswahl, Befugnis und Verantwortung; diese Arbeit verschwindet nicht automatisch, wenn ein System bereits einen flüssigen Vorschlag liefert.

  • Ausnahmebearbeitung: fehlende oder mehrdeutige Eingaben, Werkzeugausfälle, Übersteuerungen, Korrektur, Wiederherstellung und Eskalation
  • Koordination: Kontext weitergeben, Rückfragen beantworten, Ergebnisse abgleichen, Akzeptanz herstellen, coachen und gemeinsames Wissen pflegen
  • Verteilung: für jede verschobene Minute Zielrolle, Zielteam und Warteschlange festhalten
  • Belastung: Spitzen, Arbeitsintensität, Autonomie, Aufgabenvielfalt und weiterhin getragene Verantwortung neben Durchschnittszeiten beobachten

Die OECD-Evidenzübersicht zeigt, weshalb Zeit allein zu kurz greift: KI kann monotone Arbeit verringern, zugleich aber das Tempo erhöhen, Autonomie einschränken oder Beschäftigte auf ein engeres Aufgabenspektrum konzentrieren; die Wirkung variiert nach Umfeld und Person. Der NIST-Rahmen fordert klare Rollen, Kommunikationswege, Rückmeldungen und Überwachung, schreibt die fünf Konten jedoch nicht vor. Für die Praxis bedeutet das: Ein kleiner Zeitgewinn bei vielen Mitarbeitenden darf nicht gegen eine überlastete Prüf- oder Eskalationsstelle aufgerechnet werden, ohne deren reale Nachfrage und Spitzen zu messen.

KI entfernt Arbeit nicht als sauberen Block; sie verschiebt Aufwand, Befugnis, Ausnahmen und Lernen.

ModelFold Editorial Team

Wie werden veränderte Aufgaben zu tragfähigen Rollen und Expertise?

Ein erfahrener Techniker führt einen jüngeren Kollegen durch die Prüfung eines Maschinengehäuses, während ein weiterer Techniker im Hintergrund arbeitet.

Veränderte Aufgaben werden zu tragfähigen Rollen, indem jede notwendige Pflicht, Befugnis und Warteschlange einer benannten Funktion mit ausreichender Kapazität zugeordnet wird. Dazu können Output-Review, Ausnahmeverantwortung, Wissenspflege, Systemverantwortung, Leistungsüberwachung, Lernverantwortung und Eskalationsbefugnis gehören. «Human in the Loop» genügt als Beschreibung nicht: Festzulegen sind die zu prüfenden Belege, auslösende Fälle, Entscheidungskompetenz, Kommunikationswege und das Verhalten der Warteschlange unter Spitzenlast. Der NIST-Rahmen stützt solche klaren Verantwortlichkeiten, schreibt aber kein Personalmodell vor.

  • Identifizieren Sie Aufgaben, die bisher Beobachtung, Wiederholung, Rückmeldung, Ursachenverständnis und beaufsichtigte Übung ermöglichten.
  • Ersetzen Sie entfallende Übung gezielt durch Originalarbeit in Stichproben, Shadowing, Simulationen, Fallbesprechungen, Rotation und Coaching.
  • Geben Sie Lernenden schrittweise anspruchsvollere Entscheide und Zugang zu schwierigen Fällen statt nur zu geglätteten KI-Ergebnissen.
  • Prüfen Sie, ob Mitarbeitende Probleme auch dann diagnostizieren und beheben können, wenn die KI nicht verfügbar ist oder falsch liegt.

Ein hypothetisches Supportteam verdeutlicht die Verschiebung. KI-gestützte Suche und Entwürfe können bei getesteten Routinefällen Produktionszeit reduzieren. Die Mitarbeitenden behalten jedoch Diagnose, Kontextprüfung und Entscheide innerhalb ihrer Befugnis; Teamleitungen oder Fachstellen übernehmen möglicherweise mehr Reviews, Ausnahmen, Wissenskorrekturen und Coaching. Eine Studie mit 5’179 Supportmitarbeitenden fand stark nach Erfahrung variierende Produktivitätseffekte und nur hinweisende Evidenz zur Verbreitung leistungsstarker Praktiken. Ein weiteres Feldexperiment mit 776 Fachpersonen zeigte veränderte Leistung und Wissensintegration in getesteten Einzel- und Teamkonfigurationen, liess langfristige Expertise-Fragen aber offen.

Wann reicht die Evidenz für neue Kapazitäts- oder Rollenentscheide?

Ein Arbeitsteam prüft Schalen mit sortierten Bauteilen, während die Frau in der Mitte in einem hellen Industriebereich auf Arbeitsproben zeigt.

Erst ein gemessener Pilot mit vollständiger Arbeitslast liefert genügend Evidenz für vorläufige Kapazitäts-, Rollen- oder Leistungsentscheide. Berechnen Sie für einen klar bezeichneten Zeitraum die bei beobachteter Nachfrage reduzierte menschliche Produktionsarbeit. Ziehen Sie zusätzlichen Aufwand für Verifikation, Urteil, Ausnahmen, Koordination, Lernen, Überwachung und Wissenspflege ab. Berücksichtigen Sie veränderte Nachfrage, Servicequalität, Nacharbeit, Spitzen und an andere Stellen übertragene Arbeit. Verstrichene Wartezeit erklärt den Arbeitsfluss, darf aber nicht automatisch als menschliche Arbeitszeit verbucht werden.

  • Qualität, Fehler, Übersteuerungen, Nacharbeit und Wiederherstellung bei falschen oder fehlenden KI-Ergebnissen
  • Arbeitslast je Zielrolle, Warteschlangen in Spitzen und Rückmeldungen von Mitarbeitenden und Führungskräften
  • Autonomie, Aufgabenvielfalt und weiterhin getragene fachliche oder betriebliche Verantwortung
  • Fähigkeit neuerer Mitarbeitender, schwierige Fälle zu diagnostizieren und ohne KI-Unterstützung weiterzuarbeiten
  • Änderungen an Modell, Prompt, Daten, Kontrollen, Arbeitsablauf, Fallmix oder Betriebskontext

Der Pilot muss lange genug laufen, damit Nebenarbeit sichtbar wird und sich die Nachfrage vernünftig stabilisieren lässt; eine universelle Mindestdauer gibt die Evidenz nicht her. Der verbleibende Wert ist deshalb zunächst provisorische Kapazität, nicht automatisch ein Stellenäquivalent. Die OECD berichtet über unterschiedlich verteilte Auswirkungen auf Arbeitsqualität, während der NIST-Rahmen laufende Messung, Rückmeldungen und dokumentierte Verantwortung verlangt. Weil sich KI-Leistung zwischen ähnlichen Aufgaben unterscheiden und die Fähigkeitsgrenze verändern kann, wird die Gestaltung nach relevanten Konfigurations- oder Kontextänderungen erneut geprüft.

Bleiben Aufgabenbuch, repräsentative Tests, Zuständigkeiten, Prüfwirksamkeit, Ausnahmekapazität oder Kompetenzaufbau unvollständig, bleiben Stellenmodell, Stellenbeschreibungen, Leistungsmasse und Serviceversprechen unverändert. Das Aufgabenbuch dient als Pilot- und Lerninstrument, nicht als Abkürzung zu einem Personalentscheid. Arbeitsrechtliche, sozialpartnerschaftliche, datenschutzrechtliche, barrierebezogene, diskriminierungs-, sicherheits-, regulatorische und fachlich geschützte Fragen gehören zu den dafür qualifizierten und befugten Stellen der Organisation. Die Methode macht diese Beurteilungen nicht und ersetzt weder formelle Mitwirkung noch erforderliche Fachprüfung.

Häufige Fragen

Wie gestaltet man eine Stelle für generative KI neu?

Zerlegen Sie die lokal beobachtete Arbeit in konkrete Aufgaben und erfassen Sie Nachfrage, Aufwand, Urteil, Folgen und Abhängigkeiten. Testen Sie anschliessend eine dokumentierte KI-Konfiguration mit repräsentativen Fällen, führen Sie die fünf Aufwandkonten und setzen Sie Pflichten sowie Zuständigkeiten erst danach zu einer vollständigen Rolle zusammen.

Was bedeutet aufgabenbasierte KI-Personalplanung?

Sie plant von der tatsächlichen Aufgabennachfrage, Bearbeitungszeit, Variation, Verantwortung und den getesteten KI-Wirkungen aus. Eine berufsweite Expositions- oder Automatisierungsschätzung ersetzt diese lokale Evidenz nicht und erlaubt für sich allein keinen Schluss auf Personalkapazität.

Wie teilt man Aufgaben zwischen Menschen und KI auf?

Als anpassbares Raster dienen vier Konfigurationen: durch Menschen ausgeführt, KI-unterstützter Mensch, KI zuerst mit menschlichem Entscheid oder Review sowie begrenzte Automatisierung. Jede Wahl benötigt festgelegte Befugnisse, zulässige Aktionen, Prüfkriterien, Ausnahmewege, Überwachung, Stoppbedingungen und eine Rückfalllösung.

Wie misst man die Umverteilung von KI-Arbeit?

Messen Sie Produktion, Verifikation, Urteil, Ausnahmebearbeitung und Koordination getrennt nach Aufgabe und Zeitraum. Wird Arbeit verschoben, erfassen Sie Zielrolle, Nachfrage, Warteschlange und Spitzenlast; ergänzen Sie Lern-, Überwachungs- und Wissenspflegeaufwand in der Kapazitätsabstimmung.

Wann wird eingesparte KI-Zeit zu Personalkapazität?

Die Einsparung bleibt provisorisch, bis ein gemessener Pilot die vollständige Arbeitslast, Qualitätswirkung, veränderte Nachfrage, Spitzen, übertragene Arbeit und Kompetenzentwicklung berücksichtigt. Fehlen stabile Evidenz, wirksame Prüfung oder benannte Zuständigkeiten, sollte daraus keine Änderung von Stellen, Leistungszielen oder Serviceversprechen abgeleitet werden.

ModelFold logo

Redaktion von ModelFold

Wir berichten darüber, wie KI tatsächlich in einem Unternehmen ankommt. Wir arbeiten mit benannten Quellen, trennen Recherche von Einschätzung und nutzen KI-Unterstützung für Recherche und Entwürfe unter dokumentierten redaktionellen Kontrollen. Eine individuelle Fachprüfung ersetzen wir nicht.