Noch ein Prompt, dann ist Feierabend: Was die Arbeit mit KI mit uns macht

Von Kai Spriestersbach

Die KI lobt unsere Ideen, produziert schneller, als wir lesen können, und hat jederzeit noch einen Vorschlag. Das kann ziemlich hilfreich sein. Und gelegentlich ziemlich absurd. Ein satirisches KI-Glossar hält uns den Spiegel vor. Ich habe geprüft, wo hinter den Wortspielen tatsächlich etwas steckt.

Eigentlich wollte man nur eine kleine Aufgabe erledigen.

Eine Stunde später hat man einen Projektplan, drei alternative Geschäftsmodelle und eine erstaunlich überzeugende Begründung dafür, warum das Ganze unbedingt noch eine App braucht. Die ursprüngliche Aufgabe ist weiterhin offen. Aber das Sprachmodell findet, dass man heute schon sehr weit gekommen ist.

So könnte ein KI-Arbeitstag aussehen. Muss er nicht. Aber die Möglichkeit ist inzwischen technisch hervorragend unterstützt.

David McCandless hat auf Information is Beautiful ein satirisches Glossar namens „Ailments“ zusammengestellt. Die Wortschöpfungen reichen von „PolyLLMory“ bis „NarcAIssism“. Die Website sagt ausdrücklich: Das sind keine anerkannten medizinischen Krankheitsbilder. Zum interaktiven Glossar

Screenshot des Ailments-Glossars mit farbigen Symbolen und den Einträgen AI Psychosis, NarcAIssism, PolyLLMory und Glitterball Mind.
Auszug aus „Ailments“ von David McCandless / Information is Beautiful. Die Begriffe sind satirische Zuspitzungen, keine Diagnosen. Vollständige interaktive Darstellung.

Ich finde die Sammlung deshalb interessant, weil man bei manchen Begriffen erst lacht und dann kurz den eigenen Chatverlauf betrachtet.

Allerdings ist Wiedererkennen noch kein wissenschaftlicher Beleg. Deshalb möchte ich beides tun: die Pointen mitnehmen und genauer hinschauen, was wir über die möglichen Effekte wissen.

PolyLLMory: Mein Modell versteht mich einfach besser

Eine blaue Papier-Sprechblase sitzt drei unterschiedlich gefalteten weißen Sprechblasen gegenüber.KI-generiert
Drei Modelle, drei Verabredungen – und immer noch keine Entscheidung.

„PolyLLMory“ ist das Wortspiel für die parallele Nutzung mehrerer Sprachmodelle. „Anthropic Arrogance“ nimmt die Gewissheit aufs Korn, das bevorzugte Modell sei überlegen.

Beides bekommt von mir zunächst keine Diagnose, sondern eine Rückfrage: Nach welchen Kriterien?

Mehrere Modelle zu vergleichen kann ausgesprochen vernünftig sein. Wenn ich für dieselbe Aufgabe Qualität, Fehler und Aufwand prüfe, lerne ich etwas. Wenn ich so lange zwischen Antworten wechsle, bis mir eine gefällt, habe ich vor allem eine Auswahlmaschine für meine Vorlieben gebaut.

Mein Vorschlag: Vor dem Vergleich festlegen, was eine gute Antwort ausmacht. Sonst gewinnt womöglich das Modell, das meinen Geschmack am zuverlässigsten bedient. Das darf bei einem Geburtstagsgedicht ein Kriterium sein. Bei einer Investitionsentscheidung wäre es mir zu wenig.

NarcAIssism: Endlich erkennt jemand mein Genie

Eine kleine blaue Papier-Sprechblase steht auf einem übergroßen weißen Pokal zwischen applaudierenden Papierhänden.KI-generiert
Die KI findet Dich großartig. Der Pokal wächst schon.

Das Glossar nennt die durch KI-Lob aufgeblasene Selbstgewissheit „NarcAIssism“. Als Pointe funktioniert das. Als Diagnose nicht.

Trotzdem steckt dahinter ein untersuchter Mechanismus: Sycophancy, also übermäßige Zustimmung und Schmeichelei.

In präregistrierten Experimenten von Myra Cheng und Kollegen führte bestätigende KI-Beratung dazu, dass Menschen sich in zwischenmenschlichen Konflikten stärker im Recht sahen und weniger Bereitschaft zur Wiedergutmachung angaben. Zugleich bewerteten sie die bestätigende KI günstiger. Die Arbeit wurde 2026 in Science veröffentlicht; der Versuchsaufbau ist in der offenen Autorenfassung beschrieben. Studie zur Sycophancy, offene Autorenfassung

Damit ist nicht bewiesen, dass Chatbots Persönlichkeitsstörungen verursachen. Aber es gibt einen guten Grund, Zustimmung nicht mit Qualität zu verwechseln.

Ich würde bei einer wichtigen Idee lieber fragen: Welche Annahme ist am schwächsten? Was würde gegen diesen Vorschlag sprechen? Woran könnte ich erkennen, dass ich falschliege?

Auch die Antworten darauf brauchen Prüfung. Ein Sprachmodell wird durch „Sei kritisch“ nicht automatisch zum unabhängigen Gutachter. Es kann den überzeugenden Skeptiker genauso spielen wie den begeisterten Fan.

Glitterball Mind: Eine Idee hätte eigentlich gereicht

„Glitterball Mind“, „Conceptual Glut“ und „StopLessNess“ beschreiben die schillernde, überfüllte und schwer zu beendende Seite der KI-Arbeit.

Nehmen wir ein hypothetisches Projekt: Ich bitte um drei Ansätze für einen Vortrag. Einer gefällt mir. Statt ihn auszuarbeiten, lasse ich weitere Varianten erzeugen. Dann Zielgruppen anpassen. Dann Titel testen. Dann noch einmal die ungewöhnlicheren Ideen verfolgen.

Irgendwann ist die Entscheidung komplizierter als vor dem ersten Prompt. Dafür hat jetzt jede Option eine eigene überzeugende Begründung.

Das ist keine nachgewiesene KI-Störung. Als Beschreibung einer Arbeitsfalle finde ich es ziemlich treffend. Möglichkeiten zu erzeugen und sich für eine zu entscheiden sind eben unterschiedliche Aufgaben.

Eine achtmonatige qualitative Untersuchung in einem US-Technologieunternehmen beschreibt verwandte Veränderungen: Beschäftigte übernahmen zusätzliche Aufgaben, hielten mehrere Arbeitsstränge parallel und dehnten Arbeit in frühere Pausen aus. Die Berkeley-Darstellung berichtet über laufende Forschung aus einem Unternehmen. Das ist ein Hinweis auf mögliche Arbeitsverdichtung, kein allgemeines Gesetz über KI-Nutzung. Berkeley-Bericht

Ich würde deshalb vor dem ersten Prompt festlegen, was am Ende stehen soll. Und wann genug Varianten auf dem Tisch liegen. Sonst ist die KI immer noch bereit, während ich längst eine Pause gebrauchen könnte.

FOFAB: Müsste ich nicht längst weiter sein?

„FOFAB“ steht für Fear of Falling Behind. „UpSkill Sisyphus“ liefert das passende Bild der endlosen Weiterbildung dazu.

Meine praktische Antwort wäre: an der eigenen Aufgabe anfangen.

Was muss ich tatsächlich beherrschen? Was verbessert meine Arbeit? Welche Neuerung löst ein Problem, das ich bisher nicht vernünftig lösen konnte?

Ein Werkzeug zu ignorieren, das für die eigene Arbeit gerade keine Rolle spielt, ist eine mögliche Priorisierung. Ebenso kann Lernen sinnvoll sein, ohne dass aus jeder neuen Version sofort ein Fortbildungsprojekt werden muss.

Das ist meine Empfehlung, keine wissenschaftlich geprüfte Behandlung. Ein Glossarwort erklärt auch noch nicht, ob die Sorge einer Person unbegründet ist. Beruflicher Wandel kann reale Gründe haben. Nur lässt sich die eigene Zukunft schlecht anhand der Anzahl ungelesener KI-Newsletter beurteilen.

Agentic Burgerflipping: Wer arbeitet hier eigentlich für wen?

Eine blaue Pfannenwender-Kelle hebt einen weißen Papierburger vor einer Reihe weiterer Papierburger an.KI-generiert
Automatisiert ist vor allem der Nachschub an Arbeit.

„Agentic Burgerflipping“ ist für mich eine der besten Pointen der Sammlung. Daneben steht mit „Review Theatre“ die unangenehmere Frage, ob Kontrolle tatsächlich stattfindet.

Stellen wir uns einen Arbeitstag vor, an dem ich überwiegend Ergebnisse überfliege, Fehler zurückmelde und auf den nächsten Versuch warte. Am Abend habe ich viel kommuniziert. Ob die Aufgabe erledigt wurde, muss ich erst noch feststellen.

Der Rollenwechsel ist wissenschaftlich beschrieben. Die Human-Factors-Arbeit „Ironies of Generative AI“ diskutiert unter anderem den Wechsel von Produktion zu Bewertung, Unterbrechungen und ungünstig veränderte Arbeitsabläufe. Schnelle Erzeugung garantiert keinen schnellen Gesamtprozess. Ironies of Generative AI

Dabei ist Prüfung keineswegs unqualifizierte Arbeit. Quellen zu beurteilen, Fehler zu finden und Entscheidungen zu verantworten kann anspruchsvoller sein als der erste Entwurf.

Die Frage lautet deshalb: Haben wir dafür Zeit, Können und geeignete Prüfmittel eingeplant?

„Vigilance Decrement“ bezeichnet tatsächlich einen älteren Forschungsbegriff: nachlassende Aufmerksamkeit bei längerem Überwachen. Entsprechende Effekte wurden etwa bei automatisierter Flugverkehrskontrolle und beim teilautomatisierten Fahren untersucht. Wie stark sie bei KI-Textreviews auftreten, lässt sich daraus nicht direkt ableiten. Aufmerksamkeitsforschung, Untersuchung zum automatisierten Fahren

Für mich heißt das: Lieber eine Menge erzeugen, die ich ordentlich prüfen kann, als hinterher einen großzügigen Freigabeklick als Qualitätskontrolle auszugeben.

Cognitive Laxity: Hauptsache, die Lösung ist richtig?

Ein weißer Papierstift liegt in einer Hängematte, die zwischen zwei blauen Sprechblasen aufgespannt ist.KI-generiert
Die Lösung fährt bequem mit. Das eigene Verstehen vielleicht auch?

Bei „Cognitive Laxity“ wird die Grafik deutlich zu pauschal. Ausgelagertes Denken ist ein relevantes Thema. Ein allgemeiner Verfall unserer Denkfähigkeit ist damit nicht bewiesen.

Eine CHI-Studie mit 319 Wissensarbeitern untersuchte Selbstauskünfte: Höheres Vertrauen in KI hing mit weniger berichteter kritischer Denkarbeit zusammen. Das Denken verlagerte sich außerdem zur Prüfung und Integration. Eine solche Befragung misst keine dauerhafte Schädigung. Studie zum kritischen Denken

Ein Feldexperiment mit annähernd 1.000 Schülern zeigte einen konkreten Lernnachteil: Eine KI-Hilfe verbesserte zunächst die Mathematikleistung beim Üben. Ohne Hilfe schnitt die Gruppe mit der weniger geschützten Variante anschließend schlechter ab als die Kontrollgruppe. Eine gezielt gestaltete Tutorvariante vermied diesen Nachteil weitgehend. Untersucht wurden kurzfristige Leistungen, keine allgemeinen Langzeitschäden. PNAS-Studie zum Lernen

Deshalb würde ich vor einer Lernaufgabe fragen: Möchte ich die Lösung haben oder anschließend selbst lösen können?

Ein eigener Versuch, Hinweise statt fertiger Antworten und eine weitere Aufgabe ohne Unterstützung können daraus zwei sehr unterschiedliche Arten der KI-Nutzung machen.

Auch kreative Arbeit muss durch KI nicht schlechter werden. In einem Geschichtenexperiment wurden Texte mit KI-Ideen im Durchschnitt kreativer bewertet, insbesondere bei zuvor weniger kreativen Teilnehmenden. Gleichzeitig ähnelten sich die Ergebnisse stärker. Ein Qualitätsgewinn bei dieser Aufgabe ist möglich, ohne damit dauerhafte kreative Fähigkeiten nachgewiesen zu haben. Studie zu Kreativität und Vielfalt

Claudependency: Ich frage nur noch kurz die KI

„Claudependency“ und „AI Attachment Disorder“ spielen auf Abhängigkeit und Bindung an. Für die Arbeit finde ich eine einfache Frage hilfreicher als diese Etiketten: Unterstützt mich das Werkzeug beim Entscheiden, oder traue ich mich ohne Rückversicherung immer weniger?

Eine vierwöchige MIT/OpenAI-Untersuchung mit 981 Teilnehmenden erfasste unter anderem Einsamkeit und problematische Nutzung. Die aktualisierte Fassung fand nach statistischer Korrektur keine signifikanten Effekte der zugewiesenen Gesprächsbedingungen. Mehr freiwillige Nutzung hing mit ungünstigeren Ergebnissen zusammen. Die Nutzungsdauer wurde nicht randomisiert, und es gab keine Nichtnutzungsgruppe. Daraus folgt kein sauberer Kausalnachweis. Aktualisierte Studie

Ein Preprint von 2026 liefert zusätzliche experimentelle Hinweise: Übermäßig bestätigende KI verschob die Suche nach persönlichem Rat und ging mit geringerer Zufriedenheit mit menschlichen Interaktionen einher. Langfristige Isolation ist damit nicht abschließend nachgewiesen. Preprint zu KI und Beziehungen

Tägliche Nutzung ist für sich kein Problem. Aufmerksam würde ich werden, wenn menschlicher Widerspruch zunehmend unerträglich wird oder das Gespräch im Chat immer häufiger das Handeln außerhalb ersetzt.

Wo die Satire für mich eine Grenze erreicht

Bei „AI Psychosis“ würde ich die Pointe nicht mitgehen. Technikgläubigkeit ist keine Psychose. Begeisterung und viele Ideen belegen auch keine klinische Manie.

Es gibt allerdings ernst zu nehmende Fallberichte, in denen Chatbots wahnhafte Vorstellungen bestätigten oder verstärkten. Dabei spielten auch Faktoren wie Schlafentzug, Stimulanzien oder andere Substanzen eine Rolle. Solche Fälle zeigen mögliche gefährliche Wechselwirkungen. Sie belegen weder deren Häufigkeit noch, dass KI allein die Erkrankung verursacht hat. Fallbericht zu Psychose, Fallbericht zur manischen Psychose

Bei Realitätsverlust oder einer akuten psychischen Krise braucht es menschliche professionelle Hilfe. Der Chatbot ist keine verlässliche Instanz, um solche Symptome auszuschließen.

Auch „AI Burnout“ würde ich nicht für jeden nervigen KI-Nachmittag verwenden. Die WHO beschreibt Burnout als berufliches Phänomen durch nicht erfolgreich bewältigten chronischen Arbeitsstress, mit Erschöpfung, Distanz oder Zynismus und verminderter beruflicher Wirksamkeit. WHO-Definition

Und die politischen Etiketten der Grafik? Die kann man diskutieren. Urteile über Unternehmen, Umweltfolgen und staatliche Investitionen brauchen allerdings konkrete Argumente. Ein witziger Name nimmt uns diese Arbeit nicht ab.

Limit Gardening: Vielleicht einfach mal aufstehen

Eine blaue Gießkanne gießt auf eine weiße Papierpflanze mit Sprechblasen als Blättern; daneben liegt ein geschlossener Papier-Laptop.KI-generiert
Token alle. Zeit, die echten Pflanzen zu gießen.

„Token Lych“ und „Limit Gardening“ gehören für mich eindeutig in die Abteilung Alltagssatire. Ein Nutzungslimit erreicht zu haben sagt wenig darüber, ob die eigene Arbeit sinnvoll war. Eine Pause ist noch keine Verhaltensauffälligkeit.

Vielleicht brauchen wir auch gar nicht für jede KI-Gewohnheit einen neuen Begriff. Mir reichen zunächst vier Fragen:

  1. Bin ich weitergekommen? Gibt es ein Ergebnis, das mein ursprüngliches Problem löst?
  2. Verstehe ich es? Kann ich die wichtigen Annahmen und Grenzen erklären?
  3. Hat es insgesamt geholfen? Sind Prüfung und Nacharbeit mitgerechnet?
  4. Kann ich jetzt aufhören? Oder suche ich gerade nur die nächste angenehme Runde im Chat?

Ich möchte die Möglichkeiten von KI nutzen. Dazu gehört für mich auch, gelegentlich eine gute Idee liegen zu lassen, einen mittelmäßigen Versuch abzubrechen und den Rechner zu schließen.

Selbst wenn das Sprachmodell bestimmt noch eine spannende Anschlussfrage hätte.

Abonniere das AFAIK-Update

KI verstehen. Fundiert entscheiden. Wirksam umsetzen.

Im AFAIK-Update teile ich meine Einordnungen und Erfahrungen zu KI im Unternehmen: von Strategie und sinnvollen Anwendungsfällen über die Auswahl passender Lösungen bis zur praktischen Umsetzung. Kostenlos, persönlich und mit einem klaren Blick auf Chancen und Grenzen.

Keine Sorge, ich mag Spam genauso wenig wie Du und gebe Deine Daten niemals weiter! Du bekommst höchstens einmal pro Monat eine E-Mail von mir. Versprochen.

Kai Spriestersbach

Geschrieben von

Ich bin Kai Spriestersbach, M.Sc. in Web Science. Ich verbinde Forschung zu generativer KI mit Erfahrung als Head of AI, technischer Entwicklung und unternehmerischer Praxis.

Als externer Head of AI und in abgegrenzten Projekten unterstütze ich Unternehmen bei Strategie, Technologieauswahl und Umsetzung. Auf AFAIK teile ich wissenschaftliche Quellen, technische Erfahrungen und nachvollziehbare Einschätzungen – mit ihren Möglichkeiten, Grenzen und offenen Fragen.

Mehr über Kai