ISTARIUM

CONTEXT Steuerung

KI-Flüsterpost: warum die Prosa das eigentliche Problem ist

Ein Programm formuliert aus, ein zweites fasst zusammen, und dazwischen fällt der Inhalt heraus. Unser Vorschlag: kurze Nachrichten statt ausformulierter Prosa.

Michael Mai

Wer heute eine Mail schreibt, lässt sie sich oft von einem Programm ausformulieren. Wer sie bekommt, lässt sie sich von einem Programm zusammenfassen. Aus 1 Satz werden 3 Absätze, und aus 3 Absätzen wird wieder 1 Satz.

Wo geht dabei die Bedingung verloren, die im Nebensatz stand? Wer bezahlt den Verlust, wenn der Absender Zeit spart und beim Empfänger Prüfarbeit anfällt? Und was hilft dagegen?

Unsere Antwort ist unbequem: Die schön ausformulierte Prosa ist selbst das Problem. Sie erzeugt erst die Textmenge, die am anderen Ende wieder eingedampft wird. Wir schlagen kurze Nachrichten vor: 1 bis 3 Sätze mit der Entscheidung, der Zahl und der Bedingung. 2 Einschränkungen gehören dazu. Gemessen hat diesen Verlust bisher niemand, und eine Absprache gegen Höflichkeitsfloskeln hat es schwer.

KI-Flüsterpost. Das Kinderspiel kennt jeder, mancherorts heißt es Stille Post: Ein Satz wird von Ohr zu Ohr geflüstert, und am Ende steht etwas anderes da als am Anfang. In der Berufswelt kommen wir diesem Spiel deutlich näher, als den meisten von uns bewusst ist. Wer heute eine Mail schreibt, lässt sie sich oft von einem Programm ausformulieren. Wer sie bekommt, lässt sie sich von einem Programm zusammenfassen. Aus 1 Satz werden 3 Absätze, und aus 3 Absätzen wird wieder 1 Satz. Dazwischen liegen 2 Übersetzungen, und bei jeder fällt etwas heraus: die Bedingung im Nebensatz, die Zahl aus dem Anhang, der Vorbehalt vor der Zusage. Wo genau entsteht dieser Verlust, und wer bezahlt ihn? Unsere Antwort darauf steht am Ende dieses Textes und ist unbequem: Das Problem ist die Prosa selbst.

2 Rechnungen, die beide stimmen

Beim Schreiben zeigt künstliche Intelligenz ihren greifbarsten Nutzen im Büroalltag. Gemeint sind in diesem Text Programme, die auf Zuruf Text erzeugen. Man sagt ihnen in normaler Sprache, worum es geht, und bekommt einen fertigen Absatz zurück. Das Meinungsforschungsinstitut Gallup befragte im Mai 2026 rund 22.500 erwerbstätige US-Amerikaner: 52 Prozent nutzen solche Programme im Job, und unter ihnen steht Schreiben und Redigieren mit 51 Prozent an erster Stelle. Die interessantere Frage liegt jedoch eine Ebene tiefer. Was geschieht, wenn an beiden Enden derselben Nachricht ein Werkzeug sitzt? Wer gewinnt dabei Zeit, und an welcher Stelle wird sie wieder ausgegeben?

Die Zahlen zum Nutzen und die Zahlen zum Aufwand widersprechen sich weniger, als es zunächst aussieht: Sie messen verschiedene Enden derselben Nachricht. Beim Senden berichten Beschäftigte durchweg Gewinn.

  • Gallup, Mai 2026: 68 Prozent derer, die KI zum Schreiben und Redigieren einsetzen, berichten davon einen Produktivitätsgewinn. Gemeint sind also die Nutzenden dieser einen Anwendung und keine Aussage über alle KI-Nutzenden.
  • Microsoft Work Trend Index 2026: 66 Prozent der befragten Nutzenden sagen, KI verschaffe ihnen mehr Zeit für hochwertige Arbeit.
  • US-Statistikamt: 31 Prozent derer, die in der Vorwoche KI genutzt haben, erledigten Aufgaben 1 bis 2 Stunden schneller. Erhoben wurde das im März 2026 und veröffentlicht im August. Bei einer Technik, deren Verbreitung sich halbjährlich verschiebt, sind diese 5 Monate Abstand erwähnenswert.

Ein Wort zur Belastbarkeit solcher Angaben, bevor die Gegenrechnung kommt. Fast alles, was zu diesem Thema veröffentlicht wird, ist Selbstauskunft: Jemand wird gefragt und schätzt seinen eigenen Zeitgewinn selbst. Mit der Stoppuhr hat das niemand nachgemessen. Das betrifft das ganze Feld und ist keine Schwäche einer einzelnen Studie.

Dazu kommt die Fehlermarge. Eine Befragung erwischt immer nur einen Ausschnitt aller Betroffenen, und schon dieser Zufall bewegt das Ergebnis. Bei rund 1.000 Befragten schwankt ein Wert allein dadurch um etwa 3 Prozentpunkte nach oben oder unten. Ein Prozentpunkt ist dabei schlicht der Abstand zwischen 2 Prozentwerten, von 40 auf 38 sind es also genau 2 Punkte. Ein Unterschied von 2 Punkten zwischen 2 Befragungen sagt damit noch gar nichts. Man liest solche Zahlen am besten so, wie eine Meisterin die Stundenzettel ihrer Truppe liest: brauchbar für die Richtung, ungenau in der zweiten Stelle.

Beim Empfangen kippt das Vorzeichen. Für eine Befragung aus dem Winter 2025 auf 2026 antworteten 2.500 Wissensarbeitende und IT-Verantwortliche aus 10 Ländern, unter ihnen Deutschland, Österreich und die Schweiz. Wissensarbeit meint dabei jede Tätigkeit, die vor allem aus Lesen, Entscheiden und Schreiben besteht. Die Befragung nennt 3 Befunde:

  • 77 Prozent sagen, KI-erzeugte Arbeit brauche mehr Prüfzeit als von Menschen erstellte.
  • 66 Prozent sagen, das Prüfen fremder KI-Texte erzeuge zusätzliche Arbeit für sie.
  • 43 Prozent haben KI-erzeugte Inhalte verwendet, obwohl sie vermuteten, dass diese minderwertig oder fehlerhaft sein könnten.

Diese Zahlen tragen eine Einschränkung im Fuß. Auftraggeber der Erhebung ist ein Anbieter, der Telefonie, Zusammenarbeit und Fernwartung über das Internet verkauft. Er verkauft also Software für genau dieses Problem. Und geantwortet haben die Befragten über sich selbst.

Denselben Effekt misst eine bekanntere Untersuchung unter dem Begriff Workslop. Gemeint ist KI-Text, der ordentlich aussieht und die eigentliche Arbeit weiterreicht: fertig formatiert, flüssig formuliert, inhaltlich ungeklärt. Wer ihn bekommt, macht die Denkarbeit, die der Absender sich gespart hat. Rund 1.100 US-Beschäftigte antworteten im September 2025, wobei die Veröffentlichungen mal 1.004 und mal 1.150 Befragte nennen. 40 Prozent hatten im Vormonat solchen Text bekommen, und je Fall gaben sie knapp 2 Stunden Nacharbeit an. Die Forscher rechnen daraus 186 US-Dollar je Beschäftigtem und Monat hoch. Diese Summe entsteht aus 2 Schätzungen der Befragten selbst: geschätztes Gehalt mal geschätzte Zeit. Getragen wird die Untersuchung von einem Anbieter für KI-gestütztes Coaching zusammen mit einem Universitätslabor. Wer das Problem beschreibt, verkauft hier auch die Lösung, und das gehört bei jeder Zahl daraus mitgelesen.

Eine zweite Welle derselben Gruppe aus dem Jahr 2026 zeigt, wie vorsichtig man mit solchen Zahlen umgeht: 962 Befragte, 38 Prozent Betroffene, 3,4 Stunden Überarbeitung pro Monat. Die Verbreitung ist damit gegenüber 2025 nicht gestiegen. Von einem Rückgang zu sprechen, ginge allerdings ebenfalls zu weit: Der Abstand von 40 auf 38 Prozent liegt innerhalb der Fehlermarge. Für 2025 wurden je nach Veröffentlichung zudem 40 oder 41 Prozent berichtet. Die Einheit hat außerdem gewechselt, denn 2025 waren es knapp 2 Stunden je Vorfall und 2026 sind es 3,4 Stunden je Monat. Die Berichterstattung hat daraus eine Steigerungsgeschichte gebaut. Ein zulässiger Vergleich ist das jedoch nicht, so wenig wie sich Stunden je Auftrag mit Stunden je Monat verrechnen lassen.

Wie groß die Fläche ist, auf der das alles wirkt, zeigt als einzige Angabe in dieser Reihe eine Messung statt einer Befragung. Ein Sonderbericht des Microsoft Work Trend Index vom Juni 2025 hat dafür die tatsächliche Nutzung der eigenen Bürosoftware ausgewertet, also mitgezählt statt nachgefragt: Im Mittel gehen je Beschäftigtem und Arbeitstag 117 E-Mails und 153 Chatnachrichten ein. Gültig ist das für Postfächer bei diesem einen Anbieter. Eine deutsche Befragung, veröffentlicht im Januar 2026, kommt auf 53 berufliche Mails am Tag. 14 Prozent der berufstätigen Befragten bekommen 100 oder mehr.

Der Abstand zwischen 117 und 53 ist ein Messunterschied und kein Länderunterschied. Die automatische Zählung erfasst jede eingehende Nachricht, samt Benachrichtigungen und Verteilerpost. Die Befragten dagegen schätzen, was sie bewusst wahrnehmen. Es ist derselbe Unterschied wie zwischen dem Zählwerk an der Maschine und dem, was der Bediener am Abend aus dem Kopf meldet. Beide Zahlen stimmen, sie zählen nur Verschiedenes. Jede dieser Nachrichten ist eine mögliche Stelle, an der ein Werkzeug mitliest oder mitschreibt. Die eigentliche Botschaft dieser Zahlenlage ist angenehm einfach: Dieselben Menschen berichten Gewinn beim Senden und Verlust beim Empfangen. Wer diese 2 Seiten getrennt betrachtet, kann an der richtigen Stelle ansetzen.

Der Beginn der Desinformation

Der Vorgang dauert keine 5 Minuten und hat 3 Schritte.

  1. Ein Absender hat einen einzigen Inhaltssatz im Kopf, etwa dass ein Liefertermin um 2 Wochen rutscht. Er gibt diesen Satz einem Assistenten, also einem Programm, das auf Zuruf Text erzeugt. Daraus lässt er eine höfliche Mail machen.
  2. Die Mail geht raus: 3 Absätze, mit Einleitung, Begründung und Dank.
  3. Der Empfänger sieht 3 Absätze in einem vollen Postfach und lässt sie sich in einem Satz zusammenfassen.

Am Anfang stand 1 Satz, am Ende steht 1 Satz. Dazwischen liegen 2 Übersetzungen, und bei jeder fällt etwas heraus. Im Spiel Stille Post ist genau das der Witz. In der Geschäftskorrespondenz ist es eine Frage der Verbindlichkeit: der Nebensatz mit der Bedingung, die Zahl aus dem Anhang, der Zusatz „vorbehaltlich der Freigabe". Es ist derselbe Verlust wie bei der Kopie einer Kopie. Jeder einzelne Durchgang sieht sauber aus, und trotzdem ist am Ende etwas weg: KI-Flüsterpost.

Was die Forschung zeigt, und was sie offen lässt

Eine Arbeit aus dem Jahr 2025 trägt den Namen des Spiels im Titel. Forscher schickten je 150 Texte durch 100 Durchläufe und prüften nach jeder Runde, wie viele Aussagen darin noch zutreffen. Ein Durchlauf ist dabei eine einzige Weitergabe: Text hinein, umgeformter Text heraus. Der Wert sinkt stetig, und die Verluste addieren sich von Runde zu Runde.

Entscheidend für unseren Fall ist eine Nebenprüfung. Forscher nehmen dabei eine einzelne Zutat aus dem Versuch heraus und schauen, ob der Effekt auch ohne sie bleibt. Es ist dieselbe Logik, mit der eine Meisterin einen Arbeitsschritt weglässt. Sie will sehen, woher der Ausschuss wirklich kommt. Weggelassen wurde hier die auffälligste Zutat, nämlich der Sprachwechsel. Der Text wurde also nur noch umformuliert, in derselben Sprache und mit der ausdrücklichen Anweisung, die Bedeutung vollständig zu erhalten. Der Verfall blieb trotzdem. Genau darum geht es hier. Ein Assistent formuliert eine Mail aus, und ein zweiter fasst sie zusammen. Beide tun nichts anderes als umformulieren.

2 Einschränkungen gehören in denselben Abschnitt. Die erste betrifft die Größenordnung. Gemessen wurden 100 Durchläufe und keine 2. Am steilsten fällt die Kurve dort, wo die Kette am kompliziertesten ist, nämlich bei 5 beteiligten Sprachen. Die Richtung ist damit belegt, die Größenordnung lässt sich jedoch nicht übertragen. Wer den Absturz nach 10 Durchläufen in einen Mailwechsel umrechnet, lügt mit korrekten Zahlen.

Die zweite Einschränkung betrifft die naheliegende Vermutung, 2 verschiedene Programme in einer Kette richteten mehr Schaden an als eines. Diese Arbeit beantwortet sie uneinheitlich. In den Übersetzungsketten verschärfte die Kombination mehrerer Programme die Verzerrung bei einer Sprache und dämpfte sie bei einer anderen. Im reinen Umformulieren, also in unserem Fall, fiel die Kurve mit mehreren beteiligten Programmen dagegen steiler als mit einem und mit dreien am steilsten. Fachleute sagen zu einem solchen Programm Modell, gemeint ist immer dasselbe: die Maschine, die aus Text neuen Text macht. Für die Konstellation „mein Werkzeug schreibt, dein Werkzeug fasst zusammen" ist das ein Hinweis und keine Messung. Wir schreiben die Frage hier ausdrücklich als offen aus.

2 weitere Arbeiten stützen die Richtung.

  • Eine Studie von 2025 über Übertragungsketten zwischen Modellen zeigt: Kleine Verzerrungen, die in einem einzelnen Durchlauf niemandem auffallen, verstärken sich über Wiederholungen. Offene Anweisungen driften deutlich stärker als eng gefasste Aufgaben. Das ist das Argument gegen „schreib das mal freundlich aus".
  • Eine Auswertung von über 200.000 simulierten Gesprächen mit 15 Modellen vergleicht 2 Wege zur selben Information. Simuliert heißt, die Gespräche wurden maschinell nachgestellt statt mit Menschen geführt. Kommt die Information häppchenweise über mehrere Schritte statt auf einmal, fallen die Ergebnisse im Mittel 39 Prozent schlechter aus. Ursache ist weniger fehlende Fähigkeit als wachsende Unzuverlässigkeit: Die Modelle legen sich früh fest und kommen von einem falschen Abzweig kaum zurück. Gemessen ist das an Gesprächen statt an Mailketten. Übertragbar bleibt die Aussage, dass häppchenweise vermittelte Information schlechter durchschlägt.

Eine Arbeit aus der Finanzanalyse benennt 2 Mechanismen, die den Effekt erklären. Sie ist für den Industry Track der EMNLP 2026 angenommen, also für den Praxisteil einer Fachkonferenz zur maschinellen Sprachverarbeitung. Angenommen heißt dabei: Fachkollegen haben sie vor der Veröffentlichung gegengelesen und für tragfähig befunden, ähnlich wie ein Prüfingenieur eine Konstruktion freigibt, bevor gefertigt wird. Der erste Mechanismus heißt Dekontextualisierung: Eine Aussage wird von den einschränkenden Nebensätzen getrennt, die sie im Original begleiten. Im Betrieb ist das der Stückpreis, der ohne die Zeile „gültig ab 500 Stück" weitergereicht wird. Der zweite ist die Abhängigkeit vom Werkzeug, denn verschiedene Zusammenfasser lesen denselben Text verschieden. Das Ergebnis liest sich flüssig und plausibel und verändert trotzdem die Entscheidung dahinter.

Die Wirkung auf den Menschen ist ebenfalls gemessen. Ein Experiment mit 547 Teilnehmenden bewertete Texte nach ihrer Urheberschaft. Fragestellung und Auswertung standen vorher öffentlich fest, damit sich das Ergebnis hinterher nicht zurechtlegen lässt. KI-erzeugte und KI-assistierte Texte gelten den Teilnehmenden als weniger vertrauenswürdig, weniger authentisch und weniger geeignet zur Wissensübernahme. Einer der beiden geprüften Zusammenhänge war ausdrücklich die Arbeits-E-Mail. Gemessen ist damit die Wahrnehmung und kein objektiver Informationsgehalt. Für den Absender ist das trotzdem die unangenehmere Nachricht: Seine Botschaft kommt an und wird weniger ernst genommen.

Bleibt der Befund, der am meisten fehlt. Eine Untersuchung, die genau diese zweischrittige Kette kontrolliert misst und den Verlust in Zahlen fasst, haben wir bei unserer Suche nirgends gefunden. Ehrlich dazu gehört der Hinweis, was das ist und was es nicht ist: ein Suchbefund und kein Nachweis. Ein Fehlen lässt sich grundsätzlich schwer beweisen, und morgen kann eine solche Arbeit erscheinen.

Am nächsten kommt ihr ein Positionspapier vom November 2025. Ein Positionspapier stellt einen Vorschlag zur Diskussion, statt eine Messung zu berichten. Dieses beschreibt unser Bild wörtlich: Absender blasen einfache Gedanken zu wortreichem Text auf, Empfänger lassen ihn wieder zu Zusammenfassungen eindampfen. Untersucht hat es allerdings einen eigenen Gegenvorschlag und nicht die Kette selbst, und auch dessen Ergebnisse nennt es ausdrücklich vorläufig. Die Flüsterpost ist damit eine plausible Hochrechnung aus belegten Einzelteilen und keine gemessene Größe. Genau so steht sie in diesem Artikel.

Der praktische Ertrag ist trotzdem unmittelbar. Der Hebel liegt bei der Zahl der Übersetzungen und nicht bei der Wahl des Werkzeugs: Ein anderes Programm verschiebt den Verlust, der Verzicht auf den Schritt räumt ihn weg. Wer den einen Satz schickt, der ihm ohnehin vorschwebt, spart beiden Seiten die 2 Übersetzungen.

Ein verwandtes Thema bleibt hier bewusst draußen: das Zeichen #NoKI im Betreff, mit dem ein Absender aus Datenschutzgründen verlangt, dass eine einzelne Nachricht gar nicht erst durch ein Werkzeug läuft. In unseren eigenen Programmen filtert ein solches Kürzel seit dem 22. September 2026 jede so gekennzeichnete Mail aus. Dazu erscheint ein eigener Artikel.

Die Prosa ist das Problem

Das Ausklammern einzelner Nachrichten löst einen Teil des Problems, und zwar den Teil, der die Vertraulichkeit betrifft. Der größere Teil bleibt stehen, und er hat mit Geheimhaltung nichts zu tun. Ab hier steht unsere eigene Sicht und kein Befund aus einer Studie.

Das Kernproblem ist die Bequemlichkeit. Eine schön formulierte Mail auf Knopfdruck ist ein gefundenes Fressen für jedermann, und genau deshalb greift jeder danach. Wer früher 10 Minuten an einer höflichen Absage saß, hat sie heute in 20 Sekunden. Der Preis dafür fällt am anderen Ende des Postfachs an.

Unsere These in 1 Satz: Die Prosa ist das Problem. Das Drumherum, das ein Programm erzeugt, macht die Flüsterpost überhaupt erst möglich. Es ist wie eine Anlage, bei der jemand den Bass zu weit aufdreht: Der Text des Liedes läuft weiter mit, hören kann ihn niemand mehr. Die eigentliche Nachricht steht zwischen Einleitung, Begründung und Dank, und dort geht sie unter. Erst diese Menge an Text gibt dem Empfänger überhaupt den Anlass, sie sich wieder zusammenfassen zu lassen.

Die Gegenprobe ist einfach. Würden wir tatsächlich nur harte und klare Einzelaussagen senden, hätten wir dieses Problem gar nicht. „Der Liefertermin rutscht um 2 Wochen auf den 14. Oktober, die Freigabe steht noch aus." Das sind 2 Aussagen in 1 Zeile, und sie überstehen jede Weitergabe unbeschadet. Zusammenfassen lässt sich daran nichts mehr, weil alles Entbehrliche bereits fehlt.

Zurück zur kurzen Nachricht

Daraus folgt unser Vorschlag, und er ist unbequem: zurück zu kurzen und prägnanten Antworten. Denkbar ist sogar eine Konvention im Haus, sich Texte gar nicht erst schreiben zu lassen. Eine Konvention ist dabei eine Absprache, auf die sich alle einlassen. Vergleichbar ist sie mit der Regel, dass Termine ausschließlich im gemeinsamen Kalender stehen. Die Information wird kurz und prägnant hinübergeschoben, ohne Prosa davor und ohne Prosa danach.

Im Alltag hieße das 4 Dinge.

  • Eine Antwort ist 1 bis 3 Sätze lang und enthält die Entscheidung, die Zahl und die Bedingung.
  • Anrede und Dank stehen einmal am Anfang einer Korrespondenz statt in jeder einzelnen Mail.
  • Ausformuliert wird für den Kunden und für den Vertrag, für die interne Abstimmung jedoch nicht.
  • Eine Mail, die schon kurz ist, braucht keine Zusammenfassung. Damit fällt die zweite Übersetzung von selbst weg.

Der Nebeneffekt ist der eigentliche Gewinn. Wer den einen Satz selbst schreibt, muss vorher wissen, was er sagen will. Genau diese Denkarbeit reicht die ausformulierte Mail heute weiter, und am Ende leistet sie der Empfänger.

Ehrlich dazu gehört der Einwand. Eine Konvention, die Höflichkeit abschafft, hat es schwer. Einleitung und Dank sind älter als jede Bürosoftware und sie haben einen Zweck: Sie zeigen Respekt und halten eine Geschäftsbeziehung warm. Eine Mail aus 6 Wörtern liest sich schroff, und beim ersten Kontakt zieht sie womöglich eine Tür zu. Diese Spannung lässt sich schwer auflösen, und wir lassen sie hier bewusst stehen.

Unsere Position dazu ist trotzdem klar. Höflichkeit hängt am Menschen und an der Verlässlichkeit einer Zusage, an der Textmenge hängt sie nicht. Ein kurzer Satz, der stimmt und beim Empfänger keine Nacharbeit auslöst, ist die höflichere Nachricht. Wer diesen Tausch im eigenen Haus vereinbart, gewinnt an beiden Enden des Postfachs: weniger Aufwand beim Schreiben und weniger Prüfarbeit beim Lesen. Und die Nachricht kommt so an, wie sie gemeint war.

Zur Quellenlage. Die Nutzungszahlen stammen von Gallup (Befragung vom 6. bis 20. Mai 2026, 22.573 Beschäftigte, Fehlerspanne 0,9 Prozentpunkte; die 68 Prozent beziehen sich allein auf die Befragten, die KI zum Schreiben und Redigieren einsetzen), dem Microsoft Work Trend Index 2026 und einer Meldung des US-Statistikamts. Deren Daten wurden im März 2026 erhoben und am 11. August 2026 veröffentlicht; die Methodik haben wir selbst nicht geprüft. Die Zahlen zum Mehraufwand kommen aus der Befragung „Pulse of Work in 2026" im Auftrag eines Anbieters für Kommunikation und IT-Support über das Internet sowie aus der Workslop-Untersuchung von BetterUp Labs und dem Stanford Social Media Lab. Beide Auftraggeber verkaufen Lösungen für das Problem, das sie beschreiben. Die Eckdaten der Workslop-Welle 2025 weichen zwischen den Veröffentlichungen ab: Die Primärseite nennt 1.150 Befragte, Sekundärberichte 1.004, und je nach Quelle 40 oder 41 Prozent. Deshalb steht hier „rund 1.100" und „knapp 2 Stunden". Zur Welle 2026 fanden wir nur Medienberichte und keine Primärveröffentlichung; die Steigerungsgeschichte geht auf diesen Bericht und seine Nachdrucke zurück. Der Abstand von 40 auf 38 Prozent liegt bei Stichproben um 1.000 Personen innerhalb der üblichen Fehlermarge von etwa 3 Prozentpunkten, weshalb hier „nicht gestiegen" steht und kein Rückgang behauptet wird. Sämtliche Verbreitungs- und Aufwandszahlen sind Selbstauskunft. Gemessen statt befragt sind allein die 117 E-Mails und 153 Chatnachrichten je Arbeitstag; sie stehen im Sonderbericht „Breaking down the infinite workday" vom 17. Juni 2025 und stammen aus der Nutzungsmessung von Microsoft 365. Die 53 beruflichen Mails am Tag und die 14 Prozent mit 100 oder mehr kommen aus einer telefonischen Bitkom-Befragung (1.002 Personen ab 16 Jahren, darunter 532 berufstätige Internetnutzer, Feldzeit Kalenderwoche 41 bis 46 des Jahres 2025, veröffentlicht am 13. Januar 2026); beide Werte beziehen sich auf die berufstätigen Internetnutzer und sind ebenfalls Selbstauskunft. Der Abstand zwischen 117 und 53 ist deshalb ein Mess- und kein Länderunterschied. Für Deutschland gibt es außerdem Zahlen dazu, in wie vielen Unternehmen Beschäftigte private KI-Werkzeuge einsetzen (604 Unternehmen ab 20 Beschäftigten, telefonisch befragt in den Kalenderwochen 27 bis 32 des Jahres 2025). Das ist eine Unternehmens- und keine Beschäftigtenbefragung, und wie viele Mails per KI geschrieben oder zusammengefasst werden, weist sie ebenso wenig aus wie die übrigen. Die Kettenwirkung stützt sich auf LLM as a Broken Telephone (ACL 2025), When LLMs Play the Telephone Game (ICLR 2025), LLMs Get Lost in Multi-Turn Conversation, eine Arbeit zur Kompression von Finanzanalysen (angenommen für den Industry Track der EMNLP 2026, also fachlich begutachtet) und die Studie von Sahebi, Formosa und Bankins zur Wahrnehmung KI-vermittelter Texte. In der erstgenannten Arbeit fällt der steilste Faktenverfall in Ketten mit 5 beteiligten Sprachen an. Ihr Befund zu mehreren beteiligten Modellen fällt je nach Versuchsteil verschieden aus: In den Übersetzungsketten ist er uneinheitlich, im reinen Umformulieren ohne Sprachwechsel fällt die Kurve mit mehreren Modellen steiler als mit einem. Diese Arbeiten messen 10 bis 100 Durchläufe, Gespräche oder Wahrnehmung. Die hier beschriebene zweischrittige Mailkette ist in keiner davon kontrolliert gemessen, soweit unsere Suche reicht; das ist ein Suchbefund und kein Nachweis. Ein Positionspapier vom November 2025 benennt die Kette wörtlich, untersucht jedoch einen eigenen Gegenvorschlag statt der Kette und nennt dessen Ergebnisse selbst vorläufig. Die Flüsterpost ist damit unsere Hochrechnung aus belegten Einzelteilen. Der Vorschlag, auf ausformulierte Prosa zu verzichten, ist unsere eigene Position. Er stammt von uns und steht in keiner der genannten Arbeiten, und gemessen ist seine Wirkung bislang nicht. Das erwähnte Betreff-Kürzel gegen die Verarbeitung einzelner Mails ist ebenfalls unsere eigene Festlegung und kein Standard; es filtert seit dem 22. September 2026 in unseren Programmen und bekommt einen eigenen Artikel.

CONTEXT ist die Artikelreihe von AI Enabled Executive (AIEE), dem KI-Praxisprogramm der ISTARIUM Consulting Group. Hier wird eingeordnet, damit Sie selbst entscheiden können.

Irrtum und Änderungen vorbehalten. Dieser Artikel dient der Information und stellt keine Rechtsberatung dar. Er ist in Zusammenarbeit mit KI entstanden und wurde redaktionell geprüft.

Alle Artikel ›

Platz verbindlich sichern

AI Enabled Executive

Wir ziehen die Rechnungsinformationen aus dem Impressum.

 AGB & Teilnahmebedingungen (PDF)

Teilnehmer-Login

Ihre Teilnehmernummer steht in Ihrer Willkommens-E-Mail.

Die Anmeldung selbst erfolgt auf Ihrem eigenen KI-Server, nicht hier.

Dokumente

Unterlagen zu AI Enabled Executive als PDF.

Die Dateien werden als PDF geladen.