Transcribbit-Frosch-Maskottchen neben einer Sprechblase und einem aufgeschlagenen Notizbuch, als Sinnbild für gesprochenes und geschriebenes Gedächtnis
Forschung
9 min read

Gesprochenes vs. geschriebenes Gedächtnis: Was stimmt wirklich

Von Kyle RProduct

Gesprochenes vs. geschriebenes Gedächtnis im Faktencheck: Die berühmten Prozentzahlen zum Lesen und Hören sind erfunden. Echte Studien zum Modalitätseffekt.

Du kennst wahrscheinlich die Behauptung, gesprochenes vs. geschriebenes Gedächtnis lasse sich sauber in eine Pyramide packen: Wir würden uns angeblich an 10 % des Gelesenen erinnern, an 20 % des Gehörten und an 90 % dessen, was wir selbst tun. Das ist eine der meistzitierten Statistiken in Unternehmensschulungen, und eine Untersuchung von vier Forschern aus dem Jahr 2014 fand hinter keiner dieser Zahlen auch nur eine einzige Studie [1].

Die echte Forschung ist unordentlicher, aber nützlicher. Bei den letzten Punkten einer Liste, die du gerade gehört hast, gewinnt das Gesprochene mit knappem Vorsprung, und das nur für ein paar Sekunden. Bei fast allem anderen, vor allem bei Dingen, die du später nachschlagen, durchsuchen oder darauf reagieren musst, schlägt ein schriftlicher Text jede Aufnahme, die du nur von vorn abspielen kannst.

Dieser Beitrag erklärt die echte Kognitionsforschung: den Modalitätseffekt, den Produktionseffekt und warum ein Transkript besser ist als erneutes Anhören.


Gesprochenes vs. geschriebenes Gedächtnis auf einen Blick

FrageKurze Antwort
Ist die Pyramide mit "10 % Lesen, 20 % Hören" echt?Nein, keine nachweisbare Studie stützt sie [1]
Hat Gesprochenes überhaupt einen echten Gedächtnisvorteil?Ja, kurzzeitig, bei den letzten Punkten einer Liste (Rezenzeffekt) [2][3]
Hält dieser Vorteil an?Nein, er verschwindet innerhalb von Sekunden, sobald die Aufmerksamkeit abwandert [4]
Was gewinnt bei verzögertem Abruf?Geschriebener Text, in kontrollierten Tests [5]
Warum hält Text sich langfristig besser?Du kannst nachlesen, durchsuchen und dich selbst abfragen; Gesprochenes verschwindet, sobald es gesagt ist
Hilft es auch, Dinge laut zu sagen?Ja, moderat, innerhalb einer einzigen Lernsitzung [7]

Die Pyramiden-Statistik, die du kennst, ist erfunden

Die "10/20/90"-Grafik, oft als Kegel oder Pyramide dargestellt, wird meist Edgar Dales "Kegel der Erfahrung" von 1946 zugeschrieben. Dale selbst hat seinem Kegel nie Prozentzahlen zugeordnet. Die Zahlen wurden Jahrzehnte später von unbekannter Hand angeheftet, und jede Version weicht bei den genauen Werten leicht ab, was schon für sich genommen verdächtig ist: Echte experimentelle Daten runden sich nicht so ordentlich auf Vielfache von fünf und zehn.

Dean Subramony, Michael Molenda, Anthony Betrus und Will Thalheimer haben die Geschichte der Grafik 2014 in einer Sonderausgabe von *Educational Technology* zurückverfolgt und kamen zu dem Schluss, dass hinter keiner Version davon eine Forschungsgrundlage steht [1]. Deshalb verwenden wir sie hier nicht. Stattdessen stützt sich dieser Artikel auf benannte Studien, die du selbst nachschlagen kannst.


Was der Modalitätseffekt wirklich besagt

Der Modalitätseffekt ist der echte, geprüfte Befund, der sich hinter dem Mythos verbirgt: Ob du eine Liste von Punkten hörst oder liest, verändert, wie gut du sie später abrufen kannst, und der Effekt ist bei den letzten Punkten am stärksten.

Catherine Penney hat diese Forschung 1989 in *Memory & Cognition* zusammengefasst und ein Modell mit zwei getrennten Verarbeitungswegen für gesprochene und geschriebene Wörter vorgeschlagen, jeder mit eigenen Eigenschaften [2]. In ihrem Modell hinterlässt ein gesprochenes Wort eine kurze akustische Spur, die noch einen Moment nach dem Hören bestehen bleibt, was erklärt, warum die letzten Punkte einer gehörten Liste oft leichter zurückkommen als die letzten Punkte einer still gelesenen Liste [2].

Das ist die gesamte Grundlage dafür, dass Gesprochenes "gewinnt". Es ist real, und es ist eng begrenzt.


Warum die letzten gehörten Dinge kurzzeitig hängenbleiben

Bennet Murdock hat das 1962 mit der klassischen seriellen Positionskurve dargestellt: Menschen erinnern sich gut an die ersten und die letzten Punkte einer Liste, die Mitte fällt schlechter aus, unabhängig von der Listenlänge [3]. Punkte am Anfang werden ins Langzeitgedächtnis eingeübt. Punkte am Ende sitzen beim Abruf noch im Kurzzeitspeicher, weshalb sie so leicht zurückkommen.

Murray Glanzer und Anita Cunitz zeigten, wie zerbrechlich dieser Vorteil am Listenende ist. 1966 ließen sie Versuchspersonen vor dem Abruf ein paar Sekunden rückwärts zählen, und das allein löschte den Recency-Vorteil, während die früheren Punkte erhalten blieben [4]. Die zuletzt gehörten Dinge waren nicht generell aus dem Gedächtnis verschwunden, sie waren aus einem Kurzzeitspeicher verschwunden, den schon ein paar Sekunden Ablenkung leeren können.

Genau das ist der Haken bei Sprachnachrichten und Meetings. Sobald deine Aufmerksamkeit abwandert, verschwindet der Teil der Nachricht, an den du dich sonst am besten erinnern würdest.


Wo geschriebener Text die Nase vorn hat

Sobald man über die ersten Sekunden nach dem Hören hinausblickt, kippt der Vorteil. In einer separaten Arbeit von 1989 im *Quarterly Journal of Experimental Psychology* testete Penney nicht den unmittelbaren, sondern den verzögerten Abruf und die Wiedererkennung, und visuelle Präsentation schlug auditive Präsentation in all ihren Bedingungen. Der Titel der Arbeit sagt es unverblümt: visuell ist besser als auditiv [5].

Ein schriftlicher Text bleibt bestehen. Du kannst langsamer werden, einen Absatz zurückspringen und die eine Zeile nachlesen, die du verpasst hast, nichts davon erlaubt ein fortlaufender Redestrom. Diese Lücke ist gut dokumentiert in Forschung, die Lesen und Hören im Hinblick auf Erinnerungsleistung und Verständnis vergleicht, die zeigt: Lesen hat einen echten Vorteil, sobald der Stoff länger oder komplexer wird.

Nachlesen hilft aber nur, wenn du auch etwas mit dem Stoff anfängst. Henry Roediger und Jeffrey Karpicke zeigten, dass Selbsttests zum Lernstoff langfristig zu besserer Erinnerung führen als das bloße erneute Lesen desselben Stoffs [6]. Ein schriftlicher Text macht diese Art von aktivem Abruf überhaupt erst möglich. Eine Sprachnachricht, die du schon einmal gehört hast, bietet dir nichts, woran du dich abfragen könntest, ohne die ganze Nachricht erneut abzuspielen.


Warum lange Sprachnachrichten so schwer im Kopf zu behalten sind

Hier hört gesprochenes vs. geschriebenes Gedächtnis auf, eine akademische Frage zu sein, und fängt an, dich Zeit zu kosten.

Eine fünfminütige Sprachnachricht dauert fünf Minuten, egal wie schnell du lesen kannst, und du kannst sie nicht überfliegen, durchsuchen oder zu der Stelle springen, die zählt. Verpasst du einen Namen oder ein Datum in der Mitte, bleibt dir nur, von vorn anzufangen. Das ist eine direkte, praktische Folge davon, dass Sprache flüchtig ist: Ohne Aufnahme und Transkription existiert eine gesprochene Information nur für den Moment, in dem sie gesprochen wird.

Genau deshalb sind Empfängerinnen und Empfänger langer, unstrukturierter Sprachnachrichten häufig schlechter dran, nicht besser: Wer die Nachricht sendet, konnte die eigenen Gedanken einmal laut ordnen, wer sie empfängt, muss diese Struktur aus einem einzigen Durchgang rekonstruieren, der sich nicht überfliegen lässt. Ein schriftliches Transkript macht aus derselben Nachricht etwas, das du überfliegen, nach einem Stichwort durchsuchen und eine Woche später wiederfinden kannst.

Wenn du regelmäßig lange Sprachnachrichten bekommst, auf die du reagieren musst, ist das der Entscheidungspunkt: jedes Mal erneut von vorn anhören oder die Nachricht einmal in Text umwandeln und in einem Bruchteil der Zeit lesen. Transcribbit macht Letzteres kostenlos, bis zu 50 Transkriptionen im Monat. Jetzt kostenlos starten.


Der Produktionseffekt: Auch lautes Sprechen hilft

Es gibt noch einen echten, wenn auch engeren Vorteil des Sprechens, der die Bilanz für schriftliche Aufzeichnungen ergänzt.

Colin MacLeod und Kollegen benannten den Produktionseffekt 2010: Wörter, die beim Lernen laut gelesen werden, bleiben besser im Gedächtnis als dieselben Wörter, die still gelesen werden, wahrscheinlich weil das laute Aussprechen eine zusätzliche, unterscheidbare Spur bei der Enkodierung erzeugt [7]. Der Effekt zeigt sich zuverlässig innerhalb einer einzigen Lernliste, in der die laut gesprochenen Punkte sich von den still gelesenen abheben.

Der Mechanismus dahinter ist noch umstritten. Eine Analyse von Daniel Algom und Kollegen aus dem Jahr 2014 argumentierte, dass sich hinter "Unterscheidbarkeit" tatsächlich mindestens zwei getrennte Effekte verbergen, die nicht immer zusammenpassen [8]. Betrachte den Produktionseffekt also als real, aber noch nicht vollständig erklärt.

Nichts davon widerspricht dem oben beschriebenen Vorteil von schriftlichem Text. Am stärksten ist meist eine Kombination: ein schriftlicher Text, mit dem du dich auch aktiv auseinandersetzt, weder ein stilles Überfliegen noch eine Aufnahme, die du nur einmal hörst.


Häufig gestellte Fragen

Merkt man sich Gehörtes oder Gelesenes besser?

Das kommt darauf an, was gemessen wird. Bei den letzten Punkten einer Liste, die unmittelbar danach abgerufen werden, hat Gehörtes einen kleinen, echten Vorteil (den Modalitätseffekt) [2][3]. Bei allem, was nach einer Verzögerung abgerufen wird, schnitt geschriebene Präsentation in kontrollierten Tests besser ab [5]. Kurz gesagt: Gesprochenes gewinnt einen engen, kurzlebigen Wettbewerb, und Text gewinnt den, der für das eigentliche Behalten zählt.

Stimmt die Aussage, wir würden uns an 10 % des Gelesenen erinnern?

Nein. Sie stammt aus einer Grafik, hinter deren Zahlen keine nachweisbare Forschung steht, wie eine Untersuchung aus dem Jahr 2014 zur Herkunft der Grafik dokumentiert [1]. Behandle jede konkrete Prozentzahl zu Lesen, Hören oder "Tun" als unbelegt, solange sie sich nicht auf eine benannte Studie stützt.

Was ist der Modalitätseffekt im Gedächtnis?

Das ist der Befund, dass es die Erinnerungsleistung verändert, ob Informationen über das Ohr oder über das Auge ankommen, besonders bei den zuletzt präsentierten Punkten einer Liste, die bei Gehörtem besser abgerufen werden als bei Gelesenem [2]. Der Effekt verschwindet innerhalb von Sekunden, sobald die Aufmerksamkeit abwandert [4].

Warum sind Sprachnachrichten so schwer präzise zu merken?

Weil Sprache flüchtig ist. Ist ein gesprochener Satz vorbei, ist er weg, sofern er nicht aufgenommen wird, du kannst ihn also nicht wie einen Satz auf Papier noch einmal überfliegen. Eine lange Sprachnachricht nimmt dir außerdem die Möglichkeit, vorzuspringen oder nach einem Namen oder Datum zu suchen, was geschriebener Text von Haus aus erlaubt.

Hilft es, etwas laut vorzulesen, um es sich zu merken?

Oft ja, mit Einschränkungen. Der Produktionseffekt zeigt, dass laut gelesene Wörter beim Lernen besser abgerufen werden als still gelesene, ein Effekt, den MacLeod und Kollegen benannt haben [7]. Es ist ein echter, aber moderater Vorteil, und Forscher sind sich noch uneinig, warum genau er auftritt [8].

Ist erneutes Lesen der beste Weg, sich etwas zu merken?

Nicht der beste, nein. Roediger und Karpicke fanden heraus, dass Selbsttests zu einem Stoff das bloße erneute Lesen für die langfristige Erinnerung schlagen [6]. Ein schriftlicher Text ist vor allem deshalb wertvoll, weil du dich daran abfragen kannst, nicht nur, weil du ihn zweimal ansiehst.


Fazit

Gesprochenes vs. geschriebenes Gedächtnis hat keinen einzigen Sieger, aber es ist auch kein Münzwurf. Sprache hat einen echten Vorteil: Die letzten Dinge, die du hörst, sind für ein paar Sekunden ungewöhnlich leicht abrufbar. Mehr ist es nicht. Sobald eine Verzögerung ins Spiel kommt, sobald du etwas nachschlagen, durchsuchen oder darauf reagieren musst, leistet ein schriftlicher Text durchgängig mehr für dich als jede Aufnahme.

Genau das spricht dafür, gesprochene Inhalte in Text umzuwandeln. Mittlerweile werden täglich Milliarden Sprachnachrichten verschickt, 7 Milliarden am Tag allein auf WhatsApp nach Angaben des Unternehmens selbst, und die meisten davon werden einmal gehört und dann so vergessen, wie es die oben beschriebene Forschung vorhersagt. Ein Transkript macht aus einer Nachricht, die man nur einmal hört, etwas, das man tatsächlich behalten kann.

Transcribbit verwandelt weitergeleitete WhatsApp-Sprachnachrichten in sauberen, durchsuchbaren Text in über 50 Sprachen, kostenlos für bis zu 50 Transkriptionen im Monat, ohne dass danach Audio gespeichert bleibt. Jetzt kostenlos starten.


Quellen

  1. The Mythical Retention Chart and the Corruption of Dale's Cone of Experience (Subramony, Molenda, Betrus & Thalheimer, 2014, Educational Technology, 54(6), 6-16) - worklearning.com
  2. Modality effects and the structure of short-term verbal memory (Penney, 1989, Memory & Cognition) - link.springer.com
  3. The serial position effect of free recall (Murdock, 1962) - semanticscholar.org
  4. Two storage mechanisms in free recall (Glanzer & Cunitz, 1966) - semanticscholar.org
  5. Modality Effects in Delayed Free Recall and Recognition: Visual is Better than Auditory (Penney, 1989, Quarterly Journal of Experimental Psychology) - journals.sagepub.com
  6. The Power of Testing Memory (Roediger & Karpicke, 2006) - psychnet.wustl.edu
  7. The Production Effect: Delineation of a Phenomenon (MacLeod, Gopie, Hourihan, Neary & Ozubko, 2010, JEP: LMC) - uwaterloo.ca
  8. The production effect in memory: multiple species of distinctiveness (Algom et al., 2014, Frontiers in Psychology) - pmc.ncbi.nlm.nih.gov

Weitere Forschung und Beiträge von Transcribbit: https://transcribbit.io/blog