Direkt zum Inhalt springen
Zähler & Generator
Methodik, Standards & Transparenz

So zählen wir: Methodik & Regeln

Wir glauben an vollständige algorithmische Transparenz. Hier erfährst du im Detail, wie unsere Zähl-Engines Wörter, Zeichen, Sätze, Silben, Lesezeiten und Lesbarkeitsindizes berechnen.

1. Unser Leitbild: 100 % clientseitige Präzision

Während viele Online-Rechner Texte an externe Server übertragen oder unvollständige Hilfsmethoden einsetzen, verfolgt Zähler & Generator einen kompromisslos modernen Ansatz: Sämtliche Zählungen und linguistischen Analysen laufen ausschließlich lokal in deinem Webbrowser ab. Dadurch garantieren wir absolute Vertraulichkeit für sensible Manuskripte, Verträge und private Notizen.

2. Wie wir Zeichen zählen (Grapheme & Unicode)

Ein zentrales Problem vieler Zähler ist die veraltete Zählung nach JavaScript-Speichereinheiten (UTF-16 Code-Units). Zeichen wie Emojis oder historische Zeichen belegen intern 2 bis 8 Code-Units. Ein Emoji wie 👋🏽 würde bei primitiven Zählern als 2 oder 4 Zeichen gezählt werden.

Unsere Engine verwendet stattdessen den offiziellen Standard Intl.Segmenter(..., { granularity: 'grapheme' }). Wir zählen Graphem-Cluster – das bedeutet: Was für das menschliche Auge als ein einziges sichtbares Schriftzeichen wahrnehmbar ist, zählt exakt als ein Zeichen.

  • Zeichen mit Leerzeichen: Alle Grapheme inklusive regulärer Leerzeichen, geschützter Leerzeichen ( ), Tabulatoren und Zeilenumbrüchen.
  • Zeichen ohne Leerzeichen: Alle Grapheme nach vollständiger Bereinigung sämtlicher Unicode-Whitespace-Klassen (\s+).

3. Wie wir Wörter zählen (Standard nach Microsoft Word)

Um größtmögliche Verlässlichkeit und 100%ige Übereinstimmung mit branchenüblichen Textverarbeitungsprogrammen zu gewährleisten, folgt unser Wortzähler der Microsoft-Word-Zählmethode (Whitespace-Delimited Tokens).

  • Whitespace-Grenzen: Jedes durch Leerzeichen, Zeilenumbrüche oder Tabulatoren getrennte Token zählt als eigenständiges Wort. Satzzeichen an den Worträndern werden ausschließlich für die Keyword-Dichte-Tabelle bereinigt, niemals für die eigentliche Wortzählung.
  • Freistehende Zeichen & Gedankenstriche: Alleinstehende Zeichen wie „-“, „–“, „—“, „&“, „§“, „%“ oder sonstige Symbole zählen als vollwertige Wörter, exakt wie in Microsoft Word (z. B. zählt „a - b“ als 3 Wörter und ein einzelner Gedankenstrich „—“ als 1 Wort).
  • Bindestriche & Schrägstriche: Begriffe mit internen Bindestrichen oder Schrägstrichen wie „hydration/duplicated-text“, „Chrome-translated“ oder „Mund-zu-Mund-Beatmung“ zählen standardmäßig als genau 1 Wort – exakt wie in Microsoft Word.
  • Alleinstehende Symbole & Kaufmanns-Und (&): Ein freistehendes Ampersand („&“) sowie alleinstehende Währungs-, Rechen- oder Rechtszeichen („€“, „§“, „%“, „+“) werden als eigenständiges Wort gezählt (z. B. zählt „Zähler & Generator ist dein Werkzeug“ als genau 6 Wörter).
  • Optionale Komposita-Zerlegung: Für wissenschaftliche oder linguistische Zwecke bieten wir in den Optionen die Möglichkeit, gekoppelte Komposita an Bindestrichen und Slashes in ihre einzelnen Wortbestandteile zu zerlegen (hyphenatedCompoundsAsOne: false).
  • Zahlen im Text: Freistehende Ziffern wie „2026“ oder „42“ werden als Wörter gezählt, da sie beim lauten Lesen vollwertige Zahlwörter („zweitausendsechsundzwanzig“) darstellen.
  • Zeilenzählung: Bei den Zeilen zählen wir standardmäßig alle nicht-leeren Zeilen (Zeilen mit sichtbarem Textinhalt), sodass rein optische Leerzeilen das Zählergebnis nicht verfälschen.
  • Apostrophe & Abkürzungen: Wörter mit Auslassungszeichen wie „geht's“ oder „mach's“ werden als ein einziges Wort erfasst.

4. Matrix deutscher Sonder- und Grenzfälle

Beispiel-AusdruckWortanzahl (Word-Standard)Zeichen (mit Lz.)Regel / Begründung
a - b3 Wörter5 ZeichenWhitespace-getrennte Zeichen („-“ als eigenständiges Token wie in Word)
— (Gedankenstrich allein)1 Wort1 ZeichenFreistehender Gedankenstrich zählt als 1 Wort (Word-Parität)
Zähler & Generator ist dein Werkzeug6 Wörter36 ZeichenFreistehendes Kaufmanns-Und („&“) zählt als Wort
hydration/duplicated-text1 Wort25 ZeichenWhitespace-Token mit internem Slash und Bindestrich
Chrome-translated1 Wort17 ZeichenGekoppeltes Wort mit internem Bindestrich
Mund-zu-Mund-Beatmung1 Wort (optional 4)21 ZeichenGekoppeltes Kompositum (1 Wort im Standard; 4 bei Zerlegung)
z. B. (zum Beispiel)2 Wörter5 ZeichenZwei abgekürzte Wortbestandteile mit Leerzeichen
bzw. / etc.1 Wort4 ZeichenStandard-Abkürzung mit Schlusspunkt
Im Jahr 20263 Wörter12 ZeichenZahlen werden als gesprochenes Wort gezählt
Hallo Welt! 👋🏽2 Wörter14 ZeichenEmoji mit Hautton-Modifier zählt als 1 Graphem
12,50 €2 Wörter / Einheiten7 ZeichenDezimalzahl mit Komma plus Währungszeichen

5. Vergleich: Volle Kompatibilität mit Microsoft Word

Unser Standardmodus liefert exakt dieselben Wortzahlen wie Microsoft Word bei Fließtexten:

  • Standard-Wortzählung: Durch die Whitespace-Segmentierung stimmen zusammengesetzte englische oder deutsche Fachbegriffe (wie „Self-Service“, „Open-Source“ oder „Astro-Integration“) 1:1 mit den Wortangaben in Word überein.
  • Optionale Feinzerlegung: Wer Bindestrich-Verbindungen zwingend einzeln zählen möchte, kann dies per Schalter aktivieren.
  • Fußnoten & Textfelder: In Microsoft Word werden Fußnoten oft standardmäßig mitgezählt. Bei unserem Online-Zähler bestimmst du durch Copy & Paste selbst, welche Textpassagen in die Analyse einfließen.

6. Wie Lesezeit und Sprechzeit berechnet werden

Die zeitliche Einschätzung basiert auf anerkannten empirischen Lesegeschwindigkeiten:

  • Lesezeit (Stilles Lesen): Ein durchschnittlicher erwachsener Leser liest deutsche Sach- und Fachtexte mit einer Geschwindigkeit von 200 Wörtern pro Minute (WPM). Formel: Lesezeit in Sekunden = (Wörter / 200) * 60.
  • Sprechzeit (Vorträge & Präsentationen): Für verständlich und ruhig gesprochene Vorträge, Podcasts oder Hörbücher liegt die ideale Sprechgeschwindigkeit bei 130 Wörtern pro Minute (WPM). Formel: Sprechzeit in Sekunden = (Wörter / 130) * 60.

7. Deutsche Lesbarkeitsindizes: Formeln & Interpretation

Englische Lesbarkeitsformeln (wie der originale Flesch Reading Ease) lassen sich nicht unverändert auf das Deutsche übertragen, da deutsche Wörter durchschnittlich länger und silbenreicher sind. Wir setzen daher auf die zwei führenden, wissenschaftlich adaptierten Formeln:

Flesch-Amstad-Index

Toni Amstad passte die Flesch-Formel speziell an deutsche Silben- und Satzstrukturen an:

Flesch-Amstad = 180 − ASL − (58,5 × ASW)

Hierbei bezeichnet ASL (Average Sentence Length) die durchschnittliche Satzlänge in Wörtern und ASW (Average Syllables per Word) die durchschnittliche Silbenanzahl pro Wort. Ein Wert zwischen 60 und 70 gilt im deutschen Web als optimal lesbar.

1. Wiener Sachtextformel (WSTF 1)

Die von Bamberger und Vanecek an der Universität Wien entwickelte Formel gibt direkt die empfohlene Schulstufe an:

WSTF = 0,1935 · MS + 0,1672 · SL + 0,1297 · IW − 0,0327 · ES − 0,875

Dabei bedeuten: MS = Prozentualer Anteil von Wörtern mit 3 oder mehr Silben; SL = Mittlere Satzlänge; IW = Anteil langer Wörter (> 6 Buchstaben); ES = Anteil einsilbiger Wörter. Ein Wert von 7 bis 8 ist ideal für ein allgemeines Lesepublikum.

8. Testgetriebene Entwicklung & Qualitätssicherung

Alle Zähl- und Rechenlogiken unseres Portals werden durch eine umfassende, automatisierte Testsuite (Vitest) mit dutzenden Grenzfall-Szenarien kontinuierlich überwacht. Jeder Algorithmus muss strenge deterministische Tests bestehen, bevor er in Produktion geht.