1. Unser Leitbild: 100 % clientseitige Präzision
Während viele Online-Rechner Texte an externe Server übertragen oder unvollständige Hilfsmethoden einsetzen, verfolgt Zähler & Generator einen kompromisslos modernen Ansatz: Sämtliche Zählungen und linguistischen Analysen laufen ausschließlich lokal in deinem Webbrowser ab. Dadurch garantieren wir absolute Vertraulichkeit für sensible Manuskripte, Verträge und private Notizen.
2. Wie wir Zeichen zählen (Grapheme & Unicode)
Ein zentrales Problem vieler Zähler ist die veraltete Zählung nach JavaScript-Speichereinheiten (UTF-16 Code-Units). Zeichen wie Emojis oder historische Zeichen belegen intern 2 bis 8 Code-Units. Ein Emoji wie 👋🏽 würde bei primitiven Zählern als 2 oder 4 Zeichen gezählt werden.
Unsere Engine verwendet stattdessen den offiziellen Standard Intl.Segmenter(..., { granularity: 'grapheme' }). Wir zählen Graphem-Cluster – das bedeutet: Was für das menschliche Auge als ein einziges sichtbares Schriftzeichen wahrnehmbar ist, zählt exakt als ein Zeichen.
- Zeichen mit Leerzeichen: Alle Grapheme inklusive regulärer Leerzeichen, geschützter Leerzeichen ( ), Tabulatoren und Zeilenumbrüchen.
- Zeichen ohne Leerzeichen: Alle Grapheme nach vollständiger Bereinigung sämtlicher Unicode-Whitespace-Klassen (
\s+).
3. Wie wir Wörter zählen (Standard nach Microsoft Word)
Um größtmögliche Verlässlichkeit und 100%ige Übereinstimmung mit branchenüblichen Textverarbeitungsprogrammen zu gewährleisten, folgt unser Wortzähler der Microsoft-Word-Zählmethode (Whitespace-Delimited Tokens).
- Whitespace-Grenzen: Jedes durch Leerzeichen, Zeilenumbrüche oder Tabulatoren getrennte Token zählt als eigenständiges Wort. Satzzeichen an den Worträndern werden ausschließlich für die Keyword-Dichte-Tabelle bereinigt, niemals für die eigentliche Wortzählung.
- Freistehende Zeichen & Gedankenstriche: Alleinstehende Zeichen wie „-“, „–“, „—“, „&“, „§“, „%“ oder sonstige Symbole zählen als vollwertige Wörter, exakt wie in Microsoft Word (z. B. zählt „a - b“ als 3 Wörter und ein einzelner Gedankenstrich „—“ als 1 Wort).
- Bindestriche & Schrägstriche: Begriffe mit internen Bindestrichen oder Schrägstrichen wie „hydration/duplicated-text“, „Chrome-translated“ oder „Mund-zu-Mund-Beatmung“ zählen standardmäßig als genau 1 Wort – exakt wie in Microsoft Word.
- Alleinstehende Symbole & Kaufmanns-Und (&): Ein freistehendes Ampersand („&“) sowie alleinstehende Währungs-, Rechen- oder Rechtszeichen („€“, „§“, „%“, „+“) werden als eigenständiges Wort gezählt (z. B. zählt „Zähler & Generator ist dein Werkzeug“ als genau 6 Wörter).
- Optionale Komposita-Zerlegung: Für wissenschaftliche oder linguistische Zwecke bieten wir in den Optionen die Möglichkeit, gekoppelte Komposita an Bindestrichen und Slashes in ihre einzelnen Wortbestandteile zu zerlegen (
hyphenatedCompoundsAsOne: false). - Zahlen im Text: Freistehende Ziffern wie „2026“ oder „42“ werden als Wörter gezählt, da sie beim lauten Lesen vollwertige Zahlwörter („zweitausendsechsundzwanzig“) darstellen.
- Zeilenzählung: Bei den Zeilen zählen wir standardmäßig alle nicht-leeren Zeilen (Zeilen mit sichtbarem Textinhalt), sodass rein optische Leerzeilen das Zählergebnis nicht verfälschen.
- Apostrophe & Abkürzungen: Wörter mit Auslassungszeichen wie „geht's“ oder „mach's“ werden als ein einziges Wort erfasst.
4. Matrix deutscher Sonder- und Grenzfälle
| Beispiel-Ausdruck | Wortanzahl (Word-Standard) | Zeichen (mit Lz.) | Regel / Begründung |
|---|---|---|---|
| a - b | 3 Wörter | 5 Zeichen | Whitespace-getrennte Zeichen („-“ als eigenständiges Token wie in Word) |
| — (Gedankenstrich allein) | 1 Wort | 1 Zeichen | Freistehender Gedankenstrich zählt als 1 Wort (Word-Parität) |
| Zähler & Generator ist dein Werkzeug | 6 Wörter | 36 Zeichen | Freistehendes Kaufmanns-Und („&“) zählt als Wort |
| hydration/duplicated-text | 1 Wort | 25 Zeichen | Whitespace-Token mit internem Slash und Bindestrich |
| Chrome-translated | 1 Wort | 17 Zeichen | Gekoppeltes Wort mit internem Bindestrich |
| Mund-zu-Mund-Beatmung | 1 Wort (optional 4) | 21 Zeichen | Gekoppeltes Kompositum (1 Wort im Standard; 4 bei Zerlegung) |
| z. B. (zum Beispiel) | 2 Wörter | 5 Zeichen | Zwei abgekürzte Wortbestandteile mit Leerzeichen |
| bzw. / etc. | 1 Wort | 4 Zeichen | Standard-Abkürzung mit Schlusspunkt |
| Im Jahr 2026 | 3 Wörter | 12 Zeichen | Zahlen werden als gesprochenes Wort gezählt |
| Hallo Welt! 👋🏽 | 2 Wörter | 14 Zeichen | Emoji mit Hautton-Modifier zählt als 1 Graphem |
| 12,50 € | 2 Wörter / Einheiten | 7 Zeichen | Dezimalzahl mit Komma plus Währungszeichen |
5. Vergleich: Volle Kompatibilität mit Microsoft Word
Unser Standardmodus liefert exakt dieselben Wortzahlen wie Microsoft Word bei Fließtexten:
- Standard-Wortzählung: Durch die Whitespace-Segmentierung stimmen zusammengesetzte englische oder deutsche Fachbegriffe (wie „Self-Service“, „Open-Source“ oder „Astro-Integration“) 1:1 mit den Wortangaben in Word überein.
- Optionale Feinzerlegung: Wer Bindestrich-Verbindungen zwingend einzeln zählen möchte, kann dies per Schalter aktivieren.
- Fußnoten & Textfelder: In Microsoft Word werden Fußnoten oft standardmäßig mitgezählt. Bei unserem Online-Zähler bestimmst du durch Copy & Paste selbst, welche Textpassagen in die Analyse einfließen.
6. Wie Lesezeit und Sprechzeit berechnet werden
Die zeitliche Einschätzung basiert auf anerkannten empirischen Lesegeschwindigkeiten:
- Lesezeit (Stilles Lesen): Ein durchschnittlicher erwachsener Leser liest deutsche Sach- und Fachtexte mit einer Geschwindigkeit von 200 Wörtern pro Minute (WPM). Formel:
Lesezeit in Sekunden = (Wörter / 200) * 60. - Sprechzeit (Vorträge & Präsentationen): Für verständlich und ruhig gesprochene Vorträge, Podcasts oder Hörbücher liegt die ideale Sprechgeschwindigkeit bei 130 Wörtern pro Minute (WPM). Formel:
Sprechzeit in Sekunden = (Wörter / 130) * 60.
7. Deutsche Lesbarkeitsindizes: Formeln & Interpretation
Englische Lesbarkeitsformeln (wie der originale Flesch Reading Ease) lassen sich nicht unverändert auf das Deutsche übertragen, da deutsche Wörter durchschnittlich länger und silbenreicher sind. Wir setzen daher auf die zwei führenden, wissenschaftlich adaptierten Formeln:
Flesch-Amstad-Index
Toni Amstad passte die Flesch-Formel speziell an deutsche Silben- und Satzstrukturen an:
Hierbei bezeichnet ASL (Average Sentence Length) die durchschnittliche Satzlänge in Wörtern und ASW (Average Syllables per Word) die durchschnittliche Silbenanzahl pro Wort. Ein Wert zwischen 60 und 70 gilt im deutschen Web als optimal lesbar.
1. Wiener Sachtextformel (WSTF 1)
Die von Bamberger und Vanecek an der Universität Wien entwickelte Formel gibt direkt die empfohlene Schulstufe an:
Dabei bedeuten: MS = Prozentualer Anteil von Wörtern mit 3 oder mehr Silben; SL = Mittlere Satzlänge; IW = Anteil langer Wörter (> 6 Buchstaben); ES = Anteil einsilbiger Wörter. Ein Wert von 7 bis 8 ist ideal für ein allgemeines Lesepublikum.
8. Testgetriebene Entwicklung & Qualitätssicherung
Alle Zähl- und Rechenlogiken unseres Portals werden durch eine umfassende, automatisierte Testsuite (Vitest) mit dutzenden Grenzfall-Szenarien kontinuierlich überwacht. Jeder Algorithmus muss strenge deterministische Tests bestehen, bevor er in Produktion geht.