🔡 Japanischer Zeichenähler (文字数・バイト数)
Fügen Sie japanischen Text ein, um Zeichen (mit und ohne Leerzeichen), Bytes in UTF-8 und Shift-JIS, Zeilen und Vollbreite- vs. Halbbreite-Zeichen sofort zu zählen.
Was ist dieses Werkzeug?
Text im Japanischen zu zählen ist nicht so einfach, wie es aussieht. Ein einzelnes "Zeichen" kann ein halbbreites lateinisches Buchstabe (1 Byte in Shift-JIS), ein vollbreites Kana oder Kanji (2 Bytes in Shift-JIS) oder ein vollbreiter lateinischer Buchstabe (ebenfalls 2 Bytes) sein. Formulare, Datenbanken und ältere japanische Systeme haben oft Grenzen, die in Byte-Zahlen statt in Zeichenzahlen ausgedrückt werden, sodass eine Zeichenkette, die in 30 Zeichen passt, ein 30-Byte-Feld überlaufen kann. Sowohl die Zeichenzahl als auch die Bytezahl zu kennen — in UTF-8 und Shift-JIS — ist wichtig zum Ausfüllen japanischer Web-Formulare, Entwerfen von Datenbank-Spalten und Schreiben von SMS- oder Tweet-langen Texten.
Dieser japanische Zeichenähler meldet die Zeichenzahl mit und ohne Leerzeichen, die Zeilenzahl, die UTF-8-Bytezahl, die Shift-JIS-Bytezahl und eine Aufschlüsselung von Vollbreite- vs. Halbbreite-Zeichen. Er ist für Schreiber gedacht, die Text ins Japanische lokalisieren, Entwickler, die Datenbankfelder dimensionieren, und jeden, der ein japanisches Regierungs- oder Bankformular mit einer Bytebegrenzung ausfüllt. Für die verwandten Aufgaben des Kana-Konvertierens oder Romanisierens von Text verwenden Sie den Kana-Konverter und den Romaji-Konverter.
Die folgende Tabelle zeigt, wie verschiedene Zeichentypen zu den Zählungen beitragen:
| Zeichentyp | Beispiel | UTF-8 Bytes | Shift-JIS Bytes |
|---|---|---|---|
| ASCII (halbbreit Latein) | A, 1, ! | 1 | 1 |
| Kana | あ, ア | 3 | 2 |
| Kanji | 日, 本 | 3 | 2 |
| Vollbreit Latein | A, 1 | 3 | 2 |
| Emoji | 😊 | 4 | n/a |
Wie es funktioniert
Der Ähler durchläuft die Eingabe einmal und notiert für jedes Zeichen seine UTF-8-Bytelänge (1 für ASCII, 2 für Latin-1-Ergänzung und Griechisch, 3 für Kana, Kanji und die meisten Symbole, 4 für Emoji und Astral-Ebenen-Zeichen) und seine Shift-JIS-Bytelänge (1 für ASCII und Halbbreite-Katakana, 2 für Vollbreite-Kana, Kanji und Vollbreit-Latein). Er klassifiziert jedes Zeichen auch als Vollbreite oder Halbbreite, indem er seinen Unicode-Block prüft, und zählt Leerzeichen und Zeilenumbrüche separat, sodass Sie ein "ohne Leerzeichen"-Gesamt erhalten.
Die folgende Tabelle listet die Unicode-Bereiche auf, die zur Klassifizierung der Breite verwendet werden:
| Breite | Unicode-Blöcke | Typischer Inhalt |
|---|---|---|
| Halbbreite | U+0000–U+007F, U+FF61–U+FFDC | ASCII, Halbbreite-Katakana |
| Vollbreite | U+3040–U+30FF, U+4E00–U+9FFF, U+FF00–U+FF60 | Kana, Kanji, Vollbreit-Latein |
| Andere | Emoji, Kombinationszeichen | gezählt nach UTF-8-Bytelänge |
Das gesamte Zählen läuft lokal in Ihrem Browser, sodass sogar sensibler Text nie Ihr Gerät verlässt.
Verwendung
- Fügen Sie Ihren japanischen (oder gemischten) Text in das Eingabefeld ein.
- Die Ähler aktualisieren sich sofort, während Sie tippen oder einfügen.
- Prüfen Sie die Zeichenzahl mit und ohne Leerzeichen.
- Prüfen Sie die UTF-8- und Shift-JIS-Bytezahlen für Formular- oder Datenbankgrenzen.
- Verwenden Sie die Vollbreite- vs. Halbbreite-Aufschlüsselung, um die Breiten-Normalisierung zu planen.
Häufige Fragen
Warum gibt es zwei verschiedene Byte-Zahlen?
Verschiedene Systeme codieren Japanisch unterschiedlich. Moderne Webseiten verwenden UTF-8 (wo ein Kanji 3 Bytes ist), während viele ältere japanische Regierungs- und Banksysteme Shift-JIS verwenden (wo ein Kanji 2 Bytes ist). Das Tool meldet beide, damit Sie anpassen können, welches System Ihre Eingabe prüft.
Wenn ein Formular sagt, es akzeptiert 30 Bytes, welche Codierung meint es?
Es meint fast immer Shift-JIS-Bytes, weil das die ältere Codierung ist, die japanische Backend-Systeme noch verwenden. Planen Sie in diesem Fall 2 Bytes pro Vollbreite-Zeichen.
Wie werden Emoji gezählt?
Emoji sind typischerweise 4 Bytes in UTF-8 und in grundlegendem Shift-JIS nicht darstellbar, sodass sie oft dazu führen, dass ältere Formulare die Eingabe ablehnen. Der Ähler zeigt ihre UTF-8-Bytekosten, damit Sie sie erkennen können.
Zählt es Wörter sowie Zeichen?
Es konzentriert sich auf Zeichen und Bytes, weil Japanisch keine Leerzeichen zwischen Wörtern hat, was eine leerzeichen-geteilte Wortzahl unzuverlässig macht. Die Zeichenzahl ist die Standard-Längenmetrik für japanischen Text.
Was ist der Unterschied zwischen Vollbreite und Halbbreite?
Halbbreite-Zeichen (A, 1, ア) sind schmal und kosten 1 Shift-JIS-Byte; Vollbreite-Zeichen (A, 1, ア, 日) sind breit und kosten 2. Vollbreite Latein und Ziffern werden von japanischen IMEs erzeugt und oft vor dem Absenden auf Halbbreite normalisiert.
Wird mein Text an einen Server gesendet?
Nein. Das gesamte Zählen passiert in Ihrem Browser mit JavaScript. Nichts wird hochgeladen, gespeichert oder protokolliert, sodass es sicher ist, private oder Entwurfs-Texte einzufügen.
Tipps & Ratschläge
Wenn ein japanisches Formular sagt, es akzeptiere "30 Bytes", meint es fast immer Shift-JIS-Bytes, weil das die ältere Codierung ist, die die meisten japanischen Regierungs- und Banksysteme intern noch verwenden — also planen Sie 2 Bytes pro Vollbreite-Zeichen. Vollbreite Ziffern und lateinische Buchstaben (0123, ABC) kosten jeweils 2 Shift-JIS-Bytes, während ihre Halbbreite-Zwillinge 1 kosten, sodass Normalisierung auf Halbbreite vor dem Absenden oft Platz spart. Emoji zählen als 4 UTF-8 Bytes und werden meist von älteren Formularen abgelehnt. Für Tweets und andere Unicode-basierte Systeme ist die UTF-8-Zahl das, was zählt. Wenn Sie eine Wortzahl für Japanisch benötigen, denken Sie daran, dass Japanisch keine Leerzeichen hat, sodass eine leerzeichen-geteilte Wortzahl unzuverlässig ist — die Zeichenzahl ist die Standard-Metrik. Um die Breite vor dem Zählen zu bereinigen, führen Sie den Text zuerst durch den Kana-Konverter.
Verwandte Tools
Hiragana-zu-Katakana-Konverter
Konvertieren Sie Hiragana in Katakana und Katakana in Hiragana sofort im Browser
Romaji-Konverter
Konvertieren Sie Hiragana und Katakana in Romaji mit Hepburn, Kunrei-shiki oder
Furigana-Generator
Fügen Sie Furigana-Lesungen über Kanji in japanischem Text hinzu. Kostenloser br
Okurigana-Helfer
Prüfen Sie die korrekte Okurigana-Schreibweise für häufige japanische Verben und
Kanji-Lesungs-Suche
Schlagen Sie die Onyomi- und Kunyomi-Lesungen häufiger Kanji nach. Kostenlose br
Zeichenzähler
Zählen Sie sofort Zeichen, Wörter, Sätze und Absätze. Kostenloser Online-Zeichen
Wortzähler
Zählen Sie Wörter, Zeichen, Sätze und Absätze in Echtzeit. Kostenlose Wortzählun
Quellen & Referenzen
Überprüft im: August 2026.
- Unicode Consortium — UTF-8-Codierung und Byte-Zählung.
- MIC — Shift-JIS-Standard in Regierungssystemen.
- WHATWG — Shift-JIS-Codierungsspezifikation.
Einschränkungen
Der Ähler konzentriert sich auf Zeichen und Bytes, nicht auf Wortzählung (Japanisch verwendet keine Leerzeichen zwischen Wörtern). Emoji und Astral-Ebenen-Zeichen werden als 4 UTF-8 Bytes gezählt. Die Shift-JIS-Bytezahl ist eine Schätzung basierend auf häufigen Unicode-Bereichen und deckt möglicherweise nicht alle seltenen Zeichen ab.