🔡 日文字元計數器(文字数・バイト数)
貼上日文文字,即時計算字元數(含和不含空格)、UTF-8 和 Shift-JIS 位元組數、行數,以及全形與半形字元統計。
這是什麼工具?
計算日文文字並不像看起來那麼簡單。一個「字元」可以是半形拉丁字母(Shift-JIS 中 1 位元組)、全形假名或漢字(Shift-JIS 中 2 位元組),或全形拉丁字母(也是 2 位元組)。表單、資料庫和舊式日文系統通常以位元組數而非字元數表示限制,因此一個 30 字元的字串可能會超出 30 位元組的欄位。同時了解字元數和位元組數——包括 UTF-8 和 Shift-JIS——對於填寫日文網頁表單、設計資料庫欄位以及編寫簡訊或推文長度的文案至關重要。
這個日文字元計數器報告含和不含空格的字元數、行數、UTF-8 位元組數、Shift-JIS 位元組數,以及全形與半形字元的分類統計。它專為將文案本地化為日文的寫作者、設計資料庫欄位的開發者,以及任何填寫有位元組限制的日本政府或銀行表單的人而設計。如需轉換假名或羅馬字化文字的相關任務,請使用假名轉換器和羅馬字轉換器。
請參考下表,了解不同字元類型如何影響計數:
| 字元類型 | 範例 | UTF-8 位元組 | Shift-JIS 位元組 |
|---|---|---|---|
| ASCII(半形拉丁) | A, 1, ! | 1 | 1 |
| 全形拉丁 | A, 1 | 3 | 2 |
| 平假名/片假名 | あ, ア | 3 | 2 |
| 漢字 | 日, 本 | 3 | 2 |
| 繪文字 | 😀 | 4 | N/A |
運作原理
計數器遍歷輸入一次,對每個字元記錄其 UTF-8 位元組長度(ASCII 為 1,拉丁補充和希臘字母為 2,假名、漢字和大多數符號為 3,繪文字和星空平面字元為 4)及其 Shift-JIS 位元組長度(ASCII 和半形片假名為 1,全形假名、漢字和全形拉丁為 2)。它還透過檢查 Unicode 區塊將每個字元分類為全形或半形,並分別計算空格和換行符,以便你獲得「不含空格」的總數。
下表列出了用於分類寬度的 Unicode 範圍:
| 寬度 | Unicode 區塊 | 典型內容 |
|---|---|---|
| 半形 | U+0000–U+007F, U+FF61–U+FFDC | ASCII、半形片假名 |
| 全形 | U+3040–U+30FF, U+4E00–U+9FFF, U+FF00–U+FF60 | 假名、漢字、全形拉丁 |
| 其他 | 繪文字、組合標記 | 按 UTF-8 位元組長度計算 |
所有計數都在你的瀏覽器中本地執行,因此即使敏感文字也不會離開你的裝置。
使用方法
- 將你的日文(或混合)文字貼上到輸入框中。
- 隨著你輸入或貼上,計數器即時更新。
- 查看含和不含空格的字元數。
- 查看 UTF-8 和 Shift-JIS 位元組數以了解表單或資料庫限制。
- 使用全形與半形分類統計來規劃寬度歸一化。
常見問題
為什麼有兩種不同的位元組計數?
不同系統以不同方式編碼日文。現代網頁使用 UTF-8(漢字為 3 位元組),而許多舊式日本政府和銀行系統使用 Shift-JIS(漢字為 2 位元組)。工具同時報告兩者,以便你匹配正在檢查你輸入的系統。
當表單說它接受 30 位元組時,指的是哪種編碼?
幾乎總是指 Shift-JIS 位元組,因為這是日本後端系統仍在使用的舊式編碼。在這種情況下,請按每個全形字元 2 位元組來規劃。
繪文字如何計數?
繪文字在 UTF-8 中通常為 4 位元組,在基本 Shift-JIS 中無法表示,因此它們經常導致舊式表單拒絕輸入。計數器顯示其 UTF-8 位元組成本以便你發現它們。
它也計算字數嗎?
它專注於字元和位元組,因為日文單詞之間沒有空格,使得空格分割的字數統計不可靠。字元數是日文文字的標準長度指標。
全形和半形有什麼區別?
半形字元(A, 1, ア)較窄,花費 1 個 Shift-JIS 位元組;全形字元(A, 1, ア, 日)較寬,花費 2 個。全形拉丁和數字由日文 IME 產生,通常在提交前歸一化為半形。
我的文字會被傳送到伺服器嗎?
不會。所有計數都在你的瀏覽器中以 JavaScript 執行。沒有任何內容被上傳、儲存或記錄,因此可以安全地貼上私人草稿文字。
技巧與建議
當日文表單說它接受「30 位元組」時,幾乎總是指Shift-JIS 位元組,因為這是大多數政府和銀行系統仍在內部使用的舊式編碼——因此請按每個全形字元 2 位元組來規劃。全形數字和拉丁字母(0123, ABC)每個花費 2 個 Shift-JIS 位元組,而它們的半形雙胞胎只需 1 個,因此在提交前歸一化為半形通常可以節省空間。繪文字計為 4 個 UTF-8 位元組,通常被舊式表單拒絕。對於推文和其他 Unicode 感知的系統,UTF-8 計數才重要。如果你需要日文的字數統計,請記住日文沒有空格,因此空格分割的字數統計不可靠——字元數才是標準指標。如需在計數前清理寬度,請先通過假名轉換器處理文字。
相關工具
平假名轉片假名轉換器
在瀏覽器中即時將平假名轉換為片假名,片假名轉換為平假名。免費的雙向日文假名轉換器,支援全形字元,無需註冊。
羅馬字轉換器
將平假名和片假名轉換為羅馬字,支援平文式、訓令式或日本式羅馬字系統。免費瀏覽器日文羅馬字轉換器,即時、隱私。
振假名產生器
為日文文字中的漢字加上振假名讀音。免費瀏覽器振假名產生器,使用常用詞詞典。即時、隱私、無需註冊。
送假名助手
檢查常見日文動詞和形容詞的正確送假名拼寫。免費瀏覽器送假名助手,適合寫作者、學習者和校對人員。
漢字讀音查詢
查找任何常見漢字的音讀和訓讀。免費瀏覽器日文漢字讀音查找器,附含義。即時、隱私。
字元計數器
即時計算字元數、單字數、句子數和段落數。免費線上字元計數器,提供文章、推文和論文的預估閱讀時間。秒出結果,告別手動計算。操作介面簡潔明瞭,新手也能快速上手。
字數統計器
免費線上字數統計工具。統計字數、字元數、句數、段落數和閱讀時間,適合文章、報告和論文寫作時使用,即時出結果。
來源與參考
- Unicode Standard: Japanese Script Encoding (UTF-8 vs Shift-JIS)
- MDN Web Docs: JavaScript String length and encoding
- JIS X 0208: Shift-JIS 字符編碼規格
限制與免責聲明
- 繪文字等星空平面字元在基本 Shift-JIS 中無法表示,僅計算 UTF-8 位元組。
- 不提供字數統計,因日文無空格分隔,字元數為標準計量指標。