HTML 字元對應表
瀏覽和複製 HTML 字元實體
如何使用HTML 字元對應表
- 1輸入或貼上含特殊字元的文本。
- 2選擇轉換為 HTML 實體(如 © → ©)或反向還原。
- 3檢視每個字元對應的實體名與編號,複製使用。
HTML 字元實體:名稱與編號
字元 → 命名實體(©) 或 數字實體(© / ©)HTML 實體讓你在頁面裡插入鍵盤打不出、或會被誤讀為標籤的字元,例如版權符號 ©、商標 ™、非斷行空格。形式分『命名實體』(©)和『數字實體』(© 或十六進位制 ©)。
命名實體可讀性更好,但有些冷門符號只有數字實體;數字實體相容性強,適合任意 Unicode 字元。
本工具列出每個字元的實體名與編號,方便在 HTML、郵件模板、富文本里精確插入特殊符號而不出錯。
HTML 實體有兩種寫法:**實體名**(©,可讀性好但支援有限)和**實體編號**(© 十進位制或 © 十六進位制,支援所有 Unicode 字元)。HTML5 定義了約 2000 個命名實體,但常用的就幾十個。對於命名實體表裡沒有的字元,一律用編號形式。
**現代網頁其實可以直接寫 Unicode 字元**:只要頁面聲明瞭 UTF-8(<meta charset="utf-8">),©、→、中文、emoji 都能直接寫,可讀性和可維護性都更好,也利於搜尋和複製。實體編碼在今天主要用於兩類場景:① 需要轉義的 HTML 語法字元(< > &);② 鍵盤難以輸入的特殊符號(如 不換行空格、­ 軟連字元)。**不要為了「保險」把整段文字都轉成實體**,那會讓原始碼難以閱讀且增大檔案體積。
| 類別 | 字元 | HTML 實體 | Unicode |
|---|---|---|---|
| 引號 | “ ” | “ ” | U+201C U+201D |
| 破折號 | —— | — | U+2014 |
| 省略號 | … | … | U+2026 |
| 商標 | ™ | ™ | U+2122 |
| 註冊商標 | ® | ® | U+00AE |
| 版權 | © | © | U+00A9 |
| 度 | ° | ° | U+00B0 |
| 乘號 | × | × | U+00D7 |
| 正負 | ± | ± | U+00B1 |
| 箭頭 | → | → | U+2192 |
常用特殊字元速查
常見問題
命名實體和數字實體哪個更好?
命名實體更易讀、好維護;數字實體相容性最好、能表達任意碼點。混用無妨,關鍵是編輯器/環境支援。
為什麼有的符號沒有命名實體?
HTML 只為標準字元定義了有限命名實體,新 Unicode 符號往往只有數字實體。用 &#xXXXX; 即可覆蓋。
實體和 UTF-8 直接存字元衝突嗎?
不衝突。現代站點多用 UTF-8 直接存字元;實體主要用於必須轉義、或需要語義清晰的場合。
什麼是不可見字元?怎麼排查?
常見的有:U+00A0 不換行空格(看起來像空格但不會被 HTML 合併,常導致佈局奇怪或複製粘貼出錯)、U+200B 零寬空格(完全不可見,常混入複製的文本導致校驗失敗)、U+FEFF BOM(檔案開頭,可能導致 PHP 輸出警告或 JSON 解析失敗)、U+2028/2029 行/段分隔符(會破壞 JS 字串字面量)。排查方法:貼上到支援顯示不可見字元的編輯器(VS Code 裝 highlight-bad-chars 外掛),或用程式碼檢查字元的 Unicode 碼位。
為什麼從 Word 複製的文本有奇怪符號?
Word 會自動把直引號 " 換成彎引號 “ ”、把 -- 換成破折號 ——、把 ... 換成省略號 …(稱為「自動更正」)。這些是合法 Unicode 字元,但如果貼上到程式碼、配置檔案或需要精確匹配的場景就會出錯(例如 JSON 裡的彎引號會解析失敗)。解決辦法:貼上時用「純文本貼上」(Ctrl+Shift+V),或先粘到純文本編輯器中轉一道。寫文件時建議在 Word 裡關閉自動更正。
