最近使用

還沒有紀錄。點一下任何顏文字、符號或符號組合,就會出現在這裡。

Emoji 是什麼?由來、Unicode 標準,以及它在各家手機為什麼長得不一樣

Unicode 決定編號和名字,圖是 Apple、Google、微軟、三星各自畫的。這一個分工,解釋了你遇過的幾乎所有 emoji 怪事。

發表於

關於 emoji,最有用的一件事是:它不是圖片,是文字。😀 在標準裡有編號、有名字,跟 A、あ 在同一套系統裡;你看到的那張彩色小圖,是你裝置上的字型畫的。從膚色跑掉到出現空白方框,幾乎所有 emoji 怪事都來自這個分工。

這個字是日文,跟英文的 emotion 沒有關係

emoji 寫成漢字是「絵文字」:絵是圖畫,文字就是字。它跟英文 emotion、emoticon 長得像,那是巧合,兩邊沒有字源關係。

三個常被混用的詞,其實是三種不同的東西。emoticon 是把英文標點側著看的臉,像 :-) 和 :D。顏文字是日系的直立臉,像 ( ´▽`),不用歪頭就看得懂。emoji 則是 Unicode 標準定義的彩色圖形字元,像 😀。前兩種是用你本來就有的字排出來的,第三種本身就是一個字。

從 1999 年的日本手機開始

一般把起點記在 1999 年:NTT DoCoMo 的 i-mode 上線時,做了一組 176 個、畫在 12×12 點陣上的小圖,讓使用者在容不下幾個字的訊息裡也能放進語氣。設計者是栗田穣崇,紐約現代藝術博物館在 2016 年把這組原始圖收進館藏。

那組不是第一組。1997 年,J-Phone(後來的 SoftBank)的 SkyWalker DP-211SW 就內建過大約 90 個黑白圖案,只是那支手機賣得不好,所以被記住的是 i-mode。

接下來十年,日本幾家電信各做各的,彼此不相容:同一個笑臉從一家傳到另一家,可能變成別的圖,也可能什麼都沒有。要讓 emoji 走出日本,得先讓全世界同意「這個位置放的是哪一個東西」。

Unicode 只決定編號和名字,從不決定長相

2010 年 10 月的 Unicode 6.0 把 722 個 emoji 收進標準,起因是 Google 與 Apple 提案統一日本幾家電信的字集。從那時起,emoji 就是有碼位的文字:😀 是 U+1F600,名字叫 GRINNING FACE。

標準也就寫到這裡。它訂編號與名稱,不訂畫出來長什麼樣。每個平台自己做字型:Apple Color Emoji、Google 的 Noto Color Emoji、微軟的 Segoe UI Emoji、三星 One UI 那一套,還有很多網站在用的開源 Twemoji。同一則訊息,字是同一個,畫是不同張。

那些著名的意外就是這樣來的。Apple 在 2016 年的 iOS 10 把手槍 🔫 改成綠色水槍,其他平台接下來兩年陸續跟進,於是有一段時間同一個碼位在這支手機上是玩具、在那支手機上是真槍。Google 的漢堡 🍔 曾經把起司放在肉排下面,2017 年被網路指出後才改掉。字沒有變,圖變了。

很多 emoji 不只一個字元

這是最容易踩到的一點。看起來是一個 emoji,底下常常是好幾個碼位串起來的序列:

  • 膚色:基本 emoji 後面接五個膚色修飾字之一(U+1F3FB 到 U+1F3FF),2015 年的 Unicode 8.0 加入。
  • 國旗:兩個區域指示符號拼出 ISO 國碼。🇹🇼 是 U+1F1F9 U+1F1FC,也就是字母 T 和 W。
  • ZWJ 組合:用零寬度連接符 U+200D 把幾個 emoji 黏成一個。👩‍💻 是 👩 加 ZWJ 加 💻。
  • 變體選擇符:U+FE0F 會把原本是黑白文字樣式的字元切換成 emoji 樣式。❤️ 其實是 ❤(U+2764)加上 U+FE0F。

實務上有兩個後果。第一,emoji 吃掉的字數比看起來多:在 JavaScript 裡 '👍'.length 是 2,'👨‍👩‍👧'.length 是 8,簡訊與很多表單驗證也是這樣算的。第二,收件端的字型如果不認得整串序列,就會退回顯示各個部分:一家人會變成三個人並排 👨👩👧。那是設計好的後備行為,不是壞掉。

  • 紅心(含 U+FE0F)

    兩個碼位:U+2764 加上變體選擇符 U+FE0F,後者要求顯示成彩色 emoji 樣式。

  • 一家人:男人、女人、女孩

    五個碼位:三個人,中間用兩個零寬度連接符(U+200D)黏起來。不認得這串序列的裝置,會直接並排顯示三個人。

  • 台灣國旗

    兩個區域指示符號 U+1F1F9 與 U+1F1FC,也就是字母 T 和 W。用兩個字母代碼表示的國家與地區旗都是這樣拼出來的;英格蘭、蘇格蘭、威爾斯旗則改用標籤序列(tag sequence)。

  • 讚,中等膚色

    基本 emoji 後面接一個膚色修飾字(U+1F3FD)。五個膚色修飾字是 2015 年的 Unicode 8.0 加入的。

為什麼會看到空白方框或問號

空白長方形(常被叫做豆腐格)或方框裡一個問號,意思是:系統知道這裡有一個字,但手上的字型沒有它的圖。十次有九次是版本問題,那個 emoji 比你裝置上的字型新。

Unicode 大約一年加一次 emoji,新的一批要等作業系統更新才會到你手上,而舊手機常常等不到。這也是本站的 Emoji 大全只列到 Emoji 15.1 的原因:再新的字在不少 Android 與 Windows 機器上還是一格空白,給人複製一個看不見的東西沒有意義。

誰決定要不要有新的 emoji

Unicode 聯盟底下的 emoji 小組委員會審提案,任何人都可以寫,表格與評估標準都公開。他們看的是使用需求的證據、既有 emoji 是不是已經表達得出來、會不會太特定;品牌、特定人物(不論在世、已故或虛構)與神明依規定不收。通過的字排進下一版,再由各家平台畫圖,隨系統更新出貨。

名稱與搜尋關鍵字則是另一份資料。Unicode 的 CLDR 專案按語言維護它們,本站 Emoji 大全的中英文名稱就是從那裡來的。

可以直接拿 emoji 來用嗎

分兩層。碼位與名稱是標準,誰都能打:在標題、商品名稱、按鈕上放一個 😀,沒有授權問題。各家畫的那張圖則不是:Apple 的 emoji 字型是 Apple 的,不能把圖抽出來放進自己的 App 或素材包。需要圖檔就找開放授權的,例如 Twemoji(CC BY 4.0)或 Noto Color Emoji(SIL 開放字型授權)。

接下來

如果你本來就是要找 emoji 複製,不是來看它的身世,下面這份清單可以用中英文名稱或關鍵字搜尋,點一下就複製。