“1〜4バイト可変長のUTF-8、固定長にしたければ、無駄は多くなるけど1文字を常に4バイトで表すUTF-32がある。UTF-16は無駄が多いけど可変長という両方の欠点を合わせ持つ存在になった。”

vccvcc のブックマーク 2017/11/13 12:27

その他

このブックマークにはスターがありません。
最初のスターをつけてみよう!

絵文字がある種のUnicodeバグを世界から一掃しつつある件について|Rui Ueyama

    UnicodeのUTF-16エンコーディングではほとんどの文字(コードポイント)は2バイトで表現されるが、Unicodeに後から追加収録された文字の多くは4バイトで表現される。4バイト文字がうまく扱えないプログラムという...

    \ コメントが サクサク読める アプリです /

    • App Storeからダウンロード
    • Google Playで手に入れよう