10/01/15 08:16:46
てか、こんなスレがあったのね
なんとなくわかってきたカモ
スレリンク(tech板)
>>126の言うようにUnicodeと言って符号化方式をさしているケースもあると理解するのが良さそうね
Microsoftが「UTF-16LEのことをUnicodeと呼ぶ」から・・
でも、それもたぶん歴史的には仕方ない、というのか
Unicodeができた当初は2バイト固定の文字しかなかったし
UCSとかが出来たのはその後みたい
その時の符号化方式のことをUnicodeと呼んでいるわけだから
UTF-16LEと認識してしまうのはおそらく正確じゃなくて
そのうちのサロゲートペアとかを使わない部分っていう認識のほうが良いのかな
現在はVistaでその辺も対応したと。
まぁ、UTF-16LE自体がサロゲートペアに対応していない時代があったのかもしれない
結局Windowsを使ってる限り
UnicodeやUCS-2と呼んでいるやつの正体は実質ほとんどがUTF-16LEで
UTF-16LEの「よく使われてる部分」は2バイト固定ってこと、かな
間違ってたらすまぬ