zoukankan      html  css  js  c++  java
  • utf-8和unicode

    你看到的unicode字符集是这样的编码表:
    I 0049
    t 0074
    ' 0027
    s 0073
      0020
    知 77e5
    乎 4e4e
    日 65e5
    报 62a5
    
    每一个字符对应一个十六进制数字。

    计算机只懂二进制,因此,严格按照unicode的方式(UCS-2),应该这样存储:
    I 00000000 01001001
    t 00000000 01110100
    ' 00000000 00100111
    s 00000000 01110011
      00000000 00100000
    知 01110111 11100101
    乎 01001110 01001110
    日 01100101 11100101
    报 01100010 10100101
    
    这个字符串总共占用了18个字节,但是对比中英文的二进制码,可以发现,英文前9位都是0!浪费啊,浪费硬盘,浪费流量。


    链接:http://www.zhihu.com/question/23374078/answer/65352538

  • 相关阅读:
    JSON
    event flow
    for,for each,for in,for of
    history of program language
    px fr em rem
    正则符号
    DOM、BOM
    web布局
    grid
    初学python环境安装
  • 原文地址:https://www.cnblogs.com/work115/p/5587311.html
Copyright © 2011-2022 走看看