56、bytes和bytearray原理

最近,任正非接受采访时说:

这个社会最终要走向人工智能。
你可以参观一下我们的生产线,20 秒钟一部手机从无到有,基本上没有什么人。
未来我们的生产线,基本是自动化的,一个人想要获得工作机会,至少你有大专或者大学以上的教育,会英文和计算机是基本的。不然,你连做工人的机会都没有。

参考:人工智能开发宝典:第二十八讲 Python-字节串、字节数组和编码格式

字符、字节的操作不可避免的(*****)

字符串与 bytes 、bytearry的比较:

字符串是字符组成的有序序列,字符可以使用编码来理解:
bytes 是字节组成的有序的不可变序列;
bytearry 是字节组成的有序的可变序列;

编码与解码;

python3的字符串内部都是用UNICODE来存储字符的;

字符串按照不同的字符集编码encode返回字节序列 bytes;
encode(encoding='utf-8',errors='strict') ->bytes
字节序列按照不同的字符集解码decode返回字符串;
bytes.decode(encoding='utf-8',errors='strict') ->bytes
bytearry.decode(encoding='utf-8',errors='strict') ->bytes

编码与解码(UTF-8、ASCll码)
在互联网中文件是以utf-8格式进行传递,所有在传输文件(字符串)前后需要进行编码(encode)和解码(decode)

# b 表示bytes
print('中'.encode())            |  b'\xe4\xb8\xad'
#(b'\xe4\xb8\xad').decode()=bytes((0xe4,0xb8,0xad)).decode()
print((b'\xe4\xb8\xad').decode())      |  中
bytes((0xe4,0xb8,0xad)).decode()    |  '中'

1、编码
        国标系列:(常用于Windows)
                GB18030(2字节或4字节编码,共27533个)
                    GBK(2字节编码,共21003个)
                        GB2312(2字节编码,共6763个汉字)       

        国际标准:(常用语Linux /Mac OS X / IOS /Android)
                UNICODE16/UNICODE32   <<<---->>>      UTF-8(中文 大多数字都是三个 字节,有一些符号是 四字节)
                注:UTF-8(8-bit Unicode  Transformation  Format)
2、编码注释
  在python 源文件第一行或第二行写入如下内容是告诉解释执行器此文件的编码类型是什么
  如
# -*- coding: gbk -*-
# 设置源文件编码格式为gbk

  或
# -*- coding: utf-8 -*-
# 设置源文件编码格式为utf-8
1. bytes对象

bytes对象是用于二进制数据操作的核心内置类型之一。一个bytes对象是单个字节值组成的不可更改的序列。bytes对象中的每个元素都是在0到255之间的一个小整数。

bytes对象与字符串对象的字面量按照相同的方法定义,需要额外添加"b"前缀
bytes字面量只允许ASCII编码字符。任何超过127的字符值必须使用适当的转义字符进行指定:
与字符串相同,在bytes字面量中使用"r"前缀用来禁用转义字符:

bytes(<iterable>)
类似字符串,bytes对象支持常见的序列操作:

2. bytearray对象 (字节组成的可变序列)

Python支持的另一种二进制序列类型叫做bytearray。bytearray对象与bytes对象非常相似,仅有一些不同:

Python中没有专门的语法来定义bytearray字面量,类似"b"前缀可以用来定义bytes对象。bytearray对象始终使用bytearray()内置函数创建:
bytearray(bytes_or_buffer)

bytearray(b'abc').hex()  |    '616263'    #创建副本,可以改变的字节;
bytearray('abc'.encode()).hex()    |    '616263'     # hen()   16进制转换; 

修改bytearray
bytearray(b'abc')[-1]    |    99
x=bytearray(b'abcdef')
x[2]=97
print(x)
-------------------
bytearray(b'abadef')

总结:
1、字节数组 bytearray
        字节数组是可变的字节序列

2、创建函数bytearray
        bytearray()                                            创建字节数组
        bytearray(可迭代对象)                           同bytes(可迭代对象):用可迭代对象初始化一个字节串
        bytearray(整数n)                                   生成n个值为0的字节串
        bytearray(字符串, encoding='utf-8')    用字符串的转换编码生成一个字节串

3、bytes和bytearray区别
        字节串是不可变的字节序列
        字节数组是可变的字节序列

4、运算操作
        +      +=      *      *=
        <      <=      >      >=      ==      !=
        in / not in 
        索引和切片 (字节数组支持索引和切片赋值,规则同列表的索引和切片赋值规则)

5、示例
ba = bytearray(b'abcdefg')
ba[0] = 0x41                    # ba = bytearray(b‘Abcdefg’)
ba[1::2] = bytearray(b'BDF')    # ba = bytearray(b'ABcDeFg')

6、字节数组(bytearray)的方法
BA代表bytearray
        BA.clear()                          清空字节数组
        BA.append(n)                   追加一个字节(n为0~255的整数)
        BA.remove(value)            删除第一个出现的字节,如过没有出现,,则触发ValueError错误
        BA.reverse()                     字节的顺序反转
        BA.decode(encoding=‘utf-8’)     将bytearray转换为字符串
        BA.find(sub [, start[, end]])               查找sub字节数数组
详见: help(bytearray)
最后编辑于
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 218,204评论 6 506
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 93,091评论 3 395
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 164,548评论 0 354
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 58,657评论 1 293
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 67,689评论 6 392
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 51,554评论 1 305
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 40,302评论 3 418
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 39,216评论 0 276
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 45,661评论 1 314
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 37,851评论 3 336
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 39,977评论 1 348
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 35,697评论 5 347
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 41,306评论 3 330
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 31,898评论 0 22
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 33,019评论 1 270
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 48,138评论 3 370
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 44,927评论 2 355

推荐阅读更多精彩内容