濮阳杆衣贸易有限公司

主頁 > 知識庫 > 解決python3 整數(shù)數(shù)組轉(zhuǎn)bytes的效率問題

解決python3 整數(shù)數(shù)組轉(zhuǎn)bytes的效率問題

熱門標簽:400電話 申請 條件 crm電銷機器人 云南地圖標注 鄭州智能外呼系統(tǒng)中心 北京外呼電銷機器人招商 南京crm外呼系統(tǒng)排名 電銷機器人 金倫通信 汕頭電商外呼系統(tǒng)供應(yīng)商 賓館能在百度地圖標注嗎

昨天在做一道CTF題的時候碰到了一個圖片異或的問題,操作大概如下:

將一個圖片讀入,然后每字節(jié)進行異或操作,核心代碼可簡化為以下:

#coding:utf-8
'''
 @DateTime: 2017-11-25 13:51:33
 @Version: 1.0
 @Author: Unname_Bao
'''
import six
key = b'\xdcd~\xb6^g\x11\xe1U7R\x18!+9d\xdcd~\xb6^g\x11\xe1U7R\x18!+9d'
with open('flag.encrypted','rb') as f:
 c = f.read()
flag = b''
for i in range(32):
 flag += six.int2byte(key[i%32]^c[i])
with open('flag.png','wb') as f:
 f.write(flag)

然后就碰到了一個效率問題,跑了十幾分鐘都沒有跑出結(jié)果,起初以為是類型轉(zhuǎn)換的問題,因為比較急,于是換了成了C++的代碼去解決,后來一直沒多想。

今天閑下來的時候才發(fā)現(xiàn)代碼之前的代碼中存在一個非常大的問題:

內(nèi)存申請問題

由于flag.encrypted文件大小為6.47MB之大,由于我的腳本思路是不斷在byte數(shù)組后添加,但忽略了其本質(zhì)。

就是在內(nèi)存申請過程中,由于數(shù)組長度最終為600+W大小,期間存在多次數(shù)組內(nèi)存不夠,需要重新申請內(nèi)存的問題,而python中的內(nèi)存申請顯然沒有C++的vector的push_back有效率。

而且python中,無論是list、string還是byte,也沒有reserve這種函數(shù),不能預(yù)留內(nèi)存空間(這時候真的要吐槽一下python設(shè)計者對速度優(yōu)化的考量了)。

于是只能用另一種方法進行優(yōu)化,就是先用list申請一個需求大小的內(nèi)存空間,然后再轉(zhuǎn)為bytes使用,

代碼如下:

#coding:utf-8
'''
 @DateTime: 2017-11-26 14:09:29
 @Version: 2.0
 @Author: Unname_Bao
'''
key = b'\xdcd~\xb6^g\x11\xe1U7R\x18!+9d\xdcd~\xb6^g\x11\xe1U7R\x18!+9d'
with open('flag.encrypted','rb') as f:
 c = f.read()
flag = list('1'*len(c))
for i in range(len(c)):
 flag[i] = key[i%32]^c[i]
flag = bytes(flag)
with open('flag.png','wb') as f:
 f.write(flag)

這樣寫的話幾乎是瞬間完成任務(wù)了,但還是比C++慢很多,這是不可避免的。

補充:python2與python3的bytes問題

>>> s = '編程'
>>> print s
編程
>>> s
'\xe7\xbc\x96\xe7\xa8\x8b'
>>>

在python2中直接調(diào)用字符串的變量的話,會打印其bytes(可以理解成用16進制表示字符串的內(nèi)存地址,本質(zhì)還是二進制)。在python2中,bytes和str是一回事。

為什么要有個bytes呢?因為所有數(shù)據(jù)本質(zhì)都是用二進制進行儲存的,當傳輸數(shù)據(jù)的時候,要把這些數(shù)據(jù)先轉(zhuǎn)換成二進制( bytes)在進行傳輸。除此之外,python2里還有個單獨的數(shù)據(jù)類型,把字符串解碼后,就會變成unicode。

>>> s
'\xe8\xb7\xaf\xe9\xa3\x9e' #utf-8
>>> s.decode('utf-8')
u'\u8def\u98de' #unicode 在unicode編碼表里對應(yīng)的位置
>>> print(s.decode('utf-8'))
路飛 #unicode 格式的字符

原因是python2的默認編碼是ASCII,后來為了支持多國語言,就想弄個unicode。但是直接把ASCII轉(zhuǎn)成unicode是很費勁的,所以龜叔直接搞了一個新的字符類型,就叫unicode,說白了就是你得在內(nèi)存里先把字符串存成unicode類型

2008年python3出世,來了個大變革:

1、把字符串的編碼變成了unicode,文件默認編碼變成了utf-8。

2、把str 和bytes 做了明確區(qū)分, str 就是unicode格式的字符, bytes就是單純二進制還有一個很重要的是,在python3中,只有unicode給你展示字形,其他的編碼一律用bytes展示,也就是說要你強制使用unicode。

最后再提示一下,Python只要出現(xiàn)各種編碼問題,無非是哪里的編碼設(shè)置出錯了

常見編碼錯誤的原因有:

Python解釋器的默認編碼

Python源文件文件編碼

Terminal使用的編碼

操作系統(tǒng)的語言設(shè)置

以上為個人經(jīng)驗,希望能給大家一個參考,也希望大家多多支持腳本之家。如有錯誤或未考慮完全的地方,望不吝賜教。

您可能感興趣的文章:
  • python中int與str互轉(zhuǎn)方法
  • Python bytes string相互轉(zhuǎn)換過程解析
  • Python實現(xiàn)byte轉(zhuǎn)integer

標簽:西寧 梅州 石家莊 浙江 錫林郭勒盟 文山 昆明 懷化

巨人網(wǎng)絡(luò)通訊聲明:本文標題《解決python3 整數(shù)數(shù)組轉(zhuǎn)bytes的效率問題》,本文關(guān)鍵詞  解決,python3,整數(shù),數(shù)組,轉(zhuǎn),;如發(fā)現(xiàn)本文內(nèi)容存在版權(quán)問題,煩請?zhí)峁┫嚓P(guān)信息告之我們,我們將及時溝通與處理。本站內(nèi)容系統(tǒng)采集于網(wǎng)絡(luò),涉及言論、版權(quán)與本站無關(guān)。
  • 相關(guān)文章
  • 下面列出與本文章《解決python3 整數(shù)數(shù)組轉(zhuǎn)bytes的效率問題》相關(guān)的同類信息!
  • 本頁收集關(guān)于解決python3 整數(shù)數(shù)組轉(zhuǎn)bytes的效率問題的相關(guān)信息資訊供網(wǎng)民參考!
  • 推薦文章
    耿马| 西林县| 毕节市| 枞阳县| 卫辉市| 东阿县| 乐陵市| 依安县| 安丘市| 明光市| 通州区| 正宁县| 清新县| 内乡县| 财经| 四平市| 岚皋县| 钟祥市| 门头沟区| 炎陵县| 南溪县| 方山县| 乐平市| 富宁县| 尼勒克县| 大名县| 陵水| 和田市| 江孜县| 正宁县| 吴川市| 涪陵区| 衡东县| 讷河市| 民乐县| 瑞丽市| 富阳市| 翁牛特旗| 南部县| 和静县| 崇仁县|