5.9 读å�–二进制数æ�®åˆ°å�¯å�˜ç¼“冲区ä¸Â¶
问题¶
ä½ æƒ³ç›´æŽ¥è¯»å�–二进制数æ�®åˆ°ä¸€ä¸ªå�¯å�˜ç¼“冲区ä¸ï¼Œè€Œä¸�需è¦�å�šä»»ä½•çš„ä¸é—´å¤�制æ“�作。 æˆ–è€…ä½ æƒ³åŽŸåœ°ä¿®æ”¹æ•°æ�®å¹¶å°†å®ƒå†™å›žåˆ°ä¸€ä¸ªæ–‡ä»¶ä¸åŽ»ã€‚
解决方案¶
为了读å�–æ•°æ�®åˆ°ä¸€ä¸ªå�¯å�˜æ•°ç»„ä¸ï¼Œä½¿ç”¨æ–‡ä»¶å¯¹è±¡çš„ readinto() 方法。比如:
import os.path
def read_into_buffer(filename):
buf = bytearray(os.path.getsize(filename))
with open(filename, 'rb') as f:
f.readinto(buf)
return buf
下é�¢æ˜¯ä¸€ä¸ªæ¼”示这个函数使用方法的例å�:
>>> # Write a sample file
>>> with open('sample.bin', 'wb') as f:
... f.write(b'Hello World')
...
>>> buf = read_into_buffer('sample.bin')
>>> buf
bytearray(b'Hello World')
>>> buf[0:5] = b'Hello'
>>> buf
bytearray(b'Hello World')
>>> with open('newsample.bin', 'wb') as f:
... f.write(buf)
...
11
>>>
讨论¶
文件对象的 readinto() 方法能被用æ�¥ä¸ºé¢„先分é…�内å˜çš„æ•°ç»„å¡«å……æ•°æ�®ï¼Œç”šè‡³åŒ…括由 array 模å�—或 numpy 库创建的数组。
和普通 read() 方法ä¸�å�Œçš„æ˜¯ï¼Œ readinto() å¡«å……å·²å˜åœ¨çš„缓冲区而ä¸�是为新对象é‡�新分é…�内å˜å†�返回它们。
å› æ¤ï¼Œä½ å�¯ä»¥ä½¿ç”¨å®ƒæ�¥é�¿å…�大é‡�的内å˜åˆ†é…�æ“�作。
æ¯”å¦‚ï¼Œå¦‚æžœä½ è¯»å�–一个由相å�Œå¤§å°�的记录组æˆ�çš„äºŒè¿›åˆ¶æ–‡ä»¶æ—¶ï¼Œä½ å�¯ä»¥åƒ�下é�¢è¿™æ ·å†™ï¼š
record_size = 32 # Size of each record (adjust value)
buf = bytearray(record_size)
with open('somefile', 'rb') as f:
while True:
n = f.readinto(buf)
if n < record_size:
break
# Use the contents of buf
...
�外有一个有趣特性就是 memoryview ,
它å�¯ä»¥é€šè¿‡é›¶å¤�制的方å¼�对已å˜åœ¨çš„缓冲区执行切片æ“�作,甚至还能修改它的内容。比如:
>>> buf
bytearray(b'Hello World')
>>> m1 = memoryview(buf)
>>> m2 = m1[-5:]
>>> m2
<memory at 0x100681390>
>>> m2[:] = b'WORLD'
>>> buf
bytearray(b'Hello WORLD')
>>>
使用 f.readinto() 时需è¦�注æ„�çš„æ˜¯ï¼Œä½ å¿…é¡»æ£€æŸ¥å®ƒçš„è¿”å›žå€¼ï¼Œä¹Ÿå°±æ˜¯å®žé™…è¯»å�–çš„å—节数。
如果å—节数å°�于缓冲区大å°�,表明数æ�®è¢«æˆªæ–æˆ–è€…è¢«ç ´å��了(æ¯”å¦‚ä½ æœŸæœ›æ¯�次读å�–指定数é‡�çš„å—节)。
最å�Žï¼Œç•™å¿ƒè§‚察其他函数库和模å�—ä¸å’Œ into 相关的函数(比如 recv_into() , pack_into() ç‰)。
Python的很多其他部分已�能支�直接的I/O或数�访问�作,这些�作�被用�填充或修改数组和缓冲区内容。
关于解æž�二进制结构和 memoryviews 使用方法的更高级例å�,请å�‚考6.12å°�节。