详细介绍Python使用struct处理二进制(pack和unpack用法)-Python教程-PHP中文网

首页

后端开发

Python教程

详细介绍Python使用struct处理二进制(pack和unpack用法)

高洛峰

Mar 19, 2017 pm 02:49 PM

struct 二进制

有的时候需要用python处理二进制数据，比如，存取文件，socket操作时.这时候，可以使用python的struct模块来完成.可以用 struct来处理c语言中的结构体.

struct模块中最重要的三个函数是pack(), unpack(), calcsize()

pack(fmt, v1, v2, ...) 按照给定的格式(fmt)，把数据封装成字符串(实际上是类似于c结构体的字节流)

unpack(fmt, string) 按照给定的格式(fmt)解析字节流string，返回解析出来的tuple

calcsize(fmt) 计算给定的格式(fmt)占用多少字节的内存

struct中支持的格式如下表：

Format C Type Python 字节数

x pad byte no value 1

c char string of length 1 1

b signed char integer 1

B unsigned char integer 1

? _Bool bool 1

h short integer 2

H unsigned short integer 2

i int integer 4

I unsigned int integer or long 4

l long integer 4

L unsigned long long 4

q long long long 8

Q unsigned long long long 8

f float float 4

d double float 8

s char[] string 1

p char[] string 1

P void * long

注1.q和Q只在机器支持64位操作时有意思

注2.每个格式前可以有一个数字，表示个数

注3.s格式表示一定长度的字符串，4s表示长度为4的字符串，但是p表示的是pascal字符串

注4.P用来转换一个指针，其长度和机器字长相关

注5.最后一个可以用来表示指针类型的，占4个字节

为了同c中的结构体交换数据，还要考虑有的c或c++编译器使用了字节对齐，通常是以4个字节为单位的32位系统，故而struct根据本地机器字节顺序转换.可以用格式中的第一个字符来改变对齐方式.定义如下：

Character Byte order Size and alignment

@ native native 凑够4个字节

= native standard 按原字节数

< little-endian standard 按原字节数

> big-endian standard 按原字节数

! network (= big-endian)

standard 按原字节数

使用方法是放在fmt的第一个位置，就像’@5s6sif’

例子1：

结构体如下：

struct Header
{
    unsigned short id;
    char[4] tag;
    unsigned int version;
    unsigned int count;
}

登录后复制

通过socket.recv接收到了一个上面的结构体数据，存在字符串s中，现在需要把它解析出来，可以使用unpack()函数：

import struct
id, tag, version, count = struct.unpack("!H4s2I", s)

登录后复制

上面的格式字符串中，!表示我们要使用网络字节顺序解析，因为我们的数据是从网络中接收到的，在网络上传送的时候它是网络字节顺序的.后面的H表示一个unsigned short的id,4s表示4字节长的字符串，2I表示有两个unsigned int类型的数据.

就通过一个unpack，现在id, tag, version, count里已经保存好我们的信息了.

同样，也可以很方便的把本地数据再pack成struct格式：

ss = struct.pack("!H4s2I", id, tag, version, count);

登录后复制

pack函数就把id, tag, version, count按照指定的格式转换成了结构体Header，ss现在是一个字符串(实际上是类似于c结构体的字节流)，可以通过 socket.send(ss)把这个字符串发送出去。

例子2：

import struct
a=12.34
#将a变为二进制
bytes=struct.pack('i',a)

登录后复制

此时bytes就是一个string字符串，字符串按字节同a的二进制存储内容相同。

再进行反操作，现有二进制数据bytes，（其实就是字符串），将它反过来转换成python的数据类型：

#注意，unpack返回的是tuple !!

a,=struct.unpack('i',bytes)

登录后复制

如果是由多个数据构成的，可以这样：

a='hello'
b='world!'
c=2
d=45.123
bytes=struct.pack('5s6sif',a,b,c,d)

登录后复制

此时的bytes就是二进制形式的数据了，可以直接写入文件比如 binfile.write(bytes)

然后，当我们需要时可以再读出来，bytes=binfile.read()

再通过struct.unpack()解码成python变量：

a,b,c,d=struct.unpack('5s6sif',bytes)

登录后复制

’5s6sif’这个叫做fmt，就是格式化字符串，由数字加字符构成，5s表示占5个字符的字符串，2i，表示2个整数等等，下面是可用的字符及类型，ctype表示可以与python中的类型一一对应。

注意：二进制文件处理时会碰到的问题

我们使用处理二进制文件时，需要用如下方法：

binfile=open(filepath,'rb')    
#读二进制文件
binfile=open(filepath,'wb')   
#写二进制文件

登录后复制

那么和binfile=open(filepath,’r')的结果到底有何不同呢？

不同之处有两个地方：

第一，使用’r'的时候如果碰到’0x1A’，就会视为文件结束，这就是EOF。使用’rb’则不存在这个问题。即，如果你用二进制写入再用文本读出的话，如果其中存在’0X1A’，就只会读出文件的一部分。使用’rb’的时候会一直读到文件末尾。

第二，对于字符串x=’abc\ndef’，我们可用len(x)得到它的长度为7，\n我们称之为换行符，实际上是’0X0A’。当我们用’w'即文本方式写的时候，在windows平台上会自动将’0X0A’变成两个字符’0X0D’，’0X0A’，即文件长度实际上变成8.。当用’r'文本方式读取时，又自动的转换成原来的换行符。如果换成’wb’二进制方式来写的话，则会保持一个字符不变，读取时也是原样读取。所以如果用文本方式写入，用二进制方式读取的话，就要考虑这多出的一个字节了。’0X0D’又称回车符。linux下不会变。因为linux只使用’0X0A’来表示换行。

以上是详细介绍Python使用struct处理二进制(pack和unpack用法)的详细内容。更多信息请关注PHP中文网其他相关文章！

本站声明

本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

热AI工具

Undresser.AI Undress

人工智能驱动的应用程序，用于创建逼真的裸体照片

AI Clothes Remover

用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool

免费脱衣服图片

Clothoff.io

AI脱衣机

AI Hentai Generator

免费生成ai无尽的。

显示更多

热工具

记事本++7.3.1

好用且免费的代码编辑器

SublimeText3汉化版

中文版，非常好用

禅工作室 13.0.1

功能强大的PHP集成开发环境

Dreamweaver CS6

视觉化网页开发工具

SublimeText3 Mac版

神级代码编辑软件(SublimeText3)

显示更多

热门话题

gmail邮箱登陆入口在哪里

7540

CakePHP 教程

1381

steam的账户名称是什么格式

win11激活密钥永久

NYT连接提示和答案

显示更多

Related knowledge

使用golang中的json.MarshalIndent函数将结构体转换为格式化的JSON字符串 Nov 18, 2023 pm 01:59 PM

使用golang中的json.MarshalIndent函数将结构体转换为格式化的JSON字符串在使用Golang编写程序时，我们经常需要将结构体转换为JSON字符串，在这个过程中，json.MarshalIndent函数可以帮助我们实现格式化的输出。下面我们将详细介绍如何使用这个函数，并提供具体的代码示例。首先，让我们创建一个包含一些数据的结构体。以下是示

二进制算法怎么算 Jan 19, 2024 pm 04:38 PM

二进制算法是一种基于二进制数的运算方法，其基本运算包括加法、减法、乘法和除法。除了基本运算外，二进制算法还包括逻辑运算、位移运算等操作。逻辑运算包括与、或、非等操作，位移运算包括左移和右移操作。这些操作都有对应的规则和操作数的要求。

EDVAC有哪两个重大的改进 Mar 02, 2023 pm 02:58 PM

EDVAC的两个重大的改进：一是采用二进制，二是完成了存贮程序，可以自动地从一个程序指令进到下一个程序指令，其作业可以通过指令自动完成。“指令”包括数据和程序，把它们用码的形式输入到机器的记忆装置中，即用记忆数据的同一记忆装置存贮执行运算的命令，这就是所谓存贮程序的新概念。

如何使用C语言将二进制转换为十六进制？ Sep 01, 2023 pm 06:57 PM

二进制数以1和0表示。16位的十六进制数系统为{0,1,2,3…..9,A(10),B(11),……F(15)}为了从二进制表示转换为十六进制表示，位串id被分组为4位块，从最低有效侧开始称为半字节。每个块都替换为相应的十六进制数字。让我们看一个示例，以清楚地了解十六进制和二进制数字表示。001111100101101100011101 3 E 5 B&nb

Golang如何读取二进制文件？ Mar 21, 2024 am 08:27 AM

Golang如何读取二进制文件？二进制文件是以二进制形式存储的文件，其中包含了计算机能够识别和处理的数据。在Golang中，我们可以使用一些方法来读取二进制文件，并将其解析成我们想要的数据格式。下面将介绍如何在Golang中读取二进制文件，并给出具体的代码示例。首先，我们需要使用os包中的Open函数打开一个二进制文件，这将返回一个文件对象。然后，我们可以使

计算机内部采用二进制的主要原因是什么？ Apr 04, 2019 pm 02:25 PM

计算机采用二进制的主要原因：1、计算机是由逻辑电路组成，逻辑电路通常只有两个状态，开关的接通与断开，这两种状态正好可以用“1”和“0”表示；2、二进制中只使用0和1两个数字，传输和处理时不易出错，因而可以保障计算机具有很高的可靠性。

轻松学会Go语言中16进制转二进制 Mar 15, 2024 pm 04:45 PM

题目：轻松学会Go语言中16进制转二进制，需要具体代码示例在计算机编程中，经常会涉及到对不同进制数之间的转换操作。其中，16进制和二进制之间的转换是比较常见的。在Go语言中，我们可以通过一些简单的代码示例来实现16进制到二进制的转换，让我们一起来学习一下。首先，我们来了解一下16进制和二进制的表示方法。16进制是一种表示数字的方法，使用0-9和A-F来表示1

负数的二进制怎么表示 Nov 23, 2023 pm 04:11 PM

负数在计算机中采用补码表示，即用正数的二进制补数来表示负数。

See all articles

详细介绍Python使用struct处理二进制(pack和unpack用法)

热AI工具

Undresser.AI Undress

AI Clothes Remover

Undress AI Tool

Clothoff.io

AI Hentai Generator

热门文章

热工具

记事本++7.3.1

SublimeText3汉化版

禅工作室 13.0.1

Dreamweaver CS6

SublimeText3 Mac版

热门话题