【问题标题】:how to read ctypes structures from file如何从文件中读取 ctypes 结构
【发布时间】:2016-11-13 12:00:04
【问题描述】:

我正在尝试了解有关 PE 文件结构和 ctypes 结构的更多信息。我有几个问题:

鉴于这个简单的声明:

from ctypes import *

class ImageDosHeader(Structure):
    _fields_ = [
        ('e_magic', c_uint8, 2),
        ('e_cblp', c_uint8, 2),
        ('e_cp', c_uint8, 2),
        ('e_crlc', c_uint8, 2),
        ('e_cparhdr', c_uint8, 2),
        ('e_minalloc', c_uint8, 2),
        ('e_maxalloc', c_uint8, 2),
        ('e_ss', c_uint8, 2),
        ('e_sp', c_uint8, 2),
        ('e_csum', c_uint8, 2),
        ('e_ip', c_uint8, 2),
        ('e_cs', c_uint8, 2),
        ('e_lfarlc', c_uint8, 2),
        ('e_ovno', c_uint8, 2),
        ('e_res', c_uint8, 2),
        ('e_oemid', c_uint8, 2),
        ('e_oeminfo', c_uint8, 2),
        ('e_res2', c_uint8, 2 * 10),
        ('e_lfanew', c_uint8, 4),
    ]

问题1:获得ValueError: number of bits invalid for bit field的原因是什么?

如果我尝试阅读这样的简化结构:

class ImageDosHeader(Structure):
    _fields_ = [
        ('e_magic', c_uint8, 2),
    ]


filename = 'example1_crinkler.exe'
with open(filename, 'rb') as f:
    record = ImageDosHeader()
    f.readinto(record)
    print(record.e_magic)

print('-' * 80)
with open(filename, 'rb') as f:
    content = f.read()
    print(binascii.hexlify(content))
print(len(content))

我得到这个输出:

1
--------------------------------------------------------------------------------
b'4d5a3230504500004c01000001db617f10d017737547ebf9080002000b0111c94585c0791f01d350f7e2903d5c000000f7f339c119dbeb480000400004000000040000000fa32d320140008d0400ebce00000000ebb64206400000005331edbb0300000090be1c0140006a0158bf00004200b1009057eb1200000000000000005a72079229d1040029d060ad01f8742c6a0a5a89145489542410ad31ed4d4501c072fb74af60ac88c232076bc06f028700000000484f00d272ef75f9bf16104200b923e91f03730cf366ab0a06618d760e7bb7c3f7f18d3c5789e931c0ae74040007750241410fb61407d3e201548434487af385db7f0dd02c1f7503d0141ff7d3fe041f6146eb95e86aa6384b0b237bc66f82e9197a11121b13094ff4efbdfffeff7d96008180c090caeaefbdffffffffff44bec48b813eee1868379da18dcb827772cd7a49fe835cc82cc3850cb06603a8fff8e2d9becd3629b3268d3d6cb5ce9fd714516822c6dcc349482dc1e6868f92ed3df97e79469ad174b79b0479d9afb758dd7dd85c9218edef5ca0b47d5dd8aa46494ef4242201baeb2853c31d6f5ac630668462c5543f23a23616db595d1cd08993fce7231e8716b5f79480a1cacd10498fe4864843e744ae3e124c00e74af0173c8346860d98fb9882688c896737e07d3f16ee0d08238b0f0ed89553dbe2b177b64249ca712b9051e88c73'
510

问题2:为什么print(record.e_magic)会打印1?我希望它是“MZ”,或 0x4d5a,或 19802 ......但不是 1,我在这里错过了什么?

NS:我知道 pefile pypi 包或类似包,该包很棒,但我想在这里使用 ctypes 重新发明轮子来了解它,只是为了记录:)

【问题讨论】:

    标签: python ctypes portable-executable


    【解决方案1】:

    这两个问题似乎都表明了同样的误解。引用the ctypes documentation for Structure._fields_:

    对于像 c_int 这样的整数类型字段,可以给出第三个可选项目。它必须是一个小的正整数,用于定义字段的位宽。

    这意味着第三个字段是位数,而不是值的数量。因此,您已指示e_magicuint8 内的一个2 位宽的字段。 ValueError 源于试图从 e_res2 中的 8 位值中提取 20 位。 1 值来自'M' 的最低两位:ord('M')&0b11 == 1

    您可以通过为 16 位字段选择更好的匹配类型(例如 c_uint16)或创建其他结构类型(例如 2*c_char)来调整数据类型。除非你真的在处理bit field,否则避免使用第三个条目; ctypes 已经知道其类型的大小。

    【讨论】:

    • 差不多。它将读取 1 个字节(八位字节),然后将其分成四个 2 位字段:e_magic 到 e_crlc,因为它们总共加起来 8 位。或者,如果错误没有发生,它会。在您只有 e_magic 的示例中,它读取 1 个字节,其中忽略了前 6 位。
    猜你喜欢
    • 1970-01-01
    • 2015-04-06
    • 1970-01-01
    • 1970-01-01
    • 2014-12-30
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多