【发布时间】:2020-05-18 18:21:08
【问题描述】:
我在 .csv 文件中有下表:
1,123 Sesame Street,Imaginary,XL,Seven Eleven #398,,
2,124 Sesame Street,Imaginary,XL,Seven Eleven #399,,
3,125 Sesame Street,Imaginary,XL,Seven Eleven #400,,
4,126 Sesame Street,Imaginary,XL,Seven Eleven #401,,
5,127 Sesame Street,Imaginary,XL,Seven Eleven #402,,
6,128 Sesame Street,Imaginary,XL,Seven Eleven #403,,
7,129 Sesame Street,Imaginary,XL,Seven Eleven #404,,
8,130 Sesame Street,Imaginary,XL,Seven Eleven #405,,
9,131 Sesame Street,Imaginary,XL,Seven Eleven #406,,
10,132 Sesame Street,Imaginary,XL,Seven Eleven #407,,
11,133 Sesame Street,Imaginary,XL,Seven Eleven #408,,
12,134 Sesame Street,Imaginary,XL,Seven Eleven #409,,
13,135 Sesame Street,Imaginary,XL,Seven Eleven #410,,
14,136 Sesame Street,Imaginary,XL,Seven Eleven #411,,
15,137 Sesame Street,Imaginary,XL,Seven Eleven #412,,
16,138 Sesame Street,Imaginary,XL,Seven Eleven #413,,
该表分为以下列:
DeviceNumber,DeviceStreetAddress,DeviceCity,DeviceState,DeviceStoredAt,DeviceConnect,Keys
我正在尝试在表(包含数千个条目)中搜索其各自列中的某个 DeviceNumber 或 DeviceStreetAddress。搜索应该返回包含搜索信息的整行,以便为我提供有关我正在搜索的设备的附加信息。最好以列表而不是字符串的形式返回。
我发现了一些我尝试过的代码片段,但我通常会遇到如下错误:
UnicodeDecodeError: 'utf-8' codec can't decode byte 0xd0 in position 0: invalid >continuation byte 要么 NameError:名称“列”未定义 等等。
在我多次将头撞到墙上并一遍又一遍地开始之后,我目前有以下代码:
import pandas as pd
df = pd.read_csv('path/to/file.csv')
dev_id = df[0] #this should theoretically give me a list of the device ids
dev_address = df[1] #this should theoretically give me a list of addresses
TBH,我什至不知道我在技术上想要做什么,或者更确切地说如何去做。如果有人能帮帮我,我将不胜感激!
【问题讨论】: