【发布时间】:2017-07-14 08:44:38
【问题描述】:
所以我有一个包含许多行的 txt 文件,如下所示:
2107|Business|2117|Art|2137|Art|2145|English
本质上,这是一个随机的学生专业,以及他们之前宣布的编码的学期和年份。我想要做的是在学期中阅读最初宣布的每个独特专业。从上面的行我需要:
2107:Business
2117: Art
2145: English
我试图用 Python 中的 Pandas 来做这件事,但真的什么都做不了。 任何帮助表示赞赏?
编辑: 应该澄清的。我不希望代码在 Art 的第二个实例中读取。每个专业只有第一个声明和之前的学期。
【问题讨论】:
-
最终结果的类型是什么?只是字符串?
-
字符串工作正常。我想要的最终结果是一个以加密的学生 ID 作为枢轴的数据透视表,下一列将是 3 行显示术语 ('2107','2117','2145') 和最后一列对应的每个学期每行的专业。
-
String 可能不是最好的选择。我想你会想要一个元组。这样数据更容易访问。不过,Blotosmetek 的回答应该不会太难调整以做到这一点,如果字符串对你有用,那么你就是金子。
-
你能发布一部分文本文件和想要的输出吗?
标签: python pandas numpy text-files unique