【发布时间】:2016-08-05 16:43:05
【问题描述】:
B"H
我有一个应该用制表符分隔的文件。 Excel打开它没有问题。但是当我尝试 File.ReadAllText() 时,我无法得到一个像样的表示。 我能做的最好的就是使用 UTF8 来返回大部分数据,但是第一行全乱了,文档其余部分的一些选项卡丢失了。
这是使用 UTF8 读取时的第一行: �\u0010\b\u0004c\u0004\0\0�\u0006�\u0003\0\0\0\0!�A\u0004\0\0\0\0\0\0\0\0\u0001 \0\0\0ID\0\0\0\0\0\0C\0\0\0\0\u0006\0\0\0\0\0\0\0\0\0\0\0 \0\0\0\0NAME\0\0\0\0\0\0\0C\0\0\0\0\u001e\0\0\0\0\0\0\0\0\0 \0\0\0\0\0\0ADDR\0\0\0\0\0\0\0C\0\0\0\0(\0\0\0\0\0\0\0\ 0\0\0\0\0\0\0\0ADDRC\0\0\0\0\0\0C\0\0\0\0(\0\0\0\0\0\0\0 \0\0\0\0\0\0\0\0CITY\0\0\0\0\0\0\0C\0\0\0\0\u001e\0\0\0\0\0 \0\0\0\0\0\0\0\0\0\0STATE\0\0\0\0\0\0C\0\0\0\0\u0014\0\0\0\0 \0\0\0\0\0\0\0\0\0\0\0ZIP\0\0\0\0\0\0\0L\0\0\0\0\u0001\0\0 \0\0\0\0\0\0\0\0\0\0\0\0\0\r
以下是在记事本中打开时显示的前几个字节: õc ÁŸ !£A
有人认识这种编码吗?
【问题讨论】:
-
你试过
StreamReader.CurrentEncoding吗? -
StreamReader.CurrentEncoding 仅适用于标准编码。这些文件显然不是标准的。
-
@peter-duniho 这个问题不是重复的。它甚至与您发布的问题无关。该问题询问您如何以编程方式从标准编码的小列表中找到编码。我不需要程序检测。我需要帮助识别这个特定的编码。
-
"我不需要编程检测"——那么你的问题甚至不是编程问题,也不属于 Stack Overflow。改用 superuser.stackexchange.com。或者以编程方式找出编码,每个标记的重复项(你为什么关心如何你找到编码,只要你找到它?)
-
@PeterDuniho 嗨。此问题现已编辑,因此不再给人以重复 How can I detect the encoding/codepage of a text file 的印象。您现在可以删除重复标记吗?
标签: c# utf-8 character-encoding csv