【问题标题】:Clarification required regarding Arrays, Vectors and Maps in usage of a C++ Application在使用 C++ 应用程序时需要对数组、向量和映射进行说明
【发布时间】:2013-07-07 21:35:54
【问题描述】:

我想知道适合我的应用程序的算法和容器类。我正在尝试构建一个客户端-服务器通信系统,其中服务器包含一组文件 (.txt)。文件结构(原型)如下:

A|B|C|D....|Z$(some integer value)#(some integer value)。同样A to Z 的内容是a1_a2_a3_a4......aN|b1_b2_b3_b4......bN|......|z1_z2_z3_z4.....zN。所以我想要做的是当服务器应用程序启动时,它必须一个接一个地加载这些文件并将每个文件的内容保存在一个容器类中,然后再次将文件的内容保存到基于分隔符的特定变量中,即

for (int i=0; i< (Number of files); i++) 
{
1) Load the file[0] in Container class[0];
2) Read the Container class[0] search for occurences of delimiters "_" and "|"
3) Till next "|" occurs, save the value occurred at "_" to an array or variable (save it in a buffer)
4) Do this till the file length completes or reaches EOF
5) Next read the second file, save it in Container class[1] and follow the steps as in 2),3) and 4)
}

我想知道VectorMap 是否符合我的要求?因为我需要搜索出现的分隔符和push_back 它们并在必要时访问。

我可以将整个单个文件作为块读取并使用缓冲区进行操作,或者在文件只读时使用seekg 我可以将值推送到堆栈吗?哪一种会更好、更容易实施?使用regex的可能性有哪些?

【问题讨论】:

  • 我认为您的问题更多地与文件解析有关,而不是数据结构。你可能想读一读。此外,在您的情况下,您绝对应该阅读所有文件(或其中的一大块,如果文件太大),然后继续处理; 不要在文件中来回查找以进行解析! (它会非常缓慢。)
  • 解析,绝对可以使用正则表达式;但是,如果您的值(Ai、Bj、...)是数字(实数值的整数),您可以使用普通的旧 sscanf(甚至 scanf)来读取它们和分隔符。
  • @yzt 嗯,它是字符串和整数的组合... sscanf 在 C++ 中的等价物是 stringstream 我猜?
  • @highlander141:是的。 scanf 系列函数,也可以从 C++ 调用,或者 stringstream 及其类似函数。

标签: c++ regex map vector io


【解决方案1】:

根据输入的格式及其大小,我建议按照以下方式进行操作以读取和解析输入:

void ParseOneFile (std::istream & inp)
{
    std::vector<std::vector<std::string>> data;
    int some_int_1 = 0, some_int_2 = 0;

    std::string temp;

    data.push_back ({});
    while (0 == 0)
    {
        int c = inp.get();

        if ('$' == c)
        {
            data.back().emplace_back (std::move(temp));
            break;
        }
        else if ('|' == c)
        {
            data.back().emplace_back (std::move(temp));
            data.push_back ({});
        }
        else if ('_' == c)
            data.back().emplace_back (std::move(temp));
        else
            temp += char(c);
    }

    char sharp;
    inp >> some_int_1 >> sharp >> some_int_2;
    assert ('#' == sharp);

    // Here, you have your data and your two integers...
}

上面的函数不返回它提取的信息,所以你需要改变它。但它确实将您的一个文件读入一个名为data 和两个整数(some_int_1some_int_2)的字符串向量中。它使用 C++11 并且非常有效地进行读取和解析,无论是在术语处理和内存。

而且,上面的代码检查输入文件中的任何错误和不一致的格式。

现在,针对您的数据结构问题。由于我不知道您的数据的性质,我不能肯定地说。我只能说,二维数组和旁边的两个整数感觉很自然地适合这些数据。由于您有多个文件,您可以将它们全部存储在向量的另一个维度中(或者可能在 map 中,将文件名映射到如下数据结构:

struct OneFile
{
    vector<vector<string>> data;
    int i1, i2;
};

vector<OneFile> all_files;
// or...
// map<string, OneFile> all_files;

上述函数将填充上述OneFile 结构的一个实例。

例如,all_files[0].data[0][0] 将是引用第一个文件中数据项 A0 的字符串,all_files[7].data[25][3] 将是引用数据项 Z3 的另一个字符串> 在第 8 个文件中。

【讨论】:

  • 顺便说一句,上面的代码是对 C++11 有用性的确认,即使是在琐碎的日常代码中!
猜你喜欢
  • 2021-09-07
  • 1970-01-01
  • 2012-04-06
  • 2021-12-03
  • 1970-01-01
  • 2023-03-07
  • 1970-01-01
  • 1970-01-01
  • 2018-01-09
相关资源
最近更新 更多