【发布时间】:2015-04-15 20:16:35
【问题描述】:
我在MultiIndexContainer下面用过
typedef multi_index_container<PositionSummary*,
indexed_by<
ordered_unique<
composite_key<PositionSummary, const_mem_fun<PositionSummary, int, &PositionSummary::positiondate>,
const_mem_fun<PositionSummary, const std::string&, &PositionSummary::accountid>,
const_mem_fun<PositionSummary, const std::string&, &PositionSummary::instid> > >,
ordered_unique<
composite_key<PositionSummary, const_mem_fun<PositionSummary, int, &PositionSummary::positiondate>,
const_mem_fun<PositionSummary, const std::string&, &PositionSummary::instid>,
const_mem_fun<PositionSummary, const std::string&, &PositionSummary::accountid> > >
> > PositionSummaryContainer;
我插入了 10000 个实例*36 个帐户*100 天=3600 万条记录
//Begin testing of the multiIndexContainter
std::cout << "Begin inserting data from array into the multiIndexContainter" << std::endl;
timer.reset();
timer.begin();
for (int i = 0; i < numOfDays_; i++)
{
for (int j = 0; j < accountSize_; j++)
{
for (int k = 0; k < instSize_; k++)
{
PositionSummary* ps = psArray_[(i * accountSize_ + j) * instSize_ + k];
uniqueIndex.insert(ps);
}
}
}
printMemoryUsage();
timer.end();
std::cout << "Time take is " << timer.getInterval() << std::endl;
我发现插入速度有点慢,大约每秒 20K+ 记录... 有没有办法提高这个插入速度? 我的数据在 Oracle 中,已正确编入索引,因此不存在数据结构损坏的危险。我知道在 oracle 中您可以先加载然后构建索引以节省时间,如果有办法,我可以对 MultiIndexContainer 做同样的事情吗? 顺便说一下,并行查询速度还算满意,在4 cpu(8kernal)的机器上查询全部36m的记录只需要2.8秒,代码如下
#pragma omp parallel for collapse(2)
for (int i = 0; i < numOfDays_; i++)
{
for (int j = 0; j < accountSize_; j++)
{
const int& date = dates_[i];
const std::string& accountID = accountIDs_[j];
for (int k = 0; k < instSize_; k++)
{
const std::string& instID = instIDs_[i];
PositionSummaryContainer::iterator it = uniqueIndex.find(boost::make_tuple(date, accountID, instID));
if (it != uniqueIndex.end())
{
#pragma omp atomic
sum2 += (*it)->marketvalue();
}
}
//std::cout << "accountID: " << accountID << std::endl;
}
}
【问题讨论】:
-
如果
psArray_已经被适当组织(也许它甚至是内存映射的?)你也许可以直接查询它
标签: c++ performance boost