【发布时间】:2013-08-08 22:44:36
【问题描述】:
我将实现一个基于作业的线程架构。这意味着一方面,主线程可以将作业附加到一个队列。另一方面,有工作线程,取决于可用 CPU 内核的数量,消耗这些作业并将它们从队列中删除。
现在,我想到了两种在 C++ 中实现该功能的方法。第一个是基于模板的。有一个Task 模板代表一项工作。它拥有一个函数,它可能是一个 lamda 并提供对数据的访问。
要使用它,我们必须在 Work 函数对象中存储一些东西,比如 lambda 表达式。此外,我们需要将Data 指针指向我们的数据对象,然后将Empty 设置为false。当然,对象必须附加到作业队列中。获取作业的工作线程将锁定Access,并且主线程可以每隔一段时间检查锁定以释放以处理结果。
template <class T>
class Task
{
public:
Task()
{
Empty.store(true);
Data = nullptr;
}
std::mutex Access;
std::atomic<bool> Empty;
std::function<void(T*)> Work;
T *Data;
};
第二种方法是基于继承的。空标志和互斥锁与第一种方法一样。但是功函数是一种想要被覆盖的真实方法。此外,我们不再需要数据指针,因为派生任务可以添加它想要的任何成员。
class Task
{
public:
Task()
{
Empty.store(true);
Data = nullptr;
}
std::mutex Access;
std::atomic<bool> Empty;
virtual void Work() = 0;
};
为了更清楚起见,这里有两个简短的示例,说明如何从主线程中启动作业。让我们从第一个开始。
int number;
Task<int> *example = new Task<int>();
example.Data = &number;
example.Empty.store(false);
example.Run = [](int* number){
*number = 42;
});
Queue.push_back(example);
对于第二种方法。
class Example : public Task
{
public:
Example(int *number)
{
this->number = number;
}
void Work()
{
*number = 42;
}
int number;
};
int number;
Example *example = new Example(&number);
example.Empty.store(false);
Queue.push_back(example);
这两种方法在性能和灵活性方面有何不同?
【问题讨论】:
-
为什么不使用英特尔的 TBB(它是免费的、C++、基于任务的多线程并行)?顺便说一句,TBB 使用继承模型,当用户必须重写
tbb::task::execute()函数时,该函数可以使用tbb::task的多个成员,例如生成更多子任务。 -
既然您似乎在使用 C++ 11,为什么不使用
packaged_task? -
模板化Task类的原因是什么?这是示例和任务之间“是”关系的一个明显案例
-
@Mgetz 您能否详细说明如何使用
std::packaged_task来获得所描述的行为?
标签: c++ multithreading templates inheritance architecture