【发布时间】:2013-12-08 11:04:10
【问题描述】:
我需要帮助的内容以粗体显示。
我有一个执行多个喷射 HttpRequest 的参与者,请求是分页的,并且参与者确保它按顺序将结果写入数据库(顺序对于恢复爬虫很重要)。我解释这一点是因为我目前不想探索其他并发模式。演员需要从超时中恢复而不重新启动。
在我的演员中,我有以下内容:
case f : Failure => {
system.log.error("faiure")
system.log.error(s"$f")
system.shutdown()
}
case f : AskTimeoutException => {
system.log.error("faiure")
system.log.error(s"$f")
system.shutdown()
}
case msg @ _ => {
system.log.error("Unexpected message in harvest")
system.log.error(s"${msg}")
system.shutdown()
}
但我无法正确匹配:
[ERROR] [11/23/2013 14:58:10.694] [Crawler-akka.actor.default-dispatcher-3] [ActorSystem(Crawler)] Unexpected message in harvest
[ERROR] [11/23/2013 14:58:10.694] [Crawler-akka.actor.default-dispatcher-3] [ActorSystem(Crawler)] Failure(akka.pattern.AskTimeoutException: Timed out)
我的调度如下:
abstract class CrawlerActor extends Actor {
private implicit val timeout: Timeout = 20.seconds
import context._
def dispatchRequest(node: CNode) {
val reqFut = (System.requester ? CrawlerRequest(node,Get(node.url))).map(r=> CrawlerResponse(node,r.asInstanceOf[HttpResponse]))
reqFut pipeTo self
}
class CrawlerRequester extends Actor {
import context._
val throttler = context.actorOf(Props(classOf[TimerBasedThrottler],System.Config.request_rate),"throttler")
throttler ! SetTarget(Some(IO(Http).actorRef))
def receive : Receive = {
case CrawlerRequest(type_,request) => {
throttler forward request
}
}
}
一旦我找到了正确的匹配方式,我是否可以掌握发生超时的 CrawlerRequest ?它包含一些我需要弄清楚如何恢复的状态。
【问题讨论】: