【问题标题】:Linux automatically restarting application on crash - DaemonsLinux在崩溃时自动重启应用程序 - 守护进程
【发布时间】:2011-09-11 05:45:31
【问题描述】:

我有一个运行嵌入式 linux 的系统,它连续运行至关重要。基本上,它是一个与传感器通信并将数据中继到数据库和 Web 客户端的过程。

如果发生崩溃,如何自动重启应用程序?

此外,还有几个线程在进行轮询(例如套接字和 uart 通信)。如何确保没有线程挂起或意外退出?是否有易于使用且线程友好的看门狗?

【问题讨论】:

    标签: c linux embedded watchdog


    【解决方案1】:

    您可以使用forkwaitpid 无缝重启进程,如in this answer 所述。它不会消耗任何大量资源,因为操作系统将共享内存页面。

    只剩下检测挂起进程的问题。您可以使用 Michael Aaron Safyan 指出的任何解决方案,但更简单的解决方案是重复使用 alarm 系统调用,让信号终止进程(相应地使用 sigaction)。只要您继续调用alarm(即只要您的程序正在运行),它就会继续运行。一旦你不这样做,信号就会触发。
    这样,不需要额外的程序,只使用可移植的 POSIX 东西。

    【讨论】:

      【解决方案2】:

      它的要点是:

      1. 您需要检测程序是否仍在运行且未挂起。
      2. 如果程序未运行或挂起,您需要(重新)启动程序。

      有许多不同的方法可以做#1,但我想到的有两种:

      1. 侦听 UNIX 域套接字,以处理状态请求。然后外部应用程序可以询问该应用程序是否仍然正常。如果在某个超时时间内没有得到响应,则可以认为被查询的应用程序已经死锁或死了。

      2. 定期触摸带有预选路径的文件。外部应用程序可以查看文件的时间戳,如果它是陈旧的,那么它可以假定应用程序已死或死锁。

      关于#2,杀死之前的PID并使用fork+exec启动一个新进程是典型的。您也可以考虑将“连续”运行的应用程序变成运行一次的应用程序,然后使用“cron”或其他一些应用程序连续重新运行该单次运行的应用程序。

      不幸的是,看门狗定时器和摆脱死锁是非常重要的问题。我不知道有任何通用的方法可以做到这一点,而且我见过的少数方法非常丑陋,而且不是 100% 没有错误。但是,tsan 可以通过静态分析帮助检测潜在的死锁场景和其他线程问题。

      【讨论】:

      • 任何开箱即用的守护程序可以监视守护程序并重新启动它们哈哈?
      • 在许多嵌入式平台上,您可以让您的看门狗守护进程触发硬件看门狗,确保看门狗不会死
      • 我想支持“调整您的应用程序使其只运行一次,然后重复地重新运行该单次运行的应用程序”的建议。如果可以的话,它将大大简化检测过程。
      【解决方案3】:

      您可以创建一个 CRON 作业 来检查进程是否不时使用 start-stop-daemon 运行。

      【讨论】:

        【解决方案4】:

        使用此脚本运行您的应用程序

        #!/bin/bash
        
        while ! /path/to/program   #This will wait for the program to exit successfully.
        do
        echo “restarting”                  # Else it will restart.
        done
        

        您也可以将此脚本放在您的/etc/init.d/ 中,以作为守护进程启动

        【讨论】:

        • 并确保在dodone 之间放置至少一条指令。
        猜你喜欢
        • 2014-01-05
        • 2014-05-13
        • 1970-01-01
        • 1970-01-01
        • 2011-02-02
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        相关资源
        最近更新 更多