多任务看门狗, 喂狗方法

看门狗分硬件看门狗和 软件看门狗。硬件看门狗是利用一个定时器电路,其定时输出连接到电路的复位端,程序在一定时间范围内对定时器清零(俗称“喂狗”),因此程序正常工作时, 定时器总不能溢出,也就不能产生复位信号。如果程序出现故障,不在定时周期内复位看门狗,就使得看门狗定时器溢出产生复位信号并重启系统。软件看门狗原理 上一样,只是将硬件电路上的定时器用处理器的内部定时器代替,这样可以简化硬件电路设计,但在可靠性方面不如硬件定时器,比如系统内部定时器自身发生故障 就无法检测到。当然也有通过双定时器相互监视,这不仅加大系统开销,也不能解决全部问题,比如中断系统故障导致定时器中断失效。

看门狗本身不是用来解决系统出现的问题,在调试过程中发现的故障应该要查改设计本身的错误。加入看门狗目的是对一些程序潜在错误和恶劣环 境干扰等因素导致系统死机而在无人干预情况下自动恢复系统正常工作状态。看门狗也不能完全避免故障造成的损失,毕竟从发现故障到系统复位恢复正常这段时间 内怠工。同时一些系统也需要复位前保护现场数据,重启后恢复现场数据,这可能也需要一笔软硬件的开销。

图1:(a) 多任务系统看门狗示意图;(b) 相应的看门狗复位逻辑图。

在单任务系统中看门狗工作原理如上所述,容易实现。在多任务系统中情况稍为复杂。假如每个任务都像单任务系统那么做,如图1(a)所示,只要有一个 任务正常工作并定期“喂狗”,看门狗定时器就不会溢出。除非所有的任务都故障,才能使得看门狗定时器溢出而复位,如图1(b)。

而往往我们需要的是只要有一个任务故障,系统就要求复位。或者选择几个关键的任务接受监视,只要一个任务出问题系统就要求复位,如图2(a)所示,相应的看门狗复位逻辑如图2(b)所示。

在多任务系统中通过创建一个监视任务TaskMonitor,它的优先级高于被监视的任务群Task1、Task2...Taskn。 TaskMonitor在Task1~Taskn正常工作情况下,一定时间内对硬件看门狗定时器清零。如果被监视任务群有一个Task_x出现故 障,TaskMonitor就不对看门狗定时器清零,也就达到被监视任务出现故障时系统自动重启的目的。另外任务TaskMonitor自身出故障时,也 不能及时对看门狗定时器清零,看门狗也能自动复位重启。接下来需要解决一个问题是:监视任务如何有效监视被监视的任务群。

图2:(a) 多任务系统看门狗示意图;(b) 正确的看门狗复位逻辑图。

在TaskMonitor中定义一组结构体来模拟看门狗定时器组,

typedef struct

{

UINT32 CurCnt, LastCnt;

BOOL RunState;

int taskID;

} STRUCT_WATCH_DOG;

该结构体包括被监视的任务号taskID,用来模拟“喂狗”的变量CurCnt、LastCnt(具体含义见下文),看门狗状态标志RunState用来控制当前任务是否接受监视。

被监视的任务Task1~Taskn调用自定义函数CreateWatchDog(int taskid)来创建看门狗,被监视任务一段时间内要求“喂狗”,调用ResetWatchDog(int taskid),这个“喂狗”动作实质就是对看门狗定时器结构体中的变量CurCnt加1操作。TaskMonitor大部分时间处于延时状态,假设硬件 看门狗定时是2秒,监视任务可以延时1.5秒,接着对创建的看门狗定时器组一一检验,延时前保存CurCnt的当前值到LastCnt,延时后比较 CurCnt与LastCnt是否相等,都不相等系统才是正常的。需要注意的是CurCnt和LastCnt数据字节数太小,而“喂狗”过于频繁,可能出 现CurCnt加1操作达到一个循环而与LastCnt相等。

如果有任意一组的CurCnt等于LastCnt,认为对应接受监视的任务没有“喂狗”动作,也就检测到该任务出现故障需要重启,这时候 TaskMonitor不对硬件看门狗定时器清零,或者延时很长的时间,比如10秒,足以使得系统重启。反之,系统正常,Task1~Taskn定期对 TaskMonitor“喂狗”,TaskMonitor又定期对硬件看门狗“喂狗”,系统就得不到复位。还有一点,被监视任务可以通过调用 PauseWatchDog(int taskid)来取消对应的看门狗,实际上就是对STRUCT_WATCH_DOG结构体中的RunState操作,该标志体现看门狗有效与否。

这种方式可监视的最大任务数由STRUCT_WATCH_DOG结构数据的个数决定。程序中应该有一个变量记录当前已创建的看门狗数,判断被监视任务Task1~Taskn是否“喂狗”只需比较CurCnt与LastCnt的值n次。

图3:系统复位逻辑图。

硬件看门狗监视TaskMonitor任务,TaskMonitor任务又监视其他的被监视任务Task1~Taskn,形成这样一种链条。这种方 式系统的故障图表示如图3所示。被监视任务Task1~Taskn及TaskMonitor都是或的关系,因此被监视的任一任务发生故障,硬件电路看门狗 就能复位。

为实现多任务系统的看门狗监视功能额外增加了TaskMonitor任务,这个任务占用执行时间多少也是一个重要问题。假设 TaskMonitor任务一个监视周期延时1.5秒,此外需要执行保存当前计数值,判断是否“喂狗”等语句,它的CPU占用时间是很小的。用一个具体的 试验证实,使用50M工作频率的CPU(S3C4510),移植vxWorks操作系统,cache不使能条件下监视10个任务,每个监视周期占用 220~240微秒。可见该任务绝大多数时间都处于任务延时状态。

被监视任务可能有获取消息、等待一个信号量等的语句,往往这个消息、信号量的等待是无限期的等待。这就需要将这类语句作一些修改。比如在vxWorks中将一次无期限的获取信号量操作

semTake(semID, WAIT_FOREVER); // WAIT_FOREVER为无限时间等待

分解为

do

{

ResetWatchDog; // “喂狗”操作

}while(semTake(semID, sysClkRateGet( )) != OK); // 1s内的等待信号量操作

多次的时间范围内的获取信号量操作,这样才能保证及时“喂狗”。

另外需要注意的是系统中是否有的任务优先级比TaskMonitor高并且长时间处于执行状态,TaskMonitor长时间得不到调度,使得看门狗错误复位。良好的任务划分,配置是不应该出现这种高优先级任务长期执行状况的。



PS:

第二种,方案

小弟在uClinux的应用中需要同时启动5个进程,并行运行,且工作环境比较恶劣。为保证系统能够在无人职守的情况下运行正常(至少要保证某个进程出现 问题时系统能够自动重启这几个进程,有严重问题进程重启失败时,整个系统能够自动重新启动),我使用了一个软看门狗机制,其工作机制如下:
系统启动时自动启动一个后台监控进程,由后台进程启动5个功能进程。后台监控进程负责清除硬件看门狗和监控各个功能进程通过FIFO发过来的注册信息(注 册信息中带有系统时间time),如果某个进程超过10s没有新的注册信息到,则监控进程认为此功能进程已经出现问题,它将终止所有功能进程,重新启动各 个进程。如果重新启动功能进程失败,则监控进程将停止喂狗,让整个系统重新启动。
各个功能进程中每个处理周期都要通过FIFO向后台监控进程发送注册信息。由于进程都是信号唤醒的,因而各个功能进程中都使用定时器信号SIGALRM唤醒进程(一般定时2s),并在信号句柄中设置标志,由进程判断此标志并进行注册。

在实际应用中测试发现,有时候会出现进程超时未注册的情况,但检查进程源代码并没有发现问题,系统的心跳时间是10ms,正常情况下应该不会出现注册超时的现象啊?是我的处理机制有问题吗?这种情况下有更好的监控机制吗?

  • 0
    点赞
  • 10
    收藏
    觉得还不错? 一键收藏
  • 2
    评论
### 回答1: 如何实现? FreeRTOS 多任务看门狗可以通过配置 FreeRTOS 的软件定时器来实现。首先,需要创建一个软件定时器,然后在任务中定期重置该定时器。如果定时器超时,就会触发看门狗中断,从而执行相应的处理程序。这样可以确保系统在运行过程中不会出现死锁或其他异常情况。 ### 回答2: FreeRTOS是一个开源的实时操作系统内核,它可以使嵌入式系统的多个任务进行并行执行,并提供了一系列的功能和服务来管理任务之间的调度和通信。而看门狗(watchdog)是一种硬件或软件机制,用于监控和保护系统的稳定性。 在FreeRTOS中,可以通过使用软件看门狗机制来实现任务多任务看门狗功能。首先,需要在系统中创建一个特殊的任务作为看门狗任务,然后让其他任务定期向看门狗任务发送心跳信号。 具体实现方法如下:将看门狗任务设置为低优先级任务,并在其任务函数中设置一个计数器。其他任务在执行时,定期发送心跳信号给看门狗任务,每次发送后,看门狗任务将计数器重置。当其他任务因为某种原因无法发送心跳信号时,看门狗任务的计数器将递增。一旦计数器超过了一个预设的阈值,看门狗任务就会触发一个重启操作。 这种方法可以确保系统中的各个任务都在正常运行,并及时检测到某个任务的异常情况。当某个任务由于故障或死锁等原因停止运行时,看门狗任务将会检测到此种情况,并采取相应的措施来恢复系统的正常运行,例如重启系统或进行故障诊断。 总之,通过在FreeRTOS中实现多任务看门狗机制,可以提高系统的稳定性和可靠性,确保各个任务都能够正常执行,并对异常情况进行及时处理。这对于嵌入式系统的应用来说,尤为重要。 ### 回答3: FreeRTOS是一个用于嵌入式系统的开源实时操作系统。在多任务环境下,实现看门狗功能是非常重要的,以确保系统的稳定性和可靠性。 看门狗是一种硬件或软件机制,用于监视系统的运行状态。当系统出现故障或死锁时,看门狗能够重置系统,使其重新启动或恢复正常运行。在FreeRTOS中,实现多任务看门狗可以通过以下步骤完成: 1. 创建看门狗任务:在FreeRTOS中,可以使用任务创建函数xTaskCreate()创建一个专门用于看门狗功能的任务。这个任务负责定时检测每个任务工作状态。 2. 配置看门狗定时器:FreeRTOS提供了定时器服务,可以用来配置看门狗的定时器。使用定时器服务函数xTimerCreate()创建一个看门狗定时器,并设置定时器的时间间隔。 3. 监测任务工作状态:在看门狗任务中,通过任务管理函数vTaskList()获取当前所有任务的状态和信息。检测每个任务工作状态,包括任务是否处于挂起状态、是否超过预定的时间间隔等。 4. 恢复任务运行:如果发现某个任务工作状态异常,即超过了预定的时间间隔,看门狗任务可以通过任务挂起函数vTaskSuspend()将该任务挂起。然后可以选择重置任务,使其重新启动,并恢复到正常的工作状态。 5. 重置定时器:在看门狗任务中,在对每个任务进行监测后,需要重置看门狗定时器,避免系统误判任务工作状态异常。可以使用定时器服务函数xTimerReset()重置定时器。 通过以上步骤,FreeRTOS的多任务看门狗功能可以有效监测和管理系统中各个任务工作状态,确保系统的稳定性和可靠性。同时,需要根据实际需求和系统情况进行调整和优化,以适应特定的应用场景。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值