服务挂了,怎么自动恢复?

开发 开发工具
上周有个朋友问我:tomcat挂了,站点死了;service出core了,服务死了。如何让挂掉的服务自动启动呢?这里给大伙推荐一个常见的运维工具 supervisor。

上周有个朋友问我:

  • tomcat挂了,站点死了;
  • service出core了,服务死了;

[[357966]]

如何让挂掉的服务自动启动呢?

这里给大伙推荐一个常见的运维工具 supervisor。

supervisor是什么?

用Python开发的通用的进程管理工具。

supervisor有什么用?

supervisor能把一个普通进程变为后台daemon进程,并监控进程状态,在进程异常退出时能够自动重启(或者告警),同时还提供一些相关的管理功能。

supervisor是怎么做到的?

supervisor通过fork/exec的方式,把被管理的进程当作其子进程来启动,在被管理的子进程异常退出时(例如tomcat出异常挂掉,或者服务出core挂掉,或者收到异常信号挂掉),作为父进程可以获取相关信息,以选择后续如何处理。

之前没用过supervisor,这玩意是否靠谱?

supervisor诞生10年以上了,绝对靠谱,绝大部分运维同学都熟知它。

画外音:supervisor是很常见的运维工具,以下几个小问题旨在让不熟悉的同学简单了解相关原理,献丑了。

希望没有浪费这一分钟。

【本文为51CTO专栏作者“58沈剑”原创稿件,转载请联系原作者】

戳这里,看该作者更多好文

 

责任编辑:赵宁宁 来源: 51CTO专栏
相关推荐

2021-08-10 15:32:12

Redis缓存数据库

2021-08-23 10:59:01

Nginx高可用Linux

2022-06-08 08:06:05

LinuxJVM内存

2022-07-24 09:46:48

优雅停机代码

2023-10-25 08:01:30

redis主库服务

2020-05-08 09:11:50

Eureka微服务调通

2015-06-04 16:02:08

顶尖数据文件乱码

2010-10-13 14:37:49

2018-04-24 10:38:46

服务器数据恢复存储

2021-08-02 15:06:46

vim服务Java

2023-02-06 09:31:59

zookeeperRPC框架推空保护

2015-03-26 11:01:11

自动化AWS EBS快照恢复

2012-08-07 09:01:36

灾难恢复云安全云计算

2021-09-06 12:58:26

MQ面试数据库

2022-05-07 20:11:27

AI自动结账服务

2009-09-18 14:06:31

Nis服务器

2015-02-12 09:43:20

2024-04-26 00:00:02

Java线程池策略

2010-05-17 15:00:06

IIS服务

2017-12-19 07:04:01

多云云技术自动化故障
点赞
收藏

51CTO技术栈公众号