> For the complete documentation index, see [llms.txt](https://www.devops.buzz/public/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://www.devops.buzz/public/kubernetes/kube-controller-manager/node-crash-recovery.md).

# Node crash recovery

To speed up node crash recovery process, edit kube-controller-manager pod:

```bash
kubectl get -n kube-system pod | grep kube-controller-manager | cut -f1 -d ' ' | xargs kubectl edit -n kube-system pod
```

Add/edit the following parameters:

* `--pod-eviction-timeout=30s` (default 5m0s)
* `--node-monitor-period=2s` (default 5s)
* `--node-monitor-grace-period=16s` (default 40s)&#x20;
* `--pod-eviction-timeout=30s` (default 5m)
* `--node-status-update-frequency`

And, of course, you can always have your deployments with replica 2 and service will be up even if one node goes down.

### References

<https://stackoverflow.com/questions/47317682/kubernetes-node-shutdown-crash-recovery>&#x20;

<https://github.com/kubernetes/kubernetes/issues/55713>
