Всем привет.
Подскажите что делать в такой ситуации?
Openshift 3.11, достался от внешнего подрядчика, который когда-то давно все сдал и следов его нет. Инвентори файла нет, /usr/share/ansible/openshift-ansible/playbooks/openshift-checks/certificate_expiry/easy-mode.yaml тоже нет.
Вчера кластер встает раком, все ноды кроме мастера пишут статуc Not Ready. На мастере судя по ивентам был перезапуск kubelet.
Через какое-то время через oc get csr нахожу что все сертификаты в статусе Pending, апрувлю, все взводится. Однако сегодня утром, при попытке просмотров логов и коннекта к терминалу получаю Error from server: error dialing backend: remote error: tls: internal error.
Опять делаю oc get csr и вижу новые Pending, делаю oc get csr -o name | xargs oc adm certificate approve. Сейчас все работает, но уверенности в завтрашнем дне уже нет.
Что смотреть, что исправлять, когда может опять всплыть?
Причем сертификат до 25-го года (см скрин)