Etki
судя по всему, у вас именно апи упал, то, что все остальные контейнеры продолжают жить - так и должно быть, но никаких операций администрирования вы пока, понятно, сделать не можете
Etki
В этом случае он не может освободить место, и те контейнеры, которые пишут себе что-то в верхний слой, рискуют рано или поздно столкнуться с ошибкой записи
Ivan
Хорошо, но почему поды умирают?
Ivan
Как кубы могут удалить под и оставить при этом живой контейнер?
Ivan
Ведь он должен прибить под, при удаление пода умрет и контейнер.
Ivan
А у него поды умерли, а контейнеры живее всех живых
Etki
"Поды умирают" - это по каким физическим признакам был сделан вывод?
Ivan
По признакам, что я не могу достучаться до апишки кубов
Etki
это не поды умерли, это вы до апишки не можете достучаться
Ivan
Хорошо, но я вижу в netstat, что порт не забинжен
Etki
теоретически там уже возможно уже никто ни за чем не следит, но в случае падения самого кубера как системы предполагается, что контейнеры продолжают жить, это ожидаемое поведение
Ivan
А можно как понять без апишки, что в системе есть поды?
Ivan
Скажем по etcd?
Andor
у тебя мастера на тех же нодах живут что ли, где и поды запускаются?
Ivan
Ну да... Это издержки системы
Etki
Если умеете читать исходный код, то да, можете с его помощью проанализировать содержимое etcd и понять текущее состояние системы, но я бы в первую очередь сконцетрировался на возврате привычной работоспособности
Ivan
На то есть причины вообщем.
Andor
ваще апи же вроде стейтлесс, они только в етцд смотрят
Andor
может у тебя етцд помер?
Ivan
Ну его контейнер я вижу
Andor
и?
Ivan
В списке запущенных...
Andor
это не значит что он жив
Ivan
А что вы подразумеваете под словом жив, тогда?
Ivan
Если бы он умер, в смысле процесс, то и контейнер за ним?
Etki
отвечает на запросы в разумное время
Andor
контейнер может например постоянно перезапускаться и примерно ничего не делать
Andor
логи пробовал смотреть?
Andor
апи-то почему помер?
Etki
к тому же у вас все инстансы могли просто потерять друг друга и ждать восстановления кластера. опросить такую штуку тоже вряд ли получится.
Ivan
ImageGc что-то там пришел и попытался очистить память
Ivan
В смысле образ
Andor
и задай себе вопрос: почему рекомендуют мастера и етцд отселять на отдельные ноды
Andor
стрелять себе в ногу мало любителей
Ivan
Вообщем из всего выше сказано может следовать примерно следующее 1) мертвый под != Мертвый контейнер ?
Etki
я бы все-таки еще раз проакцентировал, что мертвых подов пока нет
Ivan
Но апишка недоступна...
Etki
логической связи-то между этим никакой
Ivan
Я бы согласился, но тогда хотя бы сокет был забинжен
Ivan
Или это тоже ничего не значит?
Etki
мы не знаем, что это за сокет, многие вещи делаются через iptables и не отображаются в привычном выводе
Andor
точно место кончилось?
Andor
и аписервер запуститься не может?
Ivan
Да, уверен. Да он судя по логам даже не особо старается запуститься. Scheduler усиленно старается всех на свете прибить подряд. Пока не дошел до api сервиса, у него были ошибки вида - не могу удалить образ, т.к. есть запущенный контейнер. А после того, как постарался прибить апишку, стали валится ошибки - недоступен сервис апи
Ivan
Поэтому я сделал вывод, что он каким-то образом прибил апишку...
Ivan
Вот и стараюсь выяснить, что кубы делают, когда начинали чистить контейнеры и возможна ли смерть пода без убийства контейнера
Andor
а логи-то читал той же самой апишки?
Ivan
Кубы очень много чего делают магического... Это одно из них.
Andor
наоборот, там никакой особой магии нет
Ivan
Да, в syslog
Andor
читаешь логи и обычно всё понятно
Andor
и?
Ivan
И я написал.
Ivan
Да, уверен. Да он судя по логам даже не особо старается запуститься. Scheduler усиленно старается всех на свете прибить подряд. Пока не дошел до api сервиса, у него были ошибки вида - не могу удалить образ, т.к. есть запущенный контейнер. А после того, как постарался прибить апишку, стали валится ошибки - недоступен сервис апи
Ivan
Вот что я вычитал в логах
Ivan
Или сам лог надо?
Andor
про логи апишки ты ничего вообще не написал
Ivan
Хммм, посмотрю
Ivan
Спасибо большое. Посмотрю, отпишусь
Nick
Коллеги подскажите. Gitlab который в облаке использовать в связке ci/cd и k8s использовать можно? До этого в проектах обычно был self hosted всегда. А тут облако на free тарифе. Я так понял там особо ничего изменить под себя нельзя или без разницы будет?
Kanat
Пытаюсь поставить Rancher HA mode на esxi, кто поможет?
Kanat
Что такое cattle server в rancher?
Andrey
Ну «особо изменить под себя нельзя» - выясняется просто же) есть дока, можно потыкать и понять, хватает всего или нет. Я правка их кубер ещё не пользовал, но вот хочу потестить тоже. CI вполне себе ок Работает все
Kanat
https://rancher.com/docs/rancher/v2.x/en/installation/server-installation/ha-server-install/#provision-linux-hosts
Kanat
Кто нибудь пробовал rancher ставить?
Й
забудьте вы это язделие
Kanat
Почему?
Alexandr
Что такое cattle server в rancher?
В версии 1 это движок который проглатывает docker-compose v2
Uncle
Господа, добрый день. Я правильно понимаю, что поднять nginx ingress-controller на своём облаке и без внешнего балансировщика невозможно?
Uncle
Благодарю, пойду гуглить
Kanat
И всё же кто по rancher подскажет?
Kanat
Не могу понять где брать ключи авторизации, хочу кластер поднять и настраиваю yml файл сейчас
Andrey
Товарищи, я правильно понимаю, что пока не задеплоен прометей-оператор, кубер не знает его api Error: apiVersion "monitoring.coreos.com/v1" А как правльно делать чтоб одновременно деплоить все helm-ом?
Andor
запиливать всё вместе в одном манифесте
Andor
хз про хельм