
Paul
05.12.2016
15:57:18
нет, именно 2->5 full cluster restart. Как я понял, ноды можно обновлять по одной, но нужно отключать миграцию данных между ними на время обновления
иначе будет ад

Alexander
05.12.2016
15:57:38
ну да, логично

Paul
05.12.2016
16:02:33
просто при миноре они вообще без проблем обновляются

Google

ptchol
05.12.2016
16:10:41
все мажорные релизы несовместимы и требуют полного рестарта кластера
Но обновление можно произвести хитрее, если вам позволительна остановка инжеста данных в эластик
вы можете просто одну ноду апнуть на новой версии и нацелить аппы, если заведется просто остальные цепануть.
если всё подохло, то откатить у тодну и ресинкнуть её

Alexander
05.12.2016
16:21:16
вопрос
2ha/3elastic/4logstash ок схема?

ptchol
05.12.2016
16:31:24
отстой

Sergey
05.12.2016
16:36:30

Алексей
05.12.2016
16:37:09
он за бабло

Semyon
05.12.2016
16:37:26

Алексей
05.12.2016
16:37:39
делай это! муахаха!

Александр
05.12.2016
16:37:43
Ненавижу графану

Semyon
05.12.2016
16:37:51
Алексей, я понимаю, что тебе трудно страдать в одиночку

Google

Алексей
05.12.2016
16:37:57

Semyon
05.12.2016
16:38:01
но это не повод сбивать людей с прямого пути
вообще можно поставить риман :3
И наливать метрики параллельно в инфклюкс и графит
и посмотреть потом, что больше понравится
(графит больше понравится)

K
05.12.2016
16:40:21

Алексей
05.12.2016
16:40:46

Paul
05.12.2016
16:40:57

Алексей
05.12.2016
16:41:14
1,1 пока радует.

Serge
05.12.2016
16:42:52

Алексей
05.12.2016
16:43:08
это же александр, не будет там аргументов

Sergey
05.12.2016
16:44:30
он за бабло
Я так понял у них про облачные решения и поддержку денег берут, а kapacitor в сорцах лежит. Чет мутно на сайте

Alexander
05.12.2016
16:45:13

Dmitry
05.12.2016
16:55:50
за кластер они бабла хотят
и за хронограф

ptchol
05.12.2016
17:03:25

Александр
05.12.2016
17:23:39

Uncel
05.12.2016
18:17:23
opentsdb и прочее поверх кассандры кто-то использует?

K
05.12.2016
18:20:23
да, про opentsdb интересно

Google

Magistr
05.12.2016
18:35:34
у opentsdb большой оверхед по диску и ему нужен hbase, я бы там например котировки валют хранил, т.е те данные точность которых надо сохранить

Виталий
06.12.2016
09:10:49
указывать в телеграфе мибы оказалось не очень хорошей идеей. сейчас запускается примерно 60 запросов длительных и вижу в процессах столько же
2876 ? R 0:00 snmptranslate -Td -Ob RFC1213-MIB::ifMtu
2877 ? R 0:00 snmptranslate -Td -Ob RFC1213-MIB::ifMtu
2878 ? R 0:00 snmptranslate -Td -Ob RFC1213-MIB::ifSpeed
2889 ? R 0:00 snmptranslate -Td -Ob RFC1213-MIB::ifSpeed
2890 ? R 0:00 snmptranslate -Td -Ob RFC1213-MIB::ifInOctets
2891 ? R 0:00 snmptranslate -Td -Ob RFC1213-MIB::ifPhysAddress
2892 ? R 0:00 snmptranslate -Td -Ob RFC1213-MIB::ifPhysAddress
сожрал cpu

Dmitry
06.12.2016
09:20:37
они психи
хорошо что IFMIB
будь MIB с большим количеством зависимостей - хост будет тупо парсить mib'ы

Александр
06.12.2016
16:39:38

Paul
06.12.2016
16:47:32
ее по моему до конца никто не понимает

Александр
06.12.2016
16:48:19
Ну... можно закинуться тем же что и разрабы и постигать дзен
)))

Fduch
06.12.2016
17:06:02
Селинукс проста и логична :)

Fduch
06.12.2016
17:06:07
Прям как иптаблес.

Александр
06.12.2016
17:06:53
Да? Значит я не постиг ещё дзен

Fduch
06.12.2016
17:07:21
Угу, отсыпать? ;)

Александр
06.12.2016
17:07:34
Нее, сам выращиваю

Paul
06.12.2016
17:26:36
а вот дальше начинаются нюансы

Александр
06.12.2016
18:25:27
ethstat plugin: No stats available for bond1
Как такое может быть? O_o

Google

Александр
06.12.2016
18:32:10
Всё разобрался, указываются физические интерфейсы, странно что в доке ничего не сказано об этом.

Alexey
06.12.2016
18:45:12
Где-то в доках по апгрейду было, но я не пробовал
А, так вроде даже с первой версии можно:
https://www.elastic.co/guide/en/elasticsearch/reference/current/reindex-upgrade.html#reindex-upgrade-remote

Magistr
08.12.2016
18:12:18
https://telegram.me/clickhouse_ru тут сегодня хороший разговор о скейлинге графита

Sergey
08.12.2016
18:27:00
Всем привет. В интернетах набрёл на ссылку на Графану википедии, посмотрел, показалось интересным: https://grafana.wikimedia.org/. Какие-то дашборды - спорные, какие-то - хороши в качестве образца/примера/быстрого справочника.

Admin
ERROR: S client not available

Vladimir
08.12.2016
18:32:31
у википедии даже есть где-то описание того какая у них архитектура
https://wikitech.wikimedia.org/wiki/Graphite что-то такое

Sergey
08.12.2016
18:34:57
интересно, что у них в стеке имеет место statsd
и их же ганглия - https://ganglia.wikimedia.org

Igor
08.12.2016
18:47:07
а там реально кладезь
— похоже, это единственная действительно крупная организация, IT-инфраструктура которой открыта

Dmitry
08.12.2016
18:55:03
интересно, что собирают в statsd/graphite похоже через diamond

Антон
08.12.2016
18:55:25
привет, а кто может подсказать по prometheus хочу развернуть у себя, но никак не могу найти четкой информации по системным требованиям, если разворачивать на обычных виртуалках под centos сколько делать виртушек под фронт, бэк и сколько ресурсов выделить для мониторинга 100-200 машин?

Sergey
08.12.2016
19:04:46
скромно замечу, что в вопросе не хватает конкретики. сколько метрик в секунду планируется собирать? от этого уже можно начать какие-то прикидки, хотя бы ориентируясь на ту же инфраструктуру викимедиа.

Антон
08.12.2016
19:13:38

Vladimir
08.12.2016
19:15:33

Sergey
08.12.2016
19:15:48
почему же? конечно, можно. решать, как именно делать - это привилегия/обязанность администратора ? а размерность в метриках в секунду просто хорошо подходит для оценки производительности того или иного решения.

Vladimir
08.12.2016
19:15:49
Можно слать хоть точку в день

Google

Антон
08.12.2016
19:15:56
мне нужно не много в основном ос метрики, пару метрик для БД и нужен веб чек, проверка сертификатов
для алертов

Sergey
08.12.2016
19:17:24
проверка валидности сертификатов - это больше к алертингу относится, как мне кажется.

Антон
08.12.2016
19:19:59
да эт к алертам
так как оценивать ресурсы?
или хотя бы с какой базовой конфигурации начать

Sergey
08.12.2016
19:24:33
ос = 4 метрики(диск, сеть, память, проц)*100 машин = 400 метрик. если брать их раз в минуту - так это весьма средней руки графит вроде получается (6-7 метрик в секунду). я бы алертинг вынес на отдельную ноду, т.к. будет заметно грузить. предлагаю чатику меня поправить - могу ошибаться.

Vladimir
08.12.2016
19:25:33
То есть это не нагрузка
Имхо ее такую выжмет баш скрипт дергающий гнуплот на txt файл
Как убил - оцениваешь во что уперсч. Потом понимаешь планку на процентов 20 и смотришь стабильно ли держит нагрузку пару дней

Sergey
08.12.2016
19:27:23
сурово, но справедливо. никогда не узнаешь пределов, не попытавшись за них выйти.

Антон
08.12.2016
19:28:34
да это понятно, просто везде пишут про установку на одну машину те там и графана и алерты и сам сервер, можно конечно из под докера запустить все, но думаю так не очень правильно

Sergey
08.12.2016
19:29:45
докер здесь предполагается для справедливого деления ресурсов хоста?

Антон
08.12.2016
19:30:21
я хотел поставить на одну машину сервер с алертами, на другую графану

Vladimir
08.12.2016
19:30:25
Дальше можешь сапроксимировать уже