@metrics_ru

Страница 43 из 681
Maxim
07.10.2016
18:38:50
бггг

ptchol
07.10.2016
18:48:50
я же говорю.

нужно чтобы фон алертов ложных от мониторинга в день был на одном уровне

отклонения от него является указанием на проблему

Google
Semyon
07.10.2016
18:49:20
садист

ptchol
07.10.2016
18:49:31
зато это проверенно

Semyon
07.10.2016
18:49:55
вообще посылать алерты для мониторинга мониторинга это хреновая идея

Алексей
07.10.2016
18:49:56
тоже ватант да

я думал про него

Semyon
07.10.2016
18:50:11
раз в час посылать алерт "В Багдаде всё спокойно" — это же ад

Алексей
07.10.2016
18:50:19
но он сработает когда алерты первого порядка будет кт то сомтреть

а алерты второго ктото другой

Semyon
07.10.2016
18:50:28
ну то есть да

так можно

ptchol
07.10.2016
18:50:36
не

это стремная затея

Semyon
07.10.2016
18:50:45
но это мало чем отличается от специально обученные люди смотрят в монитор

Google
ptchol
07.10.2016
18:51:15
"фоновый шум" от мониторинга хорош тем, что он срабатывает в разных метсах как бы

и т.о. проверяет не один пойнт

Semyon
07.10.2016
18:51:54
но ведь каждый раз, когда мониторинг генерирует фолс-алерт умирает котёнок!

Алексей
07.10.2016
18:52:00
да

ptchol
07.10.2016
18:52:11
согласен, что вариант ебанутый.

с другой стороны с таким подходом я лучше понимаю общее "состояние" системы вцелом

все эти предикшены настроить сильно сложно

а низкие пороги и "размер фона" работают лучше

Алексей
07.10.2016
18:53:24
с другой стороны с таким подходом я лучше понимаю общее "состояние" системы вцелом
что то у меня давно место не кончалось. видимо что то случилось

так да ?

ptchol
07.10.2016
18:53:54
не, место как раз один из немногих вариантов где предикшены хорошо работают

я скорее про алерты связанные с ио \ цпу \ респонс кодами\ отклонениями в очередях

если конечно вы классные пацаны, у вас там автоскейлы и вверх и вниз и еще раз в день отчет по результатам скелйинга отсылается и стоимость там написана сразу. ну вы классные.

у меня все гораздо уже ))

*хуже

ня ?

Vladimir
07.10.2016
19:09:19
как вы мониторите, что ваша система мониторинга работает?
Перекрестный мониторинг мониторинга мониторингом

В смысле что у нас их две (по графиту и нагиос)

И нагиоса более 1. Вот нагиосы друг друга смотрят

И по графиту тоже смотрим

Google
Vladimir
07.10.2016
19:10:48
И графитный нагиосом до кучи

Semyon
07.10.2016
19:12:57
Mexican standoff

У меня тут мониторинг один, я пока склоняюсь к deadman switch

Zon
10.10.2016
09:34:08
Elasticsearch + Prometheus, какой экспортер используете?

Vladimir
10.10.2016
14:32:32
мля - а я верно понимаю что influxdb кластерный йок?

Алексей
10.10.2016
14:33:08
ога да

Vladimir
10.10.2016
14:33:37
хулишитхэппенс прирключился ;( хорошо что вовремя и я на нее присесть не успел

Алексей
10.10.2016
14:34:12
ну они лочгино хотят жрать чо

односерврная конфа вполне работает

Vladimir
10.10.2016
14:34:44
мне надо регион дистрибутед

Алексей
10.10.2016
14:34:45
а я тут наверное самый главный хейтер инфлюкса

Denis 災 nobody
10.10.2016
14:36:29
а что с ним?

Алексей
10.10.2016
14:37:45
циклические ребуты

выходы за границы массива

долгий старт

Vladimir
10.10.2016
14:38:03
я его так и не попробовал, жил на графите трогать нельзя было

Алексей
10.10.2016
14:38:42
отвертительная обвязка

косяки со сменой размера шарда

мне продолжать ?

Google
Vladimir
10.10.2016
14:49:32
горшочек не вари

лучше посоветуй на что взглянуть

Алексей
10.10.2016
14:53:24
Пром

Vladimir
10.10.2016
14:54:13
пром - сингл нодная ? как быть когда регионы - пусть там стоит свой пром, а кверить по набору регионов как ?

Admin
ERROR: S client not available

Vladimir
10.10.2016
14:55:09
opentsdb - нексолко оверхед ;)

Semyon
10.10.2016
14:55:21
а расскажите за opentsdb

почему все улыбаются, когда про неё говорят?

Phil
10.10.2016
14:56:03
Потому что жаба жи

Semyon
10.10.2016
14:56:14
и чево?

а

Runs on Hadoop and HBase

понятно

ptchol
10.10.2016
14:57:42
opentsdb - нексолко оверхед ;)
разве ? вам нужно на несколько регионов же. это уже предполагает большУю инсталяцию. В иных случааях достаточно релеев всяких.

понятно
да брось, это лучше чем многое что есть.

хотя я не пробовал)

Phil
10.10.2016
14:59:34
и чево?
да "жаба" уже достаточно, чтобы к продукту относиться крайне осторожно

Vladimir
10.10.2016
14:59:47
в клаудере сертифицировался по слонам и с хадуп лайком все время имею дело, просто не хочу, вот не поверишь достало стопятьсот точек отказа

Google
ptchol
10.10.2016
15:11:23
помоему это из разряда баек школьничков )

ptchol
10.10.2016
15:13:44
в клаудере сертифицировался по слонам и с хадуп лайком все время имею дело, просто не хочу, вот не поверишь достало стопятьсот точек отказа
у меня совершенно обратные ощущения. 100500 компонент, дебаг в случае проблем не самый простой, но чтобы это упало прям упало, нужно постараться, в случае корректно настроеных HA

и 99.99% проблема решаются тупым рестартом, что не самое худшее.

Maxim
10.10.2016
16:34:17
https://github.com/prometheus/prometheus/releases/tag/v1.2.1

Vladimir
10.10.2016
16:40:22
И скорость приема данных на ноду высокая.

Разве что тэгов нет

Ну и жестко требует ссд

Vladimir
10.10.2016
16:41:32
И скорость приема данных на ноду высокая.
А я и не спорю, он хорош, но хочется свежего мяса

Vladimir
10.10.2016
16:41:49
А я и не спорю, он хорош, но хочется свежего мяса
Тогда стоит начать с того что не устраивает

Kirill
10.10.2016
16:44:08
Господа, всем привет! У кого-то есть положительный опыт с datadog?

Кто-то его использует для чего-то некоробочного?

Magistr
10.10.2016
16:46:48
он жеж дорогой

Vladimir
10.10.2016
17:02:28
Мне на ЛинуксКон понравились демки sysdig-cloud

Кстати

Страница 43 из 681