
Maxim
18.10.2016
20:59:08
с цветокоррекцией заебусь...

Serge
19.10.2016
12:32:46
Привет! Меня позвали в церковь. Где алтарь?

Алексей
19.10.2016
12:33:00
а где дары ?

Serge
19.10.2016
12:33:19
жертвуют грешники

Google

Алексей
19.10.2016
12:33:39
у нас особая церковь. надо достать и измерить.

Vladimir
19.10.2016
12:33:46
и нарисовать еще )
и в идеале поалертить

Serge
19.10.2016
12:34:34
у меня просто nodeexporter,prometheus,alermanager,cloudwatch,grafana
ну и свои метрики из приложения на отдельном эндпоинте

Алексей
19.10.2016
12:35:11
а что в списке делает клаудвач ?

Serge
19.10.2016
12:36:42
ну, потому что он меряет
тоже
и я его тоже графаной показываю

Алексей
19.10.2016
12:37:01
а дашик, дашик то есть ?

Serge
19.10.2016
12:37:16
прометеевский?

Алексей
19.10.2016
12:37:48
какой нить
и чем во всей этой схеме ловить вебхуки что бы показывать их на анотациях в графане ?

Google

Serge
19.10.2016
12:40:22
зачем вебхуки?
всё на pull

Алексей
19.10.2016
12:40:37
хочу деплои показывать палками

Serge
19.10.2016
12:41:04
ну это у нас редко

Алексей
19.10.2016
12:47:04
и тем более нужны палки

Сергей
19.10.2016
12:47:37
где девственницы?

Алексей
19.10.2016
12:49:10
Сергей, есть вебхуки ?

Сергей
19.10.2016
12:50:50
ничего нет
все проебали

Serge
19.10.2016
13:26:06

Алексей
19.10.2016
13:26:33
питончик же да ?

Serge
19.10.2016
13:26:40
ну да:)

Алексей
19.10.2016
13:26:54
метрики всегда все отдаются ?

Serge
19.10.2016
13:27:05
из приложения? да, всегда все
они в общем так и нужны
там всё счетчики разного в основном
куча процессов генерит события, обработчики событий инкрементят счетчики событий в редисе

Алексей
19.10.2016
13:28:28
как происходит регстрация всех метрик ?

Google

Алексей
19.10.2016
13:28:46
у нас тут с @dvolodin спор на эту тему вышел
с одной стороны удобно когда все метрики отдаются всегда
с другой стороны их надо регать как то

Serge
19.10.2016
13:29:25
куда регать?
я вижу несколько смыслов в этой фразе:)

Алексей
19.10.2016
13:29:37
ну в реестр что ли

Serge
19.10.2016
13:29:45
на зачем?

Алексей
19.10.2016
13:29:47
что бы ендпоит про них всегда знал
а то ведь некоторые срабоатывают только в каком нить except

Serge
19.10.2016
13:30:32
погоди. по урле приложение отдает срез всех метрик, метрики оно уже внутри себя заранее посчитало
когда дернешь, тогда получишь срез

Алексей
19.10.2016
13:30:48
нее я про другое

Алексей
19.10.2016
13:31:07
вот есть метрика
её на старте нужно инициализировать нулем
и сделать так что бы про нее знал ендпоинт

Serge
19.10.2016
13:32:53
на старте чего? зачем? ну сбрасывается она иногда и по фигу
как счетчик трафика в сетевухе
она же counter
пром сам разберется, что она сбросилась

Алексей
19.10.2016
13:33:35
эта понятно

Google

Алексей
19.10.2016
13:33:39
эх как объяснить

Serge
19.10.2016
13:34:17
пром увидел, собрал, в графане я ввел ее в дашборд, она показалась. ЧЯДНТ?

Алексей
19.10.2016
13:34:33
после рестарта демона, ендпоин отдаст все метрики каие есть в демоне или только уже сработавшие ?

Serge
19.10.2016
13:34:46
все отдаст

Алексей
19.10.2016
13:34:56
откуда он узнает про все метрики ?

Serge
19.10.2016
13:34:57
нет понятия "сработала"

Admin
ERROR: S client not available

Serge
19.10.2016
13:35:13
блядь, сорри, я туда ручками в код написал что считать и откуда показывать

Алексей
19.10.2016
13:35:18
они словариком у него описаны в самом ендпоинте да ?

Serge
19.10.2016
13:35:26
это наше приложение, белый ясчик
ну, не словариком, но да
там ООП во все поля;)

Алексей
19.10.2016
13:36:43
а как многотредовость отрабатывает ?

Serge
19.10.2016
13:36:47
вьюшка с полями, процессор, вьюшка смотрит в процессор, процессор собирает
оно отдельно от приложения лежит. в редисе
и в базке кое-что

Алексей
19.10.2016
13:37:17
ага
все понятно
редисик был не ясной для меня точкой.
тогда проблемы старта нету

Google

Serge
19.10.2016
13:37:49
т.е. да, может ответить любой инстанс

Алексей
19.10.2016
13:37:50
и все метрики сразу заранее известны

Serge
19.10.2016
13:38:19
куча процессов генерит события, обработчики событий инкрементят счетчики событий в редисе

Алексей
19.10.2016
13:40:03
да да. я пропустил слово редис тут :)

Serge
19.10.2016
13:40:17
у нас для rest фреймворка написан специальный форматер, который на этом ендпоинте отрабатывает для прометея;)
а мы можем туда ходить и получать json или html с красиво форматированными метриками:) и дебуг тулбаром
получилось няшно
можно прямо на том же урле даже флеймграф посмотреть при желании:)
mail_queue_len{key="queued", instance="demo_host"} 616
mail_queue_len{key="sent", instance="demo_host"} 4244
вот для этого надо было проверить, что индексы используются в count в sql

Maxim
20.10.2016
08:48:58
блин, чот я озадачен
смотрите
есть простецкий promql query:
rate(net_bytes_recv{host=~"$host.*", interface=~"eth1"}[1m])*8
к нему есть простецкий же алерт
ALERT internal_network_high_throughput
IF rate(net_bytes_sent{interface=~"eth1"}[1m])*8/1000/1000 > 80
FOR 5m

Serge
20.10.2016
08:50:36

Maxim
20.10.2016
08:50:45
раз в десять секунд