
Maxim
23.12.2016
10:05:00
сейчас ты в алертманагера передаешь урл /alertmanager

Антон
23.12.2016
10:08:10
trailing slash добавь
Заработало спасибо, рабочий вариант
location /alertmanager/ {
proxy_pass http://localhost:9093;
}

Maxim
23.12.2016
10:09:22
вообще-то я имел в виду trailing slash в proxy_pass, но раз заработало, то и хорошо :D

Антон
23.12.2016
10:12:08
там добавляется #/alerts и получается /alertmanager#

Google

Антон
23.12.2016
10:12:26
поэтому в локешене trailing slash
теперь буду разбираться почему в slack уведомления не падают )
оо только slack стоило упомянуть и уведомление пришло , наверно это из за этих урлов было неверно )

Александр
23.12.2016
10:41:01
Чем снимаете с nginx стату, по мимо средств его самого?

Maxim
23.12.2016
10:42:11

Александр
23.12.2016
10:43:21
Спасибо

Roman
23.12.2016
10:44:25
https://github.com/mailru/graphite-nginx-module

Vladimir
23.12.2016
10:46:25
у нас log_by_lua :)
и модуль на луа экспортирующий статистику

Александр
23.12.2016
10:47:11
Спасибо
Коллеги, кто и как снимает метрики с bcache?
Интересны iops(collectd+grafana)
Стандартный плагин выдаёт дичь какую-то

Google

Pavel
28.12.2016
09:33:50
Вот я и попал сюда

Александр
28.12.2016
09:34:00
Не надо :)

Pavel
28.12.2016
09:42:36
А расскажите что мне делать, если я хочу начать собирать метрики пользовательские
Как жить

Александр
28.12.2016
09:43:10
Мыло и веревка жи(

Pavel
28.12.2016
09:43:28
Ну и церковь у вас тут
Я думал их можно в редис складывать

Александр
28.12.2016
09:43:45
Я так, подгоядваю

Vladimir
28.12.2016
09:53:24
а что ты понимаешь под пользовательскими метриками?
и цели какие?

Pavel
28.12.2016
09:54:32
Нужно знать все как себя ведут пользователи на сайте - какие действия совершают, какой фичей пользуются, как часто и интенсивно. Считать нужно на бэкенде.
Чтобы если какой-то фичей никто не пользуется - откатить ее или проапгрейдить.

Vladimir
28.12.2016
09:55:01
так некоторые люди складывают подобные вещи в кассандру, риак или еще куда

Pavel
28.12.2016
09:57:02
Ну вот я за минуту придумал свой велосипед - берем событие 'x' и инкрементим его в редис по ключу current_timestamp() % 10. так у нас получатся счетчики события на каждые 10 секунд.
Потом все это дело аггрегируем и строим графики.
Раз в час или раз в день там.

Vladimir
28.12.2016
09:57:36
@chebotarevp лучше взять специализированные решения )
а не редис
проще будет потом

Google

Pavel
28.12.2016
09:57:56
тот же кликхаус?

Vladimir
28.12.2016
09:58:21
кликхаус, друид, eventql, vertica, influxdb (может быть)
и не агрегировать их на бэкэнде
а делать агрегацию при построении графиков уже
у каждого решения свои плюсы и минусы будут

Pavel
28.12.2016
09:59:10
О я вспомнил есть же такая штуковина как pinba
Она не модно уже?
Допустим если у меня объем метрик не превышает нескольких мегабайт в день.

Vladimir
28.12.2016
10:00:16
я про пинбу не знаю
ничего не могу сказать к сожалению

Timur
28.12.2016
16:44:21
еще до того как я пришел, у нас программисты придумали складывать их в Google Analytics ?
но там какое-то ограничение на количество точек в месяц

Pavel
28.12.2016
16:46:33
Да туда можно складывать
Но это больше какая то фронтендовая тема

Semyon
29.12.2016
07:07:15
Котаны, у меня идиотский вопрос
у меня есть метрика, которая состоит из точек раз в минуту. Точки принимают ВСЕГО два значения
0 или 1
когда всё хорошо, то они 0, если что-то идет не так, то они 1
проблема в том, что когда я делаю выборку за вчера, у меня все точки null
а, да

Google

Semyon
29.12.2016
07:08:50
графит
извините
когда я делаю выборку from=-2d, то все точки null
когда делаю from=-1d, вижу ноли в положеных местах
я немного в тупике
буду признателен за любые идеи

Roman
29.12.2016
07:11:17
/usr/bin/whisper-info.py blablabla.wsp покажи

Semyon
29.12.2016
07:11:47
maxRetention: 157680000
xFilesFactor: 0.5
aggregationMethod: average
fileSize: 3378292
Archive 0
retention: 86400
secondsPerPoint: 10
points: 8640
size: 103680
offset: 52
Archive 1
retention: 604800
secondsPerPoint: 60
points: 10080
size: 120960
offset: 103732
Archive 2
retention: 157680000
secondsPerPoint: 600
points: 262800
size: 3153600
offset: 224692

Admin
ERROR: S client not available

Roman
29.12.2016
07:13:08
как часто шлешь точки?

Semyon
29.12.2016
07:13:14
раз в минуту

Roman
29.12.2016
07:13:41
они не попадают в Archive 1 и сгорают по прошествии дня
потому что xFilesFactor: 0.5

Semyon
29.12.2016
07:14:17
хм
вообще странно
[overallstatus]
pattern = ^blabla\.overall_status$
retentions = 10s:1y,1min:5y
aggregationMethod = sum
вот правило аггрегации
но похоже я знаю в чем дело
чтобы новые правила аггрегации вступили в силу, нужно ведь грохнуть старые архивы?

Vladimir
29.12.2016
07:16:45

Google

Vladimir
29.12.2016
07:16:55
Ее очень странно делать average
Если у тебя 0 и 1

Semyon
29.12.2016
07:17:07
угу :)
это я вчера ещё осознал и сделал sum
но, похоже, не помогло

Vladimir
29.12.2016
07:17:23
Тоже странно

Roman
29.12.2016
07:17:33
вроде в коплекте виспера есть тулзы для изменения по живому

Vladimir
29.12.2016
07:17:39
Ну тебе правильно сказали про xfile

Semyon
29.12.2016
07:17:43
на самом деле мне нужна сумма единиц на каком-то этапе

Roman
29.12.2016
07:17:58
но проблема не в методе аггрегации, а в xfilesfactor

Semyon
29.12.2016
07:18:01
да, спасибо большое, пойду грызть

Vladimir
29.12.2016
07:27:30

Semyon
29.12.2016
07:28:08
пишут, что xFilesFactor можно
я ведь правильно понимаю, что мне его надо в 0 выставить просто?

Vladimir
29.12.2016
07:28:27
У тебя не только в нем беда
Еще в том что данные ожидаются каждые 10 секунд
А ты шлешь раз в минуту

Roman
29.12.2016
07:34:07
пишут, что xFilesFactor можно
Ну если вдруг встроенные тулзы не умеют, то вот так точно можно https://gist.github.com/lomik/6b0c509ecb60729b9851ffd027581e14 :)

Semyon
29.12.2016
08:15:22
чот теперь другая проблема вылезла
maxRetention: 31536000
xFilesFactor: 0.10000000149
aggregationMethod: last
fileSize: 6307228
Archive 0
retention: 31536000
secondsPerPoint: 60
points: 525600
size: 6307200
offset: 28
теперь какую бы точку я не отправил туда, она приедет как null