@metrics_ru

Страница 69 из 681
Andrey
11.12.2016
21:25:16
это потери пакетов

Nick
11.12.2016
21:25:55
самого трафика?

нетфлоу же не зеркалирует трафик?

Andrey
11.12.2016
21:26:29
нетфлоу это протокол

Google
Nick
11.12.2016
21:26:31
или это потеря пакетов с нетфлоу?

Andrey
11.12.2016
21:26:41
он априори не умеет зафиксировать

зеркалировать*

т9

дословно там написано full speed w/no packet loss

Nick
11.12.2016
21:28:16
or very moderate

Andrey
11.12.2016
21:28:21
что означает фулл спид без потери пакетов

Nick
11.12.2016
21:28:35
ну а вообще - сколько проца и сети это съест?

можно положить на вдс, или нужно выделить сервер? Гигабита хватит, чтобы собрать данные за 40 гигабит или надо 10г ставить?

Andrey
11.12.2016
21:30:44
смотря что вы собрались собирать и откуда и как часто и чем анализировать

могу поделиться статистикой следующей

скажем в сутки с одного маршрутизатора снимаю флоу 9й в ELK - это примерно 8 Гб места на сторэдже в сутки по трафику там вообще ерунда, я бы на самом деле задумался о хранилище

Nick
11.12.2016
21:34:47
ок, проще: надо собирать сколько байтиков пришло на каждый внутренний ип и ушло с каждого внутреннего ип за минуту. И вот это охапкой отправлять в нашу базу, остальное там уже сделано.

Google
Andrey
11.12.2016
21:35:08
маршрутизатор один из стека обслуживающих облако, объемы трафика ну по разному днём в пике бывает Гигабит

Nick
11.12.2016
21:35:44
понял, значит и гигабитного порта хватит и в начале можно засунуть в вдс

Andrey
11.12.2016
21:36:29
за глаза, я просто не представляю схему вашей инфры поэтому сложно чтот предложить)

Nick
11.12.2016
21:37:24
бордер -> толстый роутер в ДЦ под проект -> свитч в стойке масштабы маленького регионального дц

Andrey
11.12.2016
21:38:53
тут снова вопросы

вот я как облачный провайдер скажем, мне плевать что там творится внутри клиентских гостевых ос я просто хочу знать кто у меня и сколько гоняет трафика, в данном случае оптимальным вариантом будет снять трафик с пограничного маршрутизатора, наверняка это будет netflow 5 или 9

а дальше смотрите, если вы говорите есть уже что-то готовое

оно может распарсить флоу?

Nick
11.12.2016
21:42:19
нет

вот в этом и вопрос - чем выдавать мне табличку раз в минуту вида ip,in,out

Andrey
11.12.2016
21:42:48
соответственно вам нужно его переварить в удобочитаемый вид для того что уже есть

знать бы что уже есть и что оно поддерживает

вариантов сейчас куча

Nick
11.12.2016
21:44:16
какой-то из роутеров на границе с проектом или бордер умеют отдать нетфлоу 5 и возможно 9.

и уже после - у нас есть готовая обработка минутной статы вида ip,in,out

Andrey
11.12.2016
21:45:59
ну я например принимаю elk стэком для одних нужд, с них же опять же nfdump для других целей и с них же в influx для третьих

тут я думаю напрягать нужно тех кто занимается "готовой обработкой" т.к. я не понимаю что это, что то самописное так?

Nick
11.12.2016
21:48:36
да. но ему на вход нужна табличка ip, in, out. И вот стату с нетфлоу конвертировать в эту табличку я таки все еще не понял - чем?

Andrey
11.12.2016
21:49:09
ну таблички с флоу врятли кто то из коробки вам такие нарисует

Nick
11.12.2016
21:49:41
конкретный формат не важен, конечно

Google
Nick
11.12.2016
21:49:59
и текстом можно и json и csv и т.д.

Uncel
11.12.2016
21:57:42
потери зависят от сэмплирования, если netflow с роутеров\свитчей льете, а не генерите на основе анализа трафика

Алексей
11.12.2016
22:08:43
netflow это потеря времени. приблизительность очень высокая

как праивло современное железо делает семплинг

Nick
11.12.2016
22:08:57
а как правильно?

Алексей
11.12.2016
22:08:59
1:10 это хороший рейт

праивльные вартанты надо изобретать в зависимости от того какое железо есть в наличии

может быть mac accounting если джуник есть

может еще какие то варианты

Nick
11.12.2016
22:09:45
есть топовый микротик например

Алексей
11.12.2016
22:10:14
высок шанс получить бан за это слово при его повторении в приличном обществе.

Nick
11.12.2016
22:10:37
ну зря их где-то не любят, вполне хорошие железки

Алексей
11.12.2016
22:10:51
это сетевые вопросы. лучш езадовать их в соответствующих местах.

Nick
11.12.2016
22:10:55
по крайней мере модели последнего поколения

Виталий
12.12.2016
06:26:18
схожее решение задачи https://github.com/sohonetlabs/cise-elk + http://www.sflow.net/ на худой конец snmpnetstat

Sergey
12.12.2016
20:47:04
Чатик, есть вопрос. Каким агентом измеряют offset lag у Apache Kafka в реальных проектах?

ptchol
12.12.2016
21:19:05
Мы руками снимаем

Sergey
12.12.2016
21:19:19
то есть что-то самописное?

ptchol
12.12.2016
21:19:45
У кафки там в поставке кучка джарничков хелперов

Google
ptchol
12.12.2016
21:20:07
При помощи них можно посмотреть оффсеты по группам

Sergey
12.12.2016
21:20:16
есть такое. а ещё эти джарнички ругаются на то что они почти устарели.

ptchol
12.12.2016
21:20:37
У меня не ругаются )

Ну в конце концов через jmx я думаю тож вытаскивается

Sergey
12.12.2016
21:21:11
эт второй вопрос. в общем, вариант с джарниками "искаропки". понял, спасибо.

ptchol
12.12.2016
21:21:59
Jmx может быть более general вариантом

Sergey
12.12.2016
21:22:45
в теории - да, но вообще сильно зависит от версии кафки.

Admin
ERROR: S client not available

Sergey
12.12.2016
21:23:35
к сожалению, в той баянистой, с которой приходистя работать, в JMX нет ничего ценного - только в ZK.

ptchol
12.12.2016
21:25:31
Баянистой всмысле старой ?

Sergey
12.12.2016
21:25:53
да, что-то в районе pre-0.9

ptchol
12.12.2016
21:26:20
Ну это норм, чего ты уж

Пара лет всего

Не больше

Sergey
12.12.2016
21:26:53
это я потому, что вкуснятина начинается в 0.9.4

ptchol
12.12.2016
21:27:29
Эт да. А у тебя Кафка ванильная или через дистриб какой ?

Sergey
12.12.2016
21:27:49
ванильная

ptchol
12.12.2016
21:28:09
Ну тогда все дороги перед тобой открыты

Sergey
12.12.2016
21:28:42
да уж. я, конечно, написал агента на питоне, который умеет всё читать из ZK. просто на минутку подумал - а не велик ли это.....

fstpk
13.12.2016
06:27:14
шалом метриканы

Google
fstpk
13.12.2016
06:27:28
вопрос такой, кто-нибудь собирал метрики с билдагентов тимсити?

именно самих билдагентов

Антон
13.12.2016
08:34:39
а в prometheus.yml если ты node_exporter на разных машинах установил для сбора метрик, нужно отдельный job_name создавать или достаточно в общий job_name прописать хосты в target? job_name: 'node' static_configs: - targets: ....

Kateryna
13.12.2016
08:37:34
Как я поняла, можно в targets, если все метрики находятся по одинаковому пути если одинаковый metrics_path у всех.

static_configs: - targets: ['localhost:9090', 'localhost:2020'] metrics_path: /metrics вот так работает

Andrey
13.12.2016
08:40:53
Коллеги, добрейшего утра! Кто-то пробовал logstash'Ом собирать флоу?

Антон
13.12.2016
08:40:57
metrics_path по дефолту такой я его не указываю

Kateryna
13.12.2016
08:41:22
да, такой можно не указывать

просто у меня метрики по разным path находятся, и я не нашла как можно в таком случае их все в один job запихать

Антон
13.12.2016
08:42:55
в доках вот # The targets specified by the static config. targets: [ - '<host>' ]

такой еще момент для node_exporter лучше открывать порт 9100 или использовать обратный прокси типа nginx? C https там какая то проблема с валидацией сертификатов, думаю просто порт открыть 9100 в firewalld.

yopp
13.12.2016
11:21:56
само тимсити умеет собирать базовые метрики

всмысле агенты

fstpk
13.12.2016
11:22:17
ну надо

yopp
13.12.2016
11:22:29
тогда в чём вопрос?

чем сбор метрик с билдагентов отличается от сбора метрик с других железок?

или виртуалок? или контейнеров? что у вас там

fstpk
13.12.2016
11:23:03
я же напсал, что с самого агента

Страница 69 из 681