Navern
Ух как все неэффективно оказывается работает)
Александр
Записать одни и теже данные 5 раз
Aleksey
у абстрактного кластера абстрактные шарды. кластер конкретно не эффективен.
Aleksey
архитектор не очень.
Александр
Navern
У 7 девопсов абстрактный кластер без шардов
Igorь
Окей у лучшего кластера и только на запись - как будет?
Aleksey
с гарентией целостности данных ?
Igorь
Да
Aleksey
с двухфазными коммитами ?
Igorь
Да
Aleksey
какой кластер по CAP теореме ?
Igorь
Нет
Aleksey
ни нет. а CA или AP ?
Aleksey
или без А вообще ?
Igorь
CP, доступность как и раньше - не полная
Aleksey
http://digbigdata.com/wp-content/uploads/2013/05/media_httpfarm5static_mevIk.png
Aleksey
окей.
Igorь
CAP теорема для полностью доступных кластеров, что редко. В строгом смысле доступность редко бывает важна. Обычно количество девяток показывает доступность, но это не подходит под CAP
Igorь
Всё, что вы не знали о CAP теореме / Хабр
https://habr.com/ru/post/328792/
Aleksey
ну и отрежем мультк из схемы.
Aleksey
получается что весь пришедший трафик надо отреплицировать дальше.
так что мы весь output будем использовать под отправку в шарды.
получим при 100ке входа перегруз на выход.
Aleksey
кроме того надо надо будет писать нам надо будет еще и читать. при чтении возможно указать правила чтения
Igorь
Как-то ты не так считаешь
Aleksey
правило чтения у нас могу быть majority/all/one
Igorь
Я не говорил, что 100 входа. Я говорил, что полная ширина канала 100
Igorь
Окей у лучшего кластера и только на запись - как будет?
Igorь
Без чтения
Aleksey
вход делить на rf
Aleksey
служебным можно принебречь.
Igorь
Rf+1, если точнее
Aleksey
нет.
Aleksey
in+out не скалдывай
Igorь
А
Igorь
Тогда это 1 мастер и несколько реплик
Aleksey
мы всё еще в понятиях абстрактного кластера ?
Igorь
А в реальности сильно лучше?
Aleksey
у тя может быть ни одна точка входа.
Aleksey
но с учетом гарантий С я признатся запутался
Igorь
Посмотрите статью. Там об этом хорошо рассказано
Aleksey
посмотрю.
George
George
George
И вопрос правильной архитектуры - почему мы вообще говорим про 100мбит ? Это линк у провайдера ? Или на каждую ВМ ? Или где бекбон сеть ?
Igorь
George
George
А скорее от объема данных
Igorь
Нет. Именно от полосы. Объём данных - он в базе записан и к сети отношения не имеет.
George
Нет
George
Не от полосы
Igorь
Ну типа пример: 2 ПБ - это объём данных, который лежит в базе, поток данных, которым он до этого писался и будет писаться 50 мбпс. Это ширина полосы.
George
Womchik
Ну, можно, да
когда? как подписаться?
я вот как раз сегодня случайно эти две репы читал...
George
А вот скорость физлинка - вполне конкретная и определена сверху
Alexander 🐕
George
Теоретически 50мбпс входа могут многократно амплифицироваться в кластере
Igorь
Ну это уже какие-то особые случаи
Oleksandr
Кассандра работает иначе
Oleksandr
Там изначально учли проблему перегруза каналов связи и ввели понятие Rack
Oleksandr
Стойки с серверами
Oleksandr
Но это не абстрактный кластер, а реализация кластера с учётом проблемы топологии
George
Стойки с серверами
Да, но я почти наверняка уверен, что кластерные решения рассчитаны на две сетевухи в ноде
Oleksandr
И переливания данных между узлами кластера
Oleksandr
George
1. Для клиента
2. Чтобы переливать данные между узлами
Oleksandr
Это все на самом деле надо забывать. Если мы про облако
George
Ну, это проще, чем пытаться сделать qos
Oleksandr
Твоя отдельная сетевуха будет бегать по тому же линку как vxlan
George
Oleksandr
Это на самом деле сложные вопросы выбора облаков под те или иные задачи
George
Облака разные есть
George
Есть с 1гбит макс
George
А есть которые 10гбит дают в пределах одной ноды на интерконнект между вм
George
George
Все равно переплачиваешь, причем нехило