Size: a a a

Ceph — русскоговорящее сообщество

2021 March 11

ВС

Вячеслав Синельников... in Ceph — русскоговорящее сообщество
Ну а фактор репликации подразумевает диски больше пралььно!?
источник

AK

Artemy Kapitula in Ceph — русскоговорящее сообщество
Ну вот если сам знаешь ответ на вопрос - нахрена спрашивать?
источник

ВС

Вячеслав Синельников... in Ceph — русскоговорящее сообщество
Artemy Kapitula
Ну вот если сам знаешь ответ на вопрос - нахрена спрашивать?
Догадываюсь но хочется точный ответ от бывалых )
источник

Am

Alexander mamahtehok in Ceph — русскоговорящее сообщество
Вячеслав Синельников
Ну а фактор репликации подразумевает диски больше пралььно!?
ну вообще то не обязательно )
источник

DS

Dmitry Sidorov in Ceph — русскоговорящее сообщество
Вячеслав Синельников
Всем привет скажите есть 6 НОД по сколько гб нужно выделить на каждой ноде чтоб образовать 1тб хранилище?
а в Ceph надо выделять диск или место на диске? на ZFS пойдет?
источник

ТС

Татьяна Скобельцына... in Ceph — русскоговорящее сообщество
Ребят, всем привет, нужна помощь. Случайно оказались рестартованы несколько mds сразу от одной фс (max_mds=3). Всего было 7 mds, 3 всегда активно, еще 3 от них standby-replay и 1 просто satndby. зАрестартили все активные почти сразу. Реплей переключились, но уже полчаса висят в состоянии (replay — resolve —rejoin) - не переходя в состояние active. Их видать по какому то таймауту снова выкидывает, снова пытаются включиться другие standby-replay (для своих рангов) и так по кругу
источник

ТС

Татьяна Скобельцына... in Ceph — русскоговорящее сообщество
вопрос -что делать?
источник

ТС

Татьяна Скобельцына... in Ceph — русскоговорящее сообщество
ceph version 13.2.5
источник

Am

Alexander mamahtehok in Ceph — русскоговорящее сообщество
Останови стендбаи и дождись пока поднимутся активы
источник

ТС

Татьяна Скобельцына... in Ceph — русскоговорящее сообщество
Да они каким то образом в конечном итоге сами поднялись. Просто это сепх.
источник

ТС

Татьяна Скобельцына... in Ceph — русскоговорящее сообщество
Повеселило в логах вот это
источник

ТС

Татьяна Скобельцына... in Ceph — русскоговорящее сообщество
источник

ТС

Татьяна Скобельцына... in Ceph — русскоговорящее сообщество
там еще и сегфолты оказывается были
источник

ТС

Татьяна Скобельцына... in Ceph — русскоговорящее сообщество
Alexander mamahtehok
Останови стендбаи и дождись пока поднимутся активы
просто хотелось найти настройку, некий таймаут, grace period. Который можно увеличить и сеф будет дольше ждать пока поднимется mds не пытаясь переключиться на реплей.
вот например mds_heartbeat_grace. Толком не гуглится нигде, что настройка делает.
источник

ТС

Татьяна Скобельцына... in Ceph — русскоговорящее сообщество
хотя хартбит скорее всего не совсем про это
источник

А🐎

Александр 🐎... in Ceph — русскоговорящее сообщество
1296   // NB not enabling suicide grace, because the mon takes care of killing us
1297  
// (by blacklisting us) when we fail to send beacons, and it's simpler to
1298  
// only have one way of dying.
1299  
auto grace = g_conf().get_val<double>("mds_heartbeat_grace");
1300   g_ceph_context->get_heartbeat_map()->reset_timeout(hb, grace, 0);
1301 }
источник

А🐎

Александр 🐎... in Ceph — русскоговорящее сообщество
Хня какая-та
источник

А🐎

Александр 🐎... in Ceph — русскоговорящее сообщество
🤔
источник

А🐎

Александр 🐎... in Ceph — русскоговорящее сообщество
/**
1283
* Call this when you take mds_lock, or periodically if you're going to
1284
* hold the lock for a long time (e.g. iterating over clients/inodes)
1285
*/
1286 void
MDSRank::heartbeat_reset()
1287 {
1288  
// Any thread might jump into mds_lock and call us immediately
1289  
// after a call to suicide() completes, in which case MDSRank::hb
1290  
// has been freed and we are a no-op.
1291  
if (!hb) {
1292       ceph_assert(stopping);
1293      
return;
1294   }
1295
1296  
// NB not enabling suicide grace, because the mon takes care of killing us
1297  
// (by blacklisting us) when we fail to send beacons, and it's simpler to
1298  
// only have one way of dying.
1299  
auto grace = g_conf().get_val<double>("mds_heartbeat_grace");
1300   g_ceph_context->get_heartbeat_map()->reset_timeout(hb, grace, 0);
1301 }
источник

ТС

Татьяна Скобельцына... in Ceph — русскоговорящее сообщество
это судя по всему таймаут для упавшего mds. который внезапно стал для всех мониторов недоступен
источник