Actualmente tengo una estrategia de copia de seguridad de MongoDB (en AWS) que implica la automatización de instantáneas diarias del volumen de datos/diarios en un nodo. El proceso es:
Al reemplazar un miembro de RS, lanzo una nueva instancia desde la instantánea y la agrego al conjunto de réplicas. El único problema que tengo es que en el inicio del proceso mongo hay un retraso muy largo (~20-30 minutos para ~500 GB de datos) antes de que el nuevo nodo salte a SECUNDARIO y se reproduzca desde el registro de operaciones de otro miembro. Todo lo que veo es algo como esto en el archivo mongodb.log:
[initandlisten] Starting WiredTigerRecordStoreThread local.oplog.rs [initandlisten] The size storer reports that the oplog contains 659681 records totaling to 4196461664 bytes [initandlisten] Sampling from the oplog between Dec 20 05:29:14:2 and Jan 18 06:00:00:8 to determine where to place markers for truncation [initandlisten] Taking 335 samples and assuming that each section of oplog contains approximately 19672 records totaling to 125140475 bytes