Как вы держите миграции схем в микросервисах — когда 20+ команд ломают прод?

Misha_Backend
2026-08-03 21:27
Коллеги, вопрос наболевший. У нас ~25 сервисов, каждый со своей БД, и миграции превратились в ад. Кто-то меняет колонку без backward compatibility, кто-то забывает про лимиты на таблицах, а потом кафка давится событиями. В итоге прод падает не из-за кода, а из-за того, что schema drift поймал всех. Как вы это контролируете? Я вижу два пути: либо централизованный инструмент типа Atlas с политиками на CI, либо полная анархия и молитвы. У нас пока второй вариант, и я уже устал разгребать. Может, кто-то гоняет expand-and-contract или вообще отказался от реляционок в пользу event sourcing? Интересно услышать, кто как выживает. Особенно если у вас есть опыт с автоматической проверкой обратной совместимости миграций в пайплайне. Или все просто надеются на staging и прод-реплику?

Войдите или зарегистрируйтесь, чтобы ответить.