Привет! Меня зовут Михаил, в интернете — «Мишка на сервере». Давай на ты — проще обсуждать дело, когда все на одном уровне.
В ИТ с 2003-го, в эксплуатации с 2014-го. Сейчас руковожу SRE в облачном провайдере: строю функцию надёжности с нуля — архитектура observability, on-call-политика, матрица ответственности за сервисы.
До этого: собрал SRE-сообщество в крупнейшем классифайде России (240+ инженеров); запустил с нуля WAFaaS-платформу в кибербезе — от выхода в компанию до первых коммерческих клиентов за 5,5 месяцев, дальше ~250 клиентов и SLA не ниже 99.9%; держал поиск на 5 000+ bare-metal серверов; поднимал инфраструктуру нового банка от staging до production. Родом из небольшой деревушки — сейчас то, что я делаю, работает для миллионов пользователей.
Иду в задачи на стыке эксплуатации и RnD: разобрать непонятный инцидент, поднять в команде практику, которой ещё нет, написать «упрощатор жизни» вместо того, чтобы делать руками одно и то же в третий раз. Руки в код засунуть не стесняюсь — Go и Python. Люблю документацию: она должна быть, и лучше сгенерированная — для этого написал srekit. Член программного комитета DevOpsConf, ментор на GetMentor, автор открытого The Way of SRE. И фотографирую — чисто по кайфу: смотрю на мир своими глазами и иногда делюсь кадрами.
«Мишка на сервере» живёт в нескольких форматах: блог, телеграм-канал и вот это место. Здесь — самый плотный: обобщённый опыт двенадцати лет эксплуатации без глянца, свои ошибки и то, как я из них выбирался, рабочие шаблоны и инструменты. Всё — из своей практики и в обезличенном виде: чужие внутренние документы остаются там, где им положено быть.