Сисадмин со стажем 15 лет
pvmove спас меня несколько раз, когда умирал диск и нужно было срочно эвакуировать данные. Главное — запускать его в screen или tmux, чтобы не потерять прогресс при обрыве SSH-сессии.
Хорошая статья, особенно про AIDE — многие про этот инструмент вообще не знают. Обязательно добавлю в свой чеклист при деплое новых серверов.
В Proxmox cloud-init шаблоны вообще меняют подход к работе с VM — создаёшь один базовый шаблон раз в квартал после обновления образа и клонируешь из него всё что нужно за секунды.
Хорошая шпаргалка, особенно раздел про bridge-сеть — это первое с чем путаются новички когда хотят достучаться до VM из локалки. Советую также глянуть в сторону virsh domxml-from-native для конвертации qemu-команд в XML-конфиги.
Наконец-то нормальная статья про Alertmanager, а то большинство останавливаются на базовой установке и не объясняют группировку. Ингибирование — вообще спасение когда падает целая стойка.
ZFS scrub это вообще отдельная магия, нашёл несколько битых секторов которые аппаратный контроллер вообще не замечал. Теперь только ZFS на хранилищах.
Про воркспейсы согласен, соблазн велик, но потом путаешься. Мы перешли на отдельные директории для каждого env и стало намного спокойнее.
Хорошая статья, но стоило упомянуть nftables-бэкенд — на современных системах он работает заметно быстрее iptables. Ставьте в конфиге banaction = nftables-multiport.
У нас провайдер до сих пор не выдаёт IPv6 на выделенных серверах, только просят заявку подать и ждут непонятно сколько. Пришлось через туннельного брокера (Hurricane Electric) делать, но это костыль конечно.
Цены конечно кусаются, особенно если брать DDR5 RDIMM оптом. Но смотрю на маркетплейсах — б/у серверная память с Xeon-платформ стоит вполне адекватно, можно неплохо сэкономить на тестовых стендах.
Async polling действительно ощущается — у нас много железа с медленным SNMP, раньше постоянно были задержки в очереди. Сейчас намного лучше при тех же ресурсах сервера.
journald у меня на паре серверов сожрал под 20 гигабайт, пока не выставил SystemMaxUse в journald.conf. Советую сразу ограничивать, особенно если сервисы болтливые.
Б/у R740 кстати ещё вполне живые машины, у нас на них Proxmox крутится без проблем. Просто брать нужно с умом, смотреть наработку и проверять память.
А почему OSPF, а не BGP? Просто для таких задач иногда удобнее iBGP внутри, особенно если планируется рост сети и нужна гибкость в управлении маршрутами.
Не забывайте периодически делать тестовое восстановление — verify проверяет целостность данных, но убедиться, что VM действительно загружается из бэкапа, нужно руками хотя бы раз в квартал.