Практика

Кейсы по системному администрированию

Разборы типовых отказов и кривой эксплуатации: что было на площадке, какие были рамки, что сделали и чем это кончилось. Клиенты анонимны — отрасль и масштаб, без вымышленных брендов.

Windows Server, Active Directory, DNS, DHCP

Единственный контроллер домена на умирающем железе

У торговой компании остался один DC на диске с ремапами. Домен ещё отвечал, но любая перезагрузка могла оставить людей без входа и без 1С.

Оптовая торговля, ~55 рабочих мест, Москва · 9 рабочих дней

Читать кейс →

Windows file server, NAS, Veeam-подобные задания, 1С

Шифровальщик и «бэкап», который лежал на том же NAS

Ночью зашифровали файловый сервер и бухгалтерские выгрузки. Задания backup были зелёные месяцами — потому что писали на расшаренный том, доступный той же учёткой администратора.

Производство и склад, ~80 рабочих мест, МО · Инцидент: 31 час до рабочей 1С

Читать кейс →

Proxmox VE, LVM, qcow2, Windows/Linux guests

Proxmox: умер диск в «почти RAID», виртуальные машины на local-lvm

Узел из трёх дисков, mdadm «на глаз», VM на local-lvm. Один диск ушёл в failed, гости начали сыпать I/O errors. Кластера не было — был один хост в серверной.

Небольшая производственная площадка, ~25 ВМ, МО · 36 часов до штатной нагрузки

Читать кейс →

RouterOS, PPTP/L2TP, NAT, firewall filter

MikroTik: PPTP в интернет, hairpin и «VPN для всех подряд»

На границе стоял hAP, PPTP был открыт в мир, админский winbox — тоже. Бухгалтерия ходила в 1С «как получится». Нужен был доступ филиала без дыры на весь интернет.

Розница, офис + 2 магазина, Москва · 5 дней, без ночного обрыва магазинов

Читать кейс →

1С:Предприятие, SQL Server, Windows Server

1С «тормозит по сети»: SQL, tempdb и бэкап на одном шпинделе

Жаловались на «медленный интернет до 1С». Сеть была ни при чём: база, tempdb, бэкапы и пользовательские сессии писали на один диск сервера.

Оптовая компания, 18 одновременных сессий 1С, Москва · 4 дня обследования и переноса

Читать кейс →

Ubuntu Server, systemd-journald, Docker, nginx

Ubuntu: корень 100%, сайт «просто лёг», journal съел диск

Прод-сервер интернет-магазина перестал принимать SSH по ключу «иногда». На деле / был забит journal и старыми docker overlay, inode на нуле.

Интернет-магазин, 1 VPS + 1 физический бэкенд, Москва · Инцидент 3 часа + 1 день профилактики

Читать кейс →

Hyper-V, Proxmox VE, Windows/Linux guests, Veeam-архивы

Миграция с Hyper-V на Proxmox без «большого взрыва»

Хост Hyper-V 2012 R2 на исходе железа и лицензии. Нужно было переехать на Proxmox, не устроив субботу «всё лежим, потому что конвертер завис».

Сервисная компания, 14 ВМ, Москва · 3 недели, окна по ночам

Читать кейс →

RD Gateway, IIS, Let's Encrypt/коммерческий TLS, NPS

Истёкший сертификат RD Gateway: «VPN сломался», а это был TLS

В понедельник удалёнка не поднималась. Все чинили маршрутизатор. Сертификату на RD Gateway было 14 дней как просрочен, предупреждения в почте падали в спам.

Бухгалтерия на аутсорсе, 30 удалённых сотрудников, Москва · Инцидент 4 часа, затем регламент на 2 дня

Читать кейс →

Windows file server, NTFS, AD groups, DFS namespace

Файловый сервер: Everyone Full Control и «мы так исторически»

Аудит после утечки коммерческого предложения: шары открыты всем аутентифицированным, вложенные «закрытые» папки не закрыты. Нужно было сузить права, не остановив отделы.

Дистрибьютор, ~70 пользователей, Москва · 2 недели поэтапного сужения

Читать кейс →

Zabbix, Windows/Linux agents, SNMP, Telegram

Zabbix на 3000 алертов в сутки, который никто не читает

Мониторинг «внедрили». Через полгода чат дежурного — белый шум: ping флап, диск 1%, агент down на выключенных ПК. Реальных отказов в шуме не видно.

Сеть клиник, ~40 серверов и сотни ПК, Москва и МО · 10 рабочих дней

Читать кейс →

Active Directory, w32tm, GPO, Kerberos

GPO «не применяются», пароли «иногда не те»: это было время

После замены ИБП контроллер ушёл в 2018 год на час, потом вернулся. Kerberos начал отказывать выборочно. Лечили профили и «переустанавливали Windows».

Логистика, 40 ПК + терминалы, МО · 1 день диагностики, 2 дня закрепления NTP

Читать кейс →

WireGuard/IPsec, 1С thin client, MikroTik, 4G backup

Филиал: 1С через «серый» VPN по 4G и обрывы каждые 20 минут

Второй офис сидел в 1С через SSTP «как получится» на USB-модеме. Проведения документов рвались. Просили «увеличить канал», канал был не при чём — сессии и маршрутизация.

Торговля, офис + филиал 12 человек, МО · 8 дней, пилот на трёх пользователях

Читать кейс →

WSUS, Windows Server, Active Directory, DFSR

WSUS «сам накатил», DC не встал, SYSVOL в ошибке

Вторник патчей. Политика ставила обновления на все серверы сразу, включая единственный живой DC. После ребута — черный экран дольше часа, репликация разъехалась.

Производство, 3 сервера + DC, МО · Инцидент 11 часов, затем пересборка кольца обновлений

Читать кейс →

MikroTik, VLAN, Wi‑Fi AP, firewall, DHCP

Гостевой Wi‑Fi в одном VLAN с бухгалтерией и МИС

В клинике пациенты сидели в той же L2-сети, что регистратура и сервер с карточками. Пароль Wi‑Fi висел на ресепшене. Это не «удобство», это инцидент, который ещё не случился.

Медицинский центр, 2 этажа, Москва · 6 дней, без остановки приёма

Читать кейс →

Смешанный: Windows, Linux, MikroTik, облачная почта

Админ ушёл, пароли в голове, документация — чат в WhatsApp

Ключевой человек уволился в пятницу. В понедельник не знали, где шлюз, какой пароль от ESXi «или это Proxmox?», кто платит за домен и куда бэкап. Нужно было собрать контур, не сломав его поиском.

Офис услуг, ~35 человек, Москва · 12 рабочих дней до управляемого состояния

Читать кейс →

Это не гарантия такого же срока на вашей площадке. Похожая вывеска не значит похожий контур — сначала смотрим факт, потом план. Связанные услуги — в каталоге, методика — в базе знаний.

Консультация

Похожая проблема на вашей площадке?

Опишите инфраструктуру и ожидаемый результат. Уточним вводные и предложим следующий практический шаг.