Audyt IT Infrastruktura IT Outsourcing IT

Jak wygląda profesjonalny miesięczny
przegląd infrastruktury IT?

· 15 min czytania · PRO-Admin

Infrastruktura IT może działać poprawnie przez wiele miesięcy, mimo że stopniowo narastają w niej problemy.

Dysk w macierzy pracuje w stanie ostrzegawczym. Backup kończy się błędem. Certyfikat wygasa za dwa tygodnie. Wolne miejsce na serwerze spada o kilka procent miesięcznie. Jeden z hostów wirtualizacji przestaje przesyłać metryki.

Żaden z tych problemów nie musi od razu spowodować awarii. Razem tworzą jednak ryzyko, które może ujawnić się w najmniej odpowiednim momencie.

Profesjonalny miesięczny przegląd infrastruktury IT służy właśnie temu, aby wykrywać takie sygnały odpowiednio wcześnie. Nie jest to ręczne logowanie się na każdy serwer i pobieżne przejrzenie logów. Dobry przegląd opiera się na aktualnej inwentaryzacji, danych z monitoringu, analizie trendów, weryfikacji backupów, sprawdzeniu bezpieczeństwa, konkretnych zadaniach do wykonania i krótkim raporcie dla firmy.

Po co wykonywać miesięczny przegląd IT?

Monitoring bieżący i miesięczny przegląd pełnią różne funkcje. Monitoring ma wykrywać zdarzenia wymagające szybkiej reakcji: niedostępność serwera, brak miejsca, awarię backupu, wygaśnięcie certyfikatu.

Miesięczny przegląd pozwala spojrzeć szerzej i odpowiada na pytania: czy infrastruktura jest stabilna, czy rośnie ryzyko awarii, czy alerty są właściwie ustawione, czy zasoby wystarczą na kolejne miesiące, czy dokumentacja odpowiada rzeczywistości.

Monitoring pokazuje zdarzenie. Przegląd powinien pokazać trend, przyczynę i dalsze działania.

Czy przegląd raz w miesiącu wystarczy?

Nie wszystkie czynności powinny być wykonywane wyłącznie raz w miesiącu. Nie można czekać do przeglądu z reakcją na brak backupu, awarię RAID, krytyczną podatność czy niedostępność aplikacji - takie zdarzenia powinien wykrywać monitoring i bieżąca obsługa administracyjna.

Miesięczny przegląd jest dobrym rytmem dla podsumowania stanu środowiska, analizy trendów, kontroli realizacji wcześniejszych zaleceń, przeglądu kont i dostępów oraz raportowania do właściciela lub zarządu. W większych albo bardziej krytycznych środowiskach część kontroli wykonuje się tygodniowo, kwartalnie lub po każdej istotnej zmianie.

Od czego rozpocząć?

Pierwszym krokiem jest ustalenie zakresu. Przegląd może obejmować serwery fizyczne, maszyny wirtualne, Proxmox, VMware lub Hyper-V, storage, urządzenia sieciowe, firewalle i VPN, Windows Server i Linux, Active Directory, bazy danych, systemy ERP, Microsoft 365, backup, monitoring, certyfikaty i stacje robocze.

Nie trzeba każdego miesiąca sprawdzać wszystkiego ręcznie od początku. Znaczna część danych powinna pochodzić z Zabbixa, Grafany, Prometheusa, systemu backupowego, EDR i centralnych logów.

Im lepiej zbudowany monitoring, tym mniej czasu zajmuje sam przegląd.

1. Inwentaryzacja i zmiany w środowisku

Na początku warto sprawdzić, co zmieniło się od ostatniego przeglądu: nowe serwery, maszyny wirtualne, konta administratorów, certyfikaty, migracje i integracje.

Typowym problemem jest sytuacja, w której infrastruktura rozwija się szybciej niż dokumentacja i monitoring. Nowa maszyna zostaje uruchomiona „tymczasowo", ale nie trafia do backupu, nie jest monitorowana i nikt formalnie za nią nie odpowiada.

Podczas przeglądu należy porównać system monitoringu, platformę wirtualizacyjną, dokumentację i konfigurację backupu. Jeżeli system istnieje, ale nie znajduje się na którejś z tych list, trzeba ustalić przyczynę.

2. Stan serwerów fizycznych

Dyski i macierze

Warto zweryfikować stan fizycznych dysków, status macierzy RAID, proces odbudowy, stan cache i baterii kontrolera. Nie należy opierać się wyłącznie na SMART odczytanym z systemu operacyjnego - w serwerach z kontrolerem RAID pełne informacje mogą być dostępne dopiero w iDRAC, iLO, IPMI, StorCLI lub MegaCLI.

Każdy stan Degraded, Failed, Predictive Failure albo nieoczekiwanie długa odbudowa wymaga analizy.

Zasilanie, chłodzenie i błędy sprzętowe

Należy sprawdzić stan redundantnych zasilaczy, temperatury, stan UPS i kondycję jego baterii. Serwer z dwoma zasilaczami nie jest redundantny, jeżeli oba są podłączone do jednego przedłużacza albo tego samego pojedynczego UPS.

Warto przejrzeć błędy ECC, Machine Check Exception, błędy PCIe i nieoczekiwane restarty. Nie każdy pojedynczy wpis wymaga wymiany sprzętu, ale powtarzające się zdarzenia powinny zostać odnotowane i obserwowane.

3. Wirtualizacja

Wykorzystanie hostów i stan klastra

Analizujemy użycie CPU, RAM, storage, overcommitment i obciążenie w godzinach szczytu. Średnia miesięczna może ukrywać krótkie okresy przeciążenia - host wykorzystujący przez większość czasu 30% CPU może nadal mieć problem, jeżeli codziennie przez godzinę osiąga pełne obciążenie i powoduje opóźnienia aplikacji.

W zależności od platformy sprawdzamy quorum, komunikację węzłów, HA, replikację i stan shared storage. W Proxmox szczególną uwagę warto zwrócić na stan klastra, corosync, Ceph health, replikację ZFS i Proxmox Backup Server.

Snapshoty i maszyny osierocone

Snapshot nie jest backupem i nie powinien pozostawać bez kontroli przez długi czas. Należy znaleźć stare snapshoty bez opisu i generujące duże zużycie storage - każdy powinien mieć właściciela, cel i plan usunięcia.

Warto też sprawdzić nieużywane VM, testowe klony i osierocone wolumeny. Takie zasoby nie tylko zajmują miejsce - mogą również zawierać stare dane i podatne systemy.

4. Systemy Windows i Linux

Aktualizacje i usługi

Przegląd powinien pokazać brakujące poprawki bezpieczeństwa, systemy po zakończeniu wsparcia i serwery wyłączone z polityki patchowania. Nie należy automatycznie instalować wszystkich aktualizacji bez planu - w środowiskach produkcyjnych potrzebne są okna serwisowe, wcześniejszy backup i plan wycofania. Więcej o bezpiecznym procesie w artykule Dlaczego administratorzy boją się aktualizacji?

Nie wystarczy sprawdzić, czy proces działa - warto też zweryfikować, czy usługa odpowiada funkcjonalnie. Proces SQL Server może działać, ale baza nie przyjmuje nowych połączeń; Nginx może działać, ale aplikacja zwraca błąd 500.

Logi

Zamiast ręcznie przeglądać tysiące wpisów, warto analizować nowe błędy krytyczne, powtarzające się ostrzeżenia, OOM Killer, kernel panic i nieoczekiwane restarty. Centralizacja logów w Graylogu, Loki czy Windows Event Forwarding znacznie ułatwia taki przegląd.

5. Pojemność i wydajność

Jednym z najważniejszych elementów miesięcznego przeglądu jest analiza trendów. Nie chodzi tylko o pytanie „ile miejsca zostało dzisiaj?", lepsze pytanie brzmi: kiedy przy obecnym tempie wzrostu zabraknie miejsca?

Dla każdego istotnego wolumenu warto znać aktualne wykorzystanie, tempo wzrostu i przewidywaną datę zapełnienia. Szczególnej uwagi wymagają bazy danych, logi, backupy i repozytoria.

Przy CPU i RAM nie ma jednego progu 80% dla każdego systemu - serwer bazodanowy może celowo wykorzystywać większość pamięci. Problemem może być natomiast stały swap, rosnąca liczba OOM albo spadek wydajności w szczycie.

Często „wolny serwer" jest tak naprawdę wolnym storage - warto obserwować latency, IOPS i throughput poszczególnych datastore.

6. Backup i możliwość odtworzenia

Backup powinien być jednym z najważniejszych punktów przeglądu: powodzenie ostatnich zadań, zgodność z RPO, kopia off-site, warstwa immutable, retencja i stan repozytorium.

Zadanie może zakończyć się sukcesem, ale nadal nie zapewniać oczekiwanego bezpieczeństwa.

Trzeba zweryfikować, czy backup obejmuje wszystkie systemy, czy wykonuje backup aplikacyjny, czy kopia off-site jest aktualna i czy repozytorium nie jest dostępne tym samym kontem co produkcja. Pełną listę metryk backupowych opisaliśmy w artykule Jak monitorować backupy?

Regularny test przywracania jest ważniejszy niż kolejny zielony raport - może obejmować przywrócenie pliku, odtworzenie bazy albo uruchomienie VM w izolacji. Brak jakiegokolwiek testu przez wiele miesięcy powinien być traktowany jako istotne ryzyko.

Przegląd powinien też odpowiedzieć na pytanie, czy aktualna architektura nadal spełnia wymagania firmy. Jeżeli baza znacząco urosła, odtworzenie może trwać dłużej niż podczas projektowania backupu, a deklarowane RTO może nie mieć już pokrycia w rzeczywistości.

7. Sieć, firewall i VPN

Warto sprawdzić nowe reguły firewalla, tymczasowe wyjątki, reguły bez właściciela i szerokie reguły any-any. Należy też porównać rzeczywiście dostępne porty z dokumentacją - szczególnej uwagi wymagają publicznie dostępne RDP, SSH i panele administracyjne.

Dla VPN sprawdzamy stan tuneli, konta użytkowników, MFA i nieużywane profile. Konta byłych pracowników oraz nieużywane dostępy powinny zostać usunięte.

Dla urządzeń sieciowych warto sprawdzić backup konfiguracji, aktualność firmware i stan zasilania. Backup konfiguracji routera lub firewalla powinien być przechowywany poza samym urządzeniem.

8. Certyfikaty, domeny i usługi internetowe

Podczas przeglądu należy sprawdzić daty wygaśnięcia certyfikatów, poprawność łańcucha i automatyczne odnowienie - certyfikat może być odnowiony na dysku, ale niewczytany przez Nginx, Apache albo HAProxy, dlatego należy sprawdzać certyfikat rzeczywiście prezentowany klientowi. Szczegółowo opisaliśmy to w artykule Monitoring SSL.

W przypadku domen warto upewnić się, że kontakt administracyjny jest aktualny, płatności są skonfigurowane, MFA jest aktywne i dostęp nie należy do byłego pracownika lub agencji.

9. Bezpieczeństwo

Należy przejrzeć konta nieaktywne, konta byłych pracowników, konta administracyjne i uprawnienia uprzywilejowane. Trzeba sprawdzić, czy MFA obejmuje pocztę, VPN, panele administracyjne, chmurę i menedżer haseł - brak MFA na głównym koncie administracyjnym może stanowić większe ryzyko niż wiele drobnych podatności technicznych.

Dla antywirusa i EDR weryfikujemy zasięg agentów, urządzenia bez ochrony i wykryte incydenty. Zielona konsola nie oznacza automatycznie, że wszystkie urządzenia są chronione - trzeba też sprawdzić listę brakujących agentów.

Priorytet podatności powinien uwzględniać dostępność usługi z internetu, możliwość wykorzystania i wartość systemu - nie każda podatność o wysokiej punktacji jest równie istotna w konkretnym środowisku.

10. Active Directory i Microsoft 365

W środowiskach Windows warto sprawdzić stan kontrolerów domeny, replikację, DNS, role FSMO i grupy administracyjne - więcej o tym w artykule Active Directory po 10 latach.

Dla Microsoft 365: konta bez MFA, role administracyjne, logowania podejrzane, licencje i reguły przekierowania poczty. Szczególnej uwagi wymagają skrzynki posiadające automatyczne przekierowania do zewnętrznych domen.

11. Bazy danych i aplikacje biznesowe

Dla SQL Server, PostgreSQL i MySQL warto sprawdzić dostępność, backup, wzrost bazy, replikację, blokady i długie zapytania - metodologię diagnostyki opisaliśmy w artykule Dlaczego SQL Server zwalnia?

Sam fakt, że serwer działa, nie oznacza, że proces biznesowy jest sprawny.

12. Monitoring i alertowanie

System monitoringu również trzeba kontrolować: hosty bez danych, nieaktywne agenty, retencję i dostarczanie alertów.

Warto okresowo wywołać kontrolowany alert testowy i potwierdzić, że dotarł właściwym kanałem, trafił do odpowiedniej osoby i utworzył ticket. Monitoring, który nie potrafi wysłać powiadomienia, jest tylko dashboardem.

Jeżeli system generuje setki wiadomości, administrator zaczyna je ignorować. Podczas przeglądu warto znaleźć najczęstsze alerty bez reakcji i progi generujące szum - każdy alert powinien prowadzić do konkretnego działania.

13. Dokumentacja i dostęp awaryjny

Dokumentacja powinna odpowiadać aktualnemu środowisku: diagram sieci, adresacja, lista serwerów, zależności i runbooki awaryjne.

W menedżerze haseł należy zweryfikować kompletność dostępów, konta współdzielone, MFA i odebrane uprawnienia. Plan awaryjny nie może zależeć od hasła znanego tylko jednej osobie.

14. Licencje, gwarancje i umowy

Warto kontrolować terminy licencji, gwarancje sprzętu, support producenta i koszty chmury. Przegląd może ujawnić zarówno ryzyko wygaśnięcia usługi, jak i niepotrzebne koszty: licencje dla nieaktywnych użytkowników, nieużywane VM w chmurze albo płatny system, którego nikt już nie używa.

Jak powinien wyglądać raport?

Raport nie powinien mieć kilkudziesięciu stron, których nikt nie przeczyta. Najlepiej, aby zawierał:

Podsumowanie

Kilka zdań opisujących ogólny stan środowiska, najważniejsze ryzyka, wykonane działania i potrzebne decyzje.

Status obszarów

Prosta skala: zielony (brak istotnych problemów), żółty (wymaga zaplanowanego działania), czerwony (wymaga szybkiej interwencji).

Lista problemów

Każdy problem z opisem, wpływem, priorytetem, rekomendacją, właścicielem i terminem.

Trendy i decyzje biznesowe

Wykorzystanie storage, wzrost baz, liczba incydentów oraz sytuacje wymagające decyzji: zakup storage, wymiana serwera, wdrożenie drugiego łącza.

Przykładowe podsumowanie miesięczne

Miesięczny przegląd infrastruktury IT - lipiec 2026

Ogólny stan środowiska: stabilny.

Najważniejsze ustalenia:
1. Repozytorium backupowe osiągnęło 82% wykorzystania.
   Przy obecnym tempie wzrostu miejsce wyczerpie się w ciągu około trzech miesięcy.

2. Jeden dysk w serwerze HOST-02 zgłasza stan Predictive Failure.
   Zalecono wymianę w najbliższym oknie serwisowym.

3. Certyfikat usługi vpn.example.pl wygasa za 19 dni.
   Automatyczne odnowienie nie jest skonfigurowane.

4. Trzy nieużywane konta nadal posiadają dostęp do VPN.
   Konta zostały przekazane do dezaktywacji.

5. Test przywrócenia maszyny ERP zakończył się poprawnie.
   Rzeczywisty czas odtworzenia wyniósł 2 godziny i 35 minut.

Co zrobić z wykrytymi problemami?

Przegląd nie kończy się w chwili zapisania raportu. Każde zalecenie powinno trafić do systemu zadań z priorytetem, odpowiedzialną osobą, terminem i sposobem weryfikacji.

Raport bez realizacji zaleceń staje się jedynie dokumentacją narastającego ryzyka.

Jak ustalać priorytety?

Krytyczny

Niesprawny backup systemu krytycznego, zdegradowany RAID bez redundancji, publicznie dostępna krytyczna podatność, brak wolnego miejsca, wygasający certyfikat.

Wysoki

Storage osiągający niebezpieczny poziom, system po zakończeniu wsparcia, nieaktualny firewall, brak testu restore.

Średni

Przestarzała dokumentacja, nieoptymalne alerty, nieużywane licencje, stare snapshoty.

Niski

Zmiana nazewnictwa, archiwizacja dokumentacji, poprawa dashboardu, usunięcie nieużywanego obrazu ISO.

Ile powinien trwać przegląd i co warto zautomatyzować?

Czas zależy od stopnia automatyzacji i wielkości infrastruktury. W małej firmie z kilkoma serwerami dobrze przygotowany przegląd może zająć kilka godzin. W większym środowisku większość danych powinna być zbierana automatycznie, a czas administratora przeznaczony na analizę wyjątków i trendy.

Jeżeli przegląd polega na ręcznym logowaniu się na kilkadziesiąt serwerów i przepisywaniu parametrów do arkusza, warto najpierw poprawić monitoring.

Automatycznie można zbierać wykorzystanie CPU i RAM, pojemność dysków, ważność certyfikatów, wynik backupów i stan RAID. Automatyzacja nie powinna jednak ograniczać się do wysłania ogromnego raportu - administrator nadal musi ocenić znaczenie danych, odróżnić objaw od przyczyny i zdecydować o działaniach.

Najczęstsze błędy

przegląd wyłącznie na podstawie stanu bieżącego
brak monitoringu pomiędzy przeglądami
sprawdzanie backupu bez testu restore
zbyt długa checklista bez priorytetów
brak właściciela zadania
raport techniczny niezrozumiały dla zarządu
brak aktualizacji zakresu przeglądu
przegląd wykonywany bez weryfikacji drugiej osoby

System może dziś wyglądać poprawnie, mimo że trend wskazuje na problem za kilka tygodni. Informacja o rosnącym iowait nie wystarczy dla zarządu - lepiej napisać: „Opóźnienia storage wzrosły i zaczynają wpływać na czas działania ERP. Zalecamy analizę wydajności oraz przygotowanie rozbudowy."

Minimalna checklista miesięczna

  1. 1 Stan serwerów i sprzętu.
  2. 2 Wykorzystanie CPU, RAM i storage.
  3. 3 Stan platformy wirtualizacyjnej.
  4. 4 Aktualizacje bezpieczeństwa.
  5. 5 Status backupów.
  6. 6 Test wybranego odtworzenia.
  7. 7 Stan firewalla i VPN.
  8. 8 Ważność certyfikatów i domen.
  9. 9 Konta administracyjne i nieaktywne dostępy.
  10. 10 Stan monitoringu i alertów.
  11. 11 Nowe błędy w logach.
  12. 12 Aktualność dokumentacji.
  13. 13 Postęp wcześniejszych zaleceń.
  14. 14 Raport z właścicielami i terminami.

Miesięczny przegląd w modelu outsourcingu IT

W wielu małych i średnich firmach nie ma potrzeby zatrudniania osobnego administratora tylko po to, aby utrzymywał kilka lub kilkanaście systemów. Obsługa może zostać powierzona zewnętrznemu zespołowi, ale zakres współpracy powinien być jasno określony.

Profesjonalna usługa nie powinna ograniczać się do reakcji na zgłoszenia typu „nie działa serwer". Powinna obejmować również monitoring, regularne przeglądy, backup, aktualizacje, dokumentację, analizę ryzyka i raportowanie.

W PRO-Admin miesięczny przegląd infrastruktury może stanowić część stałej administracji albo niezależnego audytu. Analizujemy serwery Windows i Linux, Proxmox, VMware i Hyper-V, MikroTik, firewalle i VPN, Active Directory i Microsoft 365, bazy SQL, systemy ERP, backupy, monitoring, certyfikaty i dokumentację.

Przegląd kończymy listą konkretnych problemów i rekomendacji, a nie ogólnym stwierdzeniem, że „wszystko działa".

Kiedy zewnętrzny przegląd ma szczególny sens?

Warto go rozważyć, gdy firma nie posiada stałego administratora, infrastruktura była rozwijana przez wiele osób, backup nie był testowany, występują częste awarie, planowana jest migracja, administrator odszedł z firmy albo zarząd nie ma jasnej informacji o stanie IT.

Zewnętrzny przegląd nie musi oznaczać natychmiastowej wymiany całego środowiska. Największą wartość często daje ustalenie kolejności działań i usunięcie kilku najbardziej niebezpiecznych zaniedbań.

Podsumowanie

Profesjonalny miesięczny przegląd infrastruktury IT nie polega na ręcznym sprawdzeniu każdego wykresu. Powinien łączyć dane z monitoringu, kontrolę backupów, analizę bezpieczeństwa, przegląd zmian, analizę trendów i weryfikację dokumentacji.

Najważniejszym efektem nie jest sam raport. Efektem powinno być wcześniejsze wykrywanie problemów, ograniczenie awarii, lepsze planowanie wydatków i jasno przypisana odpowiedzialność.

Dobrze utrzymywana infrastruktura rzadko staje się tematem rozmów zarządu, ponieważ po prostu działa. Nie jest to jednak przypadek. Zwykle stoi za tym monitoring, regularna administracja i konsekwentna realizacja zaleceń.

W PRO-Admin pomagamy firmom przejść z reaktywnego modelu „naprawiamy, gdy przestanie działać" do proaktywnego utrzymania infrastruktury. Możemy wykonać jednorazowy przegląd, przygotować raport i plan naprawczy albo przejąć stałą administrację serwerami, siecią, backupem i monitoringiem. Dzięki temu problemy są wykrywane wcześniej, a właściciel firmy otrzymuje jasną informację o stanie technologii wspierającej biznes.

Miesięczny przegląd infrastruktury dla Twojej firmy

Regularny przegląd serwerów, backupów, bezpieczeństwa, sieci i monitoringu z konkretną listą rekomendacji i priorytetów - jako element stałej administracji albo niezależny audyt. Bezpłatna wstępna analiza.

Kontakt

Porozmawiajmy o Twoim IT

Odpiszemy najszybciej jak to możliwe. Bezpłatna konsultacja i wycena.

Obsługujemy firmy w Szczecinie, Stargardzie i okolicach oraz realizujemy usługi zdalnie na terenie całej Polski.

Dane kontaktowe

+48 91 885 43 40
biuro@pro-admin.pl
ul. Lutniana 39/3, 71-425 Szczecin

Godziny kontaktu

Pn–Pt 8:00–17:00
Sob–Ndz Zamknięte
Monitoring & alerty 24/7

Dziękujemy za kontakt!

Wiadomość została wysłana. Odpiszemy najszybciej jak to możliwe.

Ta strona używa narzędzi Microsoft Clarity (mapy cieplne, nagrania sesji) oraz Google Analytics (statystyki ruchu) do anonimowej analizy odwiedzin. Nie korzystamy z reklam ani profilowania.