CASE STUDY

Taka powinna być każda infrastruktura IT – case study APZ.PL

APZ - logo

Są firmy, w których dział IT to po prostu wsparcie. I są takie, w których jest sercem całego biznesu. W tych drugich każda przerwa, każda utrata danych, każda opóźniona aktualizacja oznacza konkretne straty – czasu, pieniędzy, reputacji. Dla APZ.PL niezawodność to nie dodatek, ale warunek istnienia. Ich infrastruktura IT musi działać jak szwajcarski zegarek, ale bez potrzeby ręcznego nakręcania. Gdy zgłosili się do nas, wiedzieli jedno: potrzebują środowiska, które będzie szybkie, bezpieczne i zawsze dostępne – nawet jeśli coś pójdzie nie tak. A do tego – obsługi, która weźmie to wszystko na siebie.

Klient

APZ.PL to lider w dziedzinie dietetyki i promocji zdrowia, z ponad 20-letnim doświadczeniem i tysiącami zadowolonych pacjentów miesięcznie. Firma stoi za takimi markami jak Dobry Dietetyk® – największa sieć poradni dietetycznych w Polsce, obejmująca niemal 400 placówek – oraz Fit Dietetyk℠, skierowaną do środowiska sportowego i fitness. APZ.PL łączy wiedzę naukową z nowoczesnymi technologiami, tworząc innowacyjne narzędzia i systemy wspierające pracę specjalistów ds. żywienia. Ich codzienna działalność opiera się na danych, bezpieczeństwie i nieprzerwanej dostępności usług – dlatego stabilna infrastruktura IT to dla nich fundament działania.

Wyzwanie

Zespół APZ.PL szukał rozwiązania, które będzie wydajne jak lokalna infrastruktura, ale równie elastyczne i bezobsługowe jak chmura. Kluczowe było zapewnienie ciągłości działania – także w przypadku awarii – oraz wsparcie administracyjne, które pozwoli zrezygnować z rozbudowy wewnętrznego działu IT.

W skrócie: chcieli środowiska, które nie tylko działa, ale po prostu nie przestaje działać – nawet jeśli coś się wydarzy w nocy, w weekend czy w święta. To wyzwanie idealnie wpisało się w nasze kompetencje związane z administracją serwerami i klastrami.

Rozwiązanie

Rozpoczęliśmy od fundamentów – zaprojektowaliśmy środowisko oparte na klastrze trzech fizycznych serwerów z procesorami Intel Xeon E2288-G oraz 192 GB RAM. Dlaczego takie parametry? Bo przy systemach krytycznych wydajność CPU i dostęp do pamięci decydują o czasie reakcji całej aplikacji – to właśnie tu zyskujemy sekundy (a czasem godziny) przewagi.

Na każdej z maszyn wdrożyliśmy Proxmox Virtual Environment, tworząc klaster wysokiej dostępności. Serwery zostały spięte w dwóch tzw. „RING’ach” – głównym łączem 10Gb/s i zapasowym 1Gb/s. To zestawienie sprawia, że nawet przy awarii całego stosu przełączników, usługi klienta działają nieprzerwanie.

Ekspert techniczny Dataspace tłumaczy:

„Wielu klientów sądzi, że redundancja to luksus – ale przy naszej architekturze ona staje się domyślna. Odpinamy jeden kabel? Klaster działa. Pada przełącznik? Nadal działa. To właśnie efekt dobrze zaprojektowanej sieci w oparciu o protokół LACP i wykorzystanie dwóch warstw komunikacji.”

W warstwie storage’owej zdecydowaliśmy się na CEPH, który – poza oczywistą cechą jaką jest rozproszona struktura – zapewnia jakość w postaci pełnej tolerancji na awarię fizycznego serwera. Co to oznacza w praktyce? Że dane klienta są dostępne nawet jeśli cały węzeł przestanie odpowiadać. Połączenie tego z mechanizmem wysokiej dostępności pozwala na automatyczne przenoszenie maszyn wirtualnych na inny serwer – bez udziału człowieka, bez dzwonienia na infolinię, bez czekania. To też świetne narzędzie do optymalizacji kosztów – nie musimy nadmiarowo skalować sprzętu, bo mechanizm sam dba o równowagę.

Zadbaliśmy również o aktualizacje. Dzięki odpowiedniej konfiguracji Proxmox i CEPH możemy bezpiecznie restartować fizyczne serwery, np. podczas prac konserwacyjnych mających na celu aktualizację środowiska – bez wpływu na działanie środowiska. Z punktu widzenia APZ.PL – nie ma żadnych przestojów. Z naszego – mniejsze ryzyko i większa elastyczność administracyjna.

W ramach środowiska uruchomiliśmy Docker SWARM na kilkunastu maszynach wirtualnych. Dlaczego akurat ta technologia? Bo SWARM pozwala uruchamiać aplikacje w kontenerach, co oznacza:

  • szybsze wdrażanie aplikacji (czas skraca się nawet kilkukrotnie),
  • prostsze zarządzanie (standaryzacja środowisk),
  • brak przestojów przy aktualizacjach.

W tej warstwie wykorzystaliśmy także GlusterFS jako współdzielony zasób dyskowy – co po raz kolejny zapewnia cechę (dostępność z wielu węzłów), jakość (replikacja i skalowalność) i korzyść: ciągłość działania nawet przy awarii fizycznej maszyny.

Na straży bezpieczeństwa stanął klaster Fortigate – urządzenia, które blokują ruch botnetowy, filtrują dostęp i zapewniają bezpieczne połączenia VPN. To komponent z oferty klasy enterprise, który często pojawia się także w naszych rozwiązaniach firewall dla firm.

Całości dopełnia Zabbix – system monitoringu, który śledzi nie tylko maszyny fizyczne i wirtualne, ale także poszczególne kontenery Docker. Dzięki temu inżynierowie APZ.PL mają pełną widoczność nad aplikacjami, zużyciem zasobów i ewentualnymi anomaliami. Powiadomienia trafiają zarówno do nich, jak i do zespołu Dataspace, co gwarantuje szybką reakcję i sprawne rozwiązywanie problemów – zanim te zdążą urosnąć.
Współpraca z APZ.PL pokazała, że nowoczesna infrastruktura IT nie musi być ani skomplikowana, ani droga w utrzymaniu. Kluczem jest dobrze zaprojektowany system, który łączy wydajność z automatyzacją, a bezpieczeństwo z wygodą użytkowania. Dzięki odpowiednio dobranym technologiom, takim jak Proxmox, CEPH, Docker SWARM czy GlusterFS, udało się stworzyć środowisko, które działa cicho, stabilnie i przewidywalnie – dokładnie tak, jak tego oczekiwano.

APZ - rekomendacja

Poznaj inne Case Study