Forum Discussion
WYZWANIA TESTOWANIA
Przy celowym skupieniu się na testowaniu parametrów matchmakingu, czasem po drodze pojawiają się problemy. To rzadka i niefortunna sytuacja, z której staramy się wyciągnąć jak najwięcej wniosków, aby mieć pewność, że podobne błędy nie powtórzą się w przyszłości.
Na przykład, w dniu premiery „Zryw” doświadczyliśmy awarii matchmakingu, która trwała kilka godzin. Działaliśmy zbyt szybko, wprowadziliśmy zmiany w ostatniej chwili, przeoczyliśmy kluczowy błąd, a w rezultacie awaria dotknęła całą naszą bazę graczy – co jest, szczerze mówiąc, niedopuszczalne.
Co zatem zmieniamy w przyszłości?
- Egzekwowanie procesów: Wymagamy ściślejszego przestrzegania naszego przepływu pracy w zarządzaniu zmianami.
- Zabezpieczenia techniczne: Wdrażamy automatyczne mechanizmy, aby automatycznie zmniejszyć obciążenie kolejki, dzięki czemu przyszłe awarie będzie można sprawniej i szybciej naprawić.
Kiedy coś się zepsuje i gra zostanie wyłączona, zespół jednoczy siły, aby rozwiązać problem tak szybko, jak to możliwe. Kiedy systemy matchmakingowe ulegają awarii, coraz więcej graczy gromadzi się w kolejce; jeśli kolejka nie może zostać opróżniona poprzez wczytywanie do meczów, nadal rośnie, a gdy osiągnie pewien rozmiar, przeciąża bazę danych. Aby przywrócić grę do działania, nasz zespół musiał ręcznie wyczyścić kolejkę, a następnie stopniowo wprowadzać graczy z ograniczoną przepustowością, zaczynając od 10% normalnej kolejki i powoli ją rozszerzając.
Dopiero po zmniejszeniu wystarczającego obciążenia z kolejki matchmakingowej byliśmy w stanie przywrócić normalne działanie.