API zawodzą inaczej niż strony: odpowiadają 200 z treścią błędu, zwalniają, zanim przestaną działać, i zależą od kolejek, których nikt nie obserwuje. Oto jak je monitorować.
Weryfikuj treść odpowiedzi
Wybierz endpoint health, który sprawdza bazę danych i cache oraz zwraca JSON, i monitoruj pole, np. $.status równe ok.
Uwierzytelniaj się
Użyj tokenu tylko do odczytu w nagłówku Authorization. Rotuj go jak każdy inny sekret.
Obserwuj opóźnienia
Ustaw próg na około dwukrotność normalnego p95. Wolne API jest zwykle wczesnym sygnałem nadchodzącej awarii.
Monitoruj workery
Konsumenci kolejek i zadania cron potrzebują monitorów heartbeat: zadanie pinguje adres URL po zakończeniu.
Pogrupuj na stronie statusu
Pokaż API, webhooki i zadania w tle jako osobne komponenty, aby klienci dokładnie widzieli, co jest dotknięte problemem.