Kennisbank/Support & betrouwbaarheid/Platform health & public status: Groen betekent iets
02Support & betrouwbaarheid3 min lezen

Platform health & public status: Groen betekent iets

Hoe readiness checks, de admin-cockpit, job runs en publieke status voorkomen dat incidenten folklore worden.

Health checks zijn niet glamoureus. Dat is hun charme. Ze vertellen platformmedewerkers of de app, de database, auth, storage, mail, de notificatiewachtrij, cron, webhooks, de publieke API, billing, de externe secret store, de activity audit en observability zich goed genoeg gedragen voor normaal werk. Dertien componenten, elk met één vraag: doet dit ding nu zijn werk?

/api/health

Het technische health-endpoint geeft de readiness van de app terug met componentchecks, latency en gesaneerde status. Het is gebouwd voor uptime-monitoring en smoke checks na een deploy, niet om databasedetails naar het internet te lekken.

Platformcockpit

/admin/platform/health is de incidentconsole voor platformeigenaars en -medewerkers; platform viewers zien het sidebar-item niet en worden omgeleid wanneer ze het adres openen, en organisatie-admins kunnen het helemaal niet openen. Ze toont de globale status, release readiness, een supportsamenvatting, waarschijnlijke oorzaken, de status per afhankelijkheid met haar categorie — platform, data, extern, tenantintegratie, billing, queue of evidence — het aantal getroffen tenants waar dat veilig af te leiden is, de laatste check, het laatste succes en de laatste fout, en recente job runs. Cronroutes en achtergrondjobs schrijven begrensde job-run-records, zodat het platform kan antwoorden of een geplande taak liep, faalde, geblokkeerd was, gedeeltelijk liep of stilletjes een dutje deed.

Woorden, geen codes

De console spreekt supporttaal. Interne ernstcodes zijn vervangen door impactlabels — Urgente storing, Hoge impact, Incidentopvolging nodig, Lage-prioriteit review — en er bestaan precies twee toestanden zodat niemand voor de verkeerde kaart panikeert: “Nog niet ingesteld” betekent dat een afhankelijkheid bewust ontbreekt of geen directe monitor heeft, wat geen storing is, en “Kon niet gecontroleerd worden” betekent dat de pagina de brondata niet kon lezen of verifiëren. Billing kan melden dat subscription billing niet geconfigureerd is terwijl de lokale pakkethandhaving gewoon blijft werken. Elke componentkaart linkt naar de meest relevante admin-, instellingen- of health-pagina. Opent support een ticket tijdens een incident, dan kan een momentopname van deze context automatisch aan het ticket gehangen worden.

Publieke status

/api/status/public publiceert een gesaneerde componentfeed voor een statuspagina of een externe monitor. Ze kan zeggen dat bestandsopslag of geplande jobs degraded zijn zonder tenantnamen, payloads, secrets of stack traces prijs te geven. Transparantie is goed; te veel delen blijft te veel delen.

Waarom het telt

Wanneer er iets mis is, heeft support één gedeelde bron van waarheid nodig. Health verandert “ligt het aan mij?” in “storage is degraded, uploads zijn getroffen, de rest is in orde.” Die zin bespaart een verrassende hoeveelheid zuurstof.