Vibe coding

Was Application Performance Monitoring leistet, das Logging allein nicht kann

APM ist nicht nur fuer Enterprise gedacht, sondern fuer jede Anwendung, die tatsaechlich genutzt wird.

Logging sagt, was passiert ist. APM sagt, wie schnell es passiert ist, wie oft, und wo Engpaesse entstehen. Zusammen ergibt das Observability. Konkret zeigt APM, welcher Endpoint am langsamsten ist, welche Datenbankabfrage bei bestimmten Requests besonders lang dauert, und welcher Drittanbieter-Service am haeufigsten Timeouts produziert.

Die wichtigsten Metriken

Die Response Time sollte nicht als Durchschnitt betrachtet werden, der Ausreisser versteckt, sondern als P95 und P99, also die Werte, unter denen 95 beziehungsweise 99 Prozent aller Requests liegen. Die Error Rate zeigt, wie viele Requests in einem Fehler enden, getrennt nach Status Code und Fehlertyp. Der Throughput gibt Kontext fuer die Response-Time-Zahlen. Und ein Apdex Score kombiniert Zufriedenheit, Toleranz und Frustration in einer einzigen, dashboardtauglichen Zahl.

Werkzeugauswahl

Datadog APM und New Relic sind maechtig und gut integriert, aber preislich anspruchsvoll. Elastic APM ist Open Source und selbst hostbar. Blackfire.io ist PHP-spezifisch und liefert sehr detaillierte Profiling-Daten. Scout APM eignet sich guenstig fuer kleinere PHP- oder Rails-Anwendungen.

Alerting nicht vergessen

Ein APM ohne Alerting ist ein Dashboard, das niemand ansieht. Sinnvolle Alerts greifen bei ueberschrittener P95-Response-Time, erhoehter Error Rate oder einem Apdex Score unter 0,85.

Checkliste: APM-Agent installiert, wichtigste Endpoints und Abfragen instrumentiert, P95- und P99-Baseline gemessen, Error-Rate-Dashboard eingerichtet, Alerting auf Performance-Degradation konfiguriert.

Ein Beispiel aus der Praxis

Nach der Einfuehrung von APM zeigte sich, dass ein einzelner, selten aufgerufener Endpoint fuer einen unverhaeltnismaessig grossen Anteil der durchschnittlichen Serverlast verantwortlich war, weil er bei jedem Aufruf unnoetig eine komplette Datenexportfunktion mit auf loeste. Ohne APM waere dieser Zusammenhang kaum aufgefallen, da der Endpoint isoliert betrachtet unauffaellig wirkte. Erst die aggregierte Sicht ueber alle Endpoints zeigte das tatsaechliche Verhaeltnis von Aufrufhaeufigkeit und Ressourcenverbrauch.

APM fuer eure Anwendung einrichten? markom.digital setzt APM-Monitoring auf, mit sinnvollem Alerting und Dashboards, die beim Incident wirklich helfen.

Weitere Beiträge