Servislerimi önce RED metrikleriyle mi yoksa USE metrikleriyle mi enstrümante etmeliyim?
API'de RED ile başlayın, worker'da job'ı istek gibi modelleyip yine RED kurun, sonra kuyruk derinliği ve pool doygunluğu için iki tarafa da USE ekleyin.
Etiket
Metrik, log ve iz: bir sistemin içeride ne yaptığını dışarıdan okuyabilmek. Bu etiketle sorulan sorular ve cevapları.
Bu etikette 7 cevaplanmış soru var.
API'de RED ile başlayın, worker'da job'ı istek gibi modelleyip yine RED kurun, sonra kuyruk derinliği ve pool doygunluğu için iki tarafa da USE ekleyin.
ID'yi W3C `traceparent` olarak üretip SQS message attribute'unda taşıyın, her sınırda OTel propagator ile enjekte edin, logger'a `trace_id` verin.
Bir satır gece 3'te birini uyandırmayı gerektiriyorsa ERROR, gerektirmiyorsa WARN yazın; hatayı sınırında bir kez loglayıp alert'i ERROR oranına bağlayın.
Yeni sürümü canary ağırlığında bir bake süresi boyunca 5xx ve latency eşiğine karşı ölçün; eşik aşılırsa son kararlı sürüme dönüp ekibi yalnızca uyarın.
Tekrarlı logu uygulamada sayaçla tek satıra indirin, retry'a backoff koyun, logrotate'e boyut ve sayı sınırı verin, `/var/log`'u kök diskten ayırın.
W3C Trace Context'te standartlaşıp propagation'ı OTel SDK'ya bırakın ve traceparent'ı kuyruk mesajının header'ına koyun; zincir orada kopuyor.
Önce Fluent Bit'in filesystem buffer'ını açın; 40k/s kalıcıysa Kafka'ya geçin, Redis listesini yalnızca kaybını göze aldığınız loglarda kullanın.