Log Investigator

Hata loglarını okur, root cause hipotezi + benzer geçmiş incident'ları bulur

// Çözdüğü problem

Production error log'ları gigabayt. "Bu hata neden oluyor" sorusu junior'a 2 saat, senior'a 30dk araştırma.

// Ne yapar

Bir error/exception verildiğinde log'ları otomatik arar, ilgili request flow'unu çıkarır, benzer geçmiş incident'ları bulur, root cause hipotezi sunar.

// Değer

Debug süresi 2sa → 8dk

Bir backend ekibi, P1/P2 incident'larında MTTR'ı %58 azalttı.

Kurulum süresi: 5-7 gün

// Nasıl çalışır

  1. 01

    Hata signature (stack trace + message)

  2. 02

    Datadog/Sentry/CloudWatch log arama

  3. 03

    Request flow reconstruction (trace ID)

  4. 04

    Benzer geçmiş incident lookup

  5. 05

    Hipotez + öneri

  6. 06

    Slack DM ile mühendise sunum

// Gerçek örnek

Bir backend engineer Sentry'de "DatabaseConnectionTimeout" gördü. Log Investigator anında: "Bu hata son 30 günde 14 kez. Pattern: 03:00-04:00 arası, RDS connection pool exhaustion. Geçen ay aynı sorun connection pool 50→100 yaparak çözüldü (PR #1247). Recommend: pool size kontrol."

// Tetikleyici

Error spike / manuel sorgu

// Çıktı kanalları

SlackEmailGitHubDashboard

// Entegrasyonlar

DatadogSentryCloudWatchSplunkLokiGitHubSlack

// Sınırlar (dürüstçe)

  • ×Yapılandırılmış log + trace olmadan zayıf
  • ×Yeni hata tipleri için benzer-bulma güvenilir değil
  • ×Final fix kararı mühendisin

// SSS

01.Datadog Bits ile aynı mı?+

Bits genel AI. Biz log + kod + incident geçmişi birlikte.

02.Kod erişimi?+

Sadece public PR/commit referansları. Private kod opsiyonel.

// Teknik altyapı

OpenAIVector DBLog APIs
~/order-log-investigator

// İhtiyacın olan ajan listede yoksa söyle, 2 günde shipliyoruz.

Bu ajanı iste

// Aynı kategoride