Financial banking platforms operate under stringent reliability and security requirements while continuously evolving through frequent releases, configuration changes, and infrastructure modernization. Traditional monitoring approaches—static thresholds, handcrafted alert rules, and siloed dashboards—struggle to keep pace with the scale, seasonality, and dependency complexity of modern banking systems. This study provides a practitioner-oriented manuscript on AI-powered anomaly detection for real-time reliability monitoring in financial platforms. Rather than treating anomaly detection as a standalone ML exercise, we treat it as a production capability embedded in DevOps and Site Reliability Engineering (SRE). We outline a reference AIOps architecture shaped by banking constraints—auditability, model governance, access control, and controlled data handling. We then benchmark representative detectors (robust statistics, classical machine learning, and deep learning) against three high-impact categories of production risk: outages, latency spikes (including tail latency degradation), and security violations. Evaluation prioritizes operational measures—time-to-detect, false alerts per
📖 افتح في inklap 🔗 DOI 📮 اطلب بحثاً