Session

When AI Breaks Production: Designing SRE Guardrails for Autonomous Systems

As organizations rapidly integrate AI into production systems, a new class of failures is emerging — unpredictable, non-deterministic, and often invisible to traditional observability.

This talk explores real-world challenges faced when AI-driven systems intersect with production reliability, including:

Unbounded decision loops causing cascading failures
Silent data corruption from model drift
Latency spikes due to inference unpredictability
Security risks introduced by autonomous actions

Drawing from hands-on experience operating large-scale distributed systems, this session introduces a new reliability model for AI systems, where traditional SLOs and monitoring are no longer sufficient.

We will present a practical framework for:

Designing AI-aware SLOs (beyond latency & availability)
Implementing guardrails for autonomous systems
Building observability for non-deterministic behavior
Integrating Zero Trust principles into AI pipelines

Attendees will leave with actionable strategies to safely deploy AI in production without compromising reliability, security, or user trust.

Charit Upadhyay

Adobe, Senior Site Reliability Engineer

San Francisco, California, United States

Actions

Please note that Sessionize is not responsible for the accuracy or validity of the data provided by speakers. If you suspect this profile to be fake or spam, please let us know.

Jump to top