Amsterdam
1 day ago

Staff SRE, Ads
Reddit, Inc.
Amsterdam
1 day ago
Staff SRE, Ads
Reddit seeks a Staff Site Reliability Engineer to lead reliability initiatives across the Ads organization. The role involves improving scalability, operational excellence, and developer productivity for Reddit's advertising platform. Requires 8+ years of SRE experience and deep distributed systems knowledge.
RemoteFull-timePrincipalSite Reliability EngineeringInfrastructure Engineering
Staff SRE, Ads
Reddit seeks a Staff Site Reliability Engineer to lead reliability initiatives across the Ads organization. The role involves improving scalability, operational excellence, and developer productivity for Reddit's advertising platform. Requires 8+ years of SRE experience and deep distributed systems knowledge.
RemoteFull-timePrincipalSite Reliability Engineering
Salary
Not specified
Core Qualifications
Technical (Must-have)
Site Reliability EngineeringInfrastructure EngineeringDistributed SystemsNetworkingLinuxCloud Native ArchitecturesObservabilityMetricsLoggingTracingAlertingGoPythonSLOsAutomationIncident ManagementPerformance Optimization
Soft Skills
CollaborationCommunicationMentoringTechnical LeadershipProblem Solving
Preferred Qualifications
Technical (Nice-to-have)
Advertising TechnologyAd-servingReal-time AuctionsBudget PacingCampaign DeliveryMeasurementAttributionBilling SystemsKubernetesCloud InfrastructureApache KafkaClickHouseApache SparkApache FlinkBigQueryMachine Learning InferenceRecommendation Systems
Key Responsibilities
- Lead reliability initiatives across multiple Ads domains including ad serving, auctions, targeting, reporting, measurement, and billing.
- Partner with engineering leadership to improve reliability, scalability, operational excellence, and engineering efficiency across the Ads organization.
- Drive architecture reviews and influence technical decisions impacting critical revenue-generating systems.
- Design and build platforms, tooling, and automation that improve reliability and developer productivity at scale.
- Participate in on-call rotations, lead complex incident investigations and coordinate cross-functional response efforts during major production events.
- Identify systemic reliability risks and drive long-term solutions that improve platform resilience.
- Establish reliability metrics around advertiser-critical user journeys such as campaign creation, ad delivery, auction participation, reporting, attribution, and billing.
- Mentor engineers and provide technical leadership across multiple teams.
- Influence roadmap planning and ensure reliability considerations are incorporated into product and infrastructure investments.
Staff SREAdsReliabilityDistributed SystemsGoPythonKubernetesCloud InfrastructureRemoteNetherlands