Jobs / IFS

Principal Site Reliability Engineer – Performance (A&D, Ultra HA/Exadata)

IFS · Ottawa, ON, Canada
Ottawa, ON, CanadaExp: 10+ yrs134,000-179,000 CAD/yearlyRemote
Remuneration
134,000-179,000 CAD/yearly
Location
Ottawa, ON, Canada
Visa sponsorship
Not specified

Job summary

The Principal Site Reliability Engineer – Performance at IFS will lead the Site Reliability Engineering practices within the Unified Support organization, focusing on delivering 24x7x365 support excellence for Ultra High Availability environments in the Aerospace & Defense industry.

Qualifications

  • Minimum 10+ years of experience in cloud computing services or site reliability engineering
  • Minimum 7-8 years in hands-on SRE, DevOps, or cloud operations roles
  • Proven experience leading SRE teams and establishing SRE practices
  • Expertise in performance engineering including load testing and system optimization
  • Experience operating or supporting Oracle Exadata platforms in production

Responsibilities

  • Set technical direction and establish long-term reliability strategies for IFS cloud products supporting the A&D industry
  • Own proactive performance monitoring for Ultra HA on Exadata customers
  • Lead resolution of complex incidents affecting A&D customers
  • Champion the elimination of toil through intelligent automation
  • Establish knowledge management frameworks for cloud-based applications

Skills

AnsibleAppDynamicsAWSAzureBashCloudFormationDatadogDockerDynatraceElastic APMElasticsearchGCPGoGrafanaJiraKafkaKibanaKubernetesLinuxLogstashNew RelicNGINXOpenTelemetryPowerShellPrometheusPythonRabbitMQServiceNowSplunkTerraformJava

Relocation

No