1

Observability Site Reliability Engineer Jobs in Florida

Senior Application Support Engineer (SRE)

Tampa, FL · On-site

$53.75 - $71.50/hr

Apply SRE principles and practices to improve system reliability, scalability, and performance ... Partner with development teams to implement monitoring, alerting, and observability solutions

Site Reliability Engineer (SRE)

Jupiter, FL · Remote

$55.75 - $74/hr

We are looking for a Site Reliability Engineer to help maintain the health, stability, and ... Familiarity with observability tools such as Nedata or Datadog or similar. * Experience with ...

Site Reliability Engineer (SRE)

Jupiter, FL · On-site +1

$55.75 - $74/hr

We are looking for a Site Reliability Engineer to help maintain the health, stability, and ... Familiarity with observability tools such as Nedata or Datadog or similar. * Experience with ...

Sr. Site Reliability Engineer

Orlando, FL

$53.25 - $70.75/hr

Build observability solutions and dashboards that provide visibility into CI/CD health, deployment success, build performance, developer wait times, and platform reliability. * Partner with ...

Site Reliability Engineer

Tampa, FL

$53.75 - $71.50/hr

\n \n \n Looking for an SRE experienced in monitoring and observability using Prometheus, Grafana, ELK Stack, DataDog, and Sentry. You will assist in converting clients off of Datadog to an Otel ...

Site Reliability Engineer II

Plantation, FL · On-site

$56.50 - $75.25/hr

Remote (US-Based Candidates Only) Site Reliability Engineer II (SRE) Position Overview We are ... Experience with Datadog or similar monitoring and observability platforms. * Strong experience with ...

next page

Showing results 1-20

Observability Site Reliability Engineer information

What is the difference between Observability Site Reliability Engineer vs Monitoring Engineer?

AspectObservability Site Reliability EngineerMonitoring Engineer
FocusEnsuring system reliability through observability, automation, and incident responseImplementing and managing monitoring tools and dashboards
SkillsCloud platforms, scripting, incident management, observability toolsMonitoring tools, alerting systems, data analysis
Work EnvironmentDevOps teams, cloud infrastructure, large-scale systemsOperations teams, infrastructure monitoring

While both roles involve system health, the Observability Site Reliability Engineer focuses on comprehensive system reliability using observability practices, whereas Monitoring Engineers primarily manage monitoring tools and alerts. The SRE role emphasizes automation, incident response, and system resilience, making it broader in scope.

What are popular job titles related to Observability Site Reliability Engineer jobs in Florida?

For Observability Site Reliability Engineer jobs in Florida, the most frequently searched job titles are:

What job categories do people searching Observability Site Reliability Engineer jobs in Florida look for?

The top searched job categories for Observability Site Reliability Engineer jobs in Florida are:

What cities in Florida are hiring for Observability Site Reliability Engineer jobs?

Cities in Florida with the most Observability Site Reliability Engineer job openings:

SRE Engineer with ML Ops and Arize product

SysMind, LLC

Jacksonville, FL • On-site

$52.75 - $70.25/hr

Other

Posted 6 days ago


Job description

Tittle – SRE Engineer with ML Ops and Arize product

Location – Malvern, PA - 100% ONSITE FROM DAY 1

ROLE_DESCRIPTION -

AWS Cloud Platform Expertise - EC2, EKS, ECS, Lambda, CloudWatch, SNS, SQS, Event Bridge for highly available and scalable services.

Arize AI Observability & Monitoring - Model performance monitoring, drift detection, evaluation analytics, and AI/LLM observability.

Site Reliability Engineering (SRE) - SLI/SLO definition, Error Budgets, reliability improvement, service resilience, and uptime management.

Incident Management & RCA - Major Incident Management (MIM), outage tracking, root cause analysis, problem management, and MTTR reduction.

Failure Analysis & Risk Assessment - FMEA, risk quantification, reliability assessments, and proactive mitigation of platform failures.

Testing & Validation Engineering - Scenario testing, regression testing, impact analysis, release validation, and upstream change testing.

Monitoring, Alerting & Automation - CloudWatch, Grafana, Prometheus, PagerDuty, automated notifications, dashboards, and operational metrics.

DevOps & MLOps Practices - Kubernetes, Terraform, CI/CD pipelines, Python scripting, AI/ML platform operations, and LLM reliability optimization.

Preferred Technologies: AWS, Arize AI, Kubernetes (EKS), CloudFormation, Python, CloudWatch, Grafana, Prometheus, PagerDuty, GitHub Actions/Jenkins.


SYSMIND LLC is an Equal Employment Opportunity employer. All qualified applicants will receive consideration for employment without any discrimination. We promote and support a diverse workforce at all levels in the company. All job offers are contingent upon completion of a satisfactory background check and reference checks. Additionally passing the drug test may also be required. All contractors intending to work on SYSMIND's W2 are "at will" employees.


SysMind logo

About SysMind

Sourced by ZipRecruiter

Founded in 1999, SysMind is a reliable recruitment and staffing company that assists businesses with their human capital needs. We bring our expertise in staffing solutions, both locally and internationally. A cost-effective company, we assist companies in their growth journey by adopting emerging technologies and up-skilling resources as per their requirements. Our expertise of over two decades in different industries empowers us with the knowledge to provide you with a quick & dependable response to all your human capital needs without compromising quality.

Industry

It services

Company size

51 - 200 Employees

Headquarters location

Princeton Junction, NJ, US

Year founded

1999

Social media