wagey.ggwagey.gg
31,365  jobs31,365  jobs
Browse Tech JobsCompaniesFeaturesPricingFAQs
Log InGet Started Free
Jobs(31,365)/Site Reliability Engineer Role(176)/vultr (57) - Senior Site Reliability Engineer, Infrastructure
vultr

vultr - Senior Site Reliability Engineer, Infrastructure

Remote - United States$125k - $135k+ Equity2mo ago
RemoteSeniorNAMaterialsSite Reliability EngineerChefLokiGrafanaLinuxTerraformAnsible

Requirements

• 5+ years of experience in site reliability, platform, or infrastructure engineering in a production environment. • Hands-on experience building and operating observability pipelines including metrics, logs, and alerting using Grafana, Loki, Mimir, or equivalent tooling. • Working knowledge of datacenter hardware telemetry protocols including Redfish, IPMI, and/or SNMP. • Strong Linux fundamentals and operational experience in production infrastructure environments. • Demonstrated experience with infrastructure-as-code and configuration management tooling (Terraform, Ansible, Chef or similar). • Strong cross-functional communication skills and experience delivering tooling for operational stakeholder teams.

Responsibilities

• Design and build the observability pipeline for datacenter infrastructure including CDUs, PDUs, bare metal servers, and provisioning workflows, collecting telemetry via Redfish, IPMI, SNMP, and OpenTelemetry. • Own the full stack from data collection through to visualization and alerting in Grafana, Loki, and Mimir. • Build dashboards and alerting that are actionable and meaningful for stakeholder teams including Datacenter Ops, SysAdmin, Network, and Provisioning. • Establish standards and patterns for how datacenter infrastructure telemetry is collected, stored, and visualized across Vultr's global footprint. • Partner closely with stakeholder teams to understand their operational needs and translate them into observable, measurable signals. • Drive infrastructure-as-code practices across the observability pipeline to ensure consistency, repeatability, and maintainability.

Benefits

• $125,000 - $135,000 • Final compensation will vary depending on years of experience, background/skill set, location, and applicable laws. • INCLUSION & PRIVACY

Apply in one click

Upload My Resume

Drop here or click to browse · Tap to choose · PDF, DOCX, DOC, RTF, TXT

Apply in One Click
Apply in One Click

Similar roles

NICENICE - Senior Cloud Site Reliability Engineer1w ago
·United Kingdom - London; United Kingdom - Southampton - Hybrid
In OfficeEMEASeniorSite Reliability EngineerChefChefAnsiblePuppetCloseTerraformKubernetesReportingLokiGrafana
asymmetric.reasymmetric.re - Site Reliability Engineer5mo ago
·Remote - AMER - USA *
RemoteNAMidCryptocurrencySite Reliability EngineerChefLinuxPuppetAnsibleChefRust
Ping IdentityPing Identity - Site Reliability Engineer II4w ago
·Remote - Canada
RemoteNAMidCloud ComputingSite Reliability EngineerChefLinuxAWSRubyBashPythonGoTerraformPuppetChefGitAnsibleDockerKubernetesJenkins
GitLabGitLab - Senior Site Reliability Engineer, Database Excellence5mo ago
·Remote - Canada·$124k - $266k/year + Equity
RemoteNASeniorSoftwareSite Reliability EngineerChefDocumentationPostgreSQLSQLTeam ManagementTerraform
AmwellAmwell - Senior Site Reliability Engineer1mo ago
·US - Remote - Hybrid·$129k - $140k/year + Equity
In OfficeNASeniorMental HealthCloud ComputingSite Reliability EngineerBashPythonPuppetTerraformAnsible
GitLabGitLab - Senior Site Reliability Engineer, Environment Automation5mo ago
·Remote - Canada·$124k - $266k/year + Equity
RemoteNASeniorCloud ComputingSite Reliability EngineerTerraformKubernetesAnsibleRubyGo
kongkong - Site Reliability Engineer 22w ago
·Singapore
In OfficeAPACCloud ComputingSite Reliability EngineerChefTerraformPuppetChefAnsibleLinuxC++GoPythonKubernetesAWSAzureGCPPostgreSQLPrometheusDatadogRedisGrafana
runpodrunpod - Site Reliability Engineer2w ago
·Remote - USA·$150k - $200k/year + Equity
RemoteNASeniorSite Reliability EngineerLinuxPerformance ReviewsReportingSlackPrometheusGrafanaPythonBashGo
talkiatrytalkiatry - Senior Site Reliability Engineer2w ago
·Remote - Americas
RemoteNASeniorCloud ComputingSite Reliability EngineerTerraformPythonTypeScriptTeam ManagementPrometheusDatadogAWSGrafanaNode.jsReactKubernetesDocumentation

Browse more by category

Show 176 moreSite Reliability EngineerShow 52 moreChefShow 39 moreLokiShow 292 moreGrafanaShow 806 moreLinuxShow 921 moreTerraformShow 165 moreAnsible
Privacy·Terms··Contact·FAQ·Wagey on X