Platform Reliability Engineer
ConocoPhillips
In this role, you will sustain the reliability of critical trading platforms across hybrid and cloud environments, enabling stable production operations and rapid incident response. You’ll drive controlled releases, automation, and operational readiness for trading, scheduling, risk, settlement, and end-of-day processes. You’ll partner with stakeholders to communicate status and risks while supporting platform transformation and security/compliance requirements. This is a hands-on, impact-focused role in a company that values safety, integrity and teamwork.
Responsibilities- Maintain stability, availability, performance, monitoring, and continuity across production and non-production environments
- Lead incident management: restore service quickly, coordinate escalations, perform root-cause analysis
- Support environment readiness, migration, testing, deployment, and release validation for platform transformations
- Ensure security and compliance through change controls, access governance, and audit requirements
- Communicate status, risks, and recovery plans to business and leadership stakeholders
- Document fixes, improve knowledge articles, automate repeatable tasks, and improve service stability
- Monitor and support applications, infrastructure, databases, middleware, integrations, and cloud services
- Triage issues across applications, databases, servers, networks, middleware, and cloud services
- Support controlled deployments and production release activities
- Automate support, deployment, validation, monitoring, and documentation using DevOps and scripting tools
- Analyze SQL/Oracle data, logs, APIs, middleware, and data pipelines for root-cause analysis
- Support resiliency, backup, recovery, and disaster-recovery activities
- 7 or more years of experience in platform engineering, production support, DevOps, site reliability engineering, or related fields
- 5 or more years of experience supporting business-critical production platforms with defined availability and escalation expectations
- Direct troubleshooting across applications, databases, servers, networks, middleware, integrations, and cloud services
- Experience supporting on-call, shift-based, or follow-the-sun operations for global or time-sensitive functions
- Accountability and ownership
- Clear, concise communication
- Cross-functional collaboration
- Platform engineering with applications, infrastructure, databases, middleware, integrations, and cloud services
- Knowledge of commercial trading platforms or energy/commodity trading processes
- Incident management, SLA handling, and operational readiness
Reference: WJ-747_30223686