Specialist - Technology Services
MetLife · Delhi
- Experience5–8 yrs
- SalaryNot disclosed
- Work modeonsite
- Posted23 Sept 2026
About MetLife
MetLife is hiring in Delhi in insurance. This role looks for around 5+ years of experience.
Skills
- Elasticsearch
- Kibana
- Logstash
- Elastic Agent
- Fleet
- APM
- Index Lifecycle Management
- Data Streams
- Index Templates
- Snapshot & Restore
- cluster administration
- observability
- capacity planning
- disaster recovery
- backup and recovery
- monitoring
- troubleshooting
- performance optimization
- storage tiering
- data retention
- alerting frameworks
- dashboards
- distributed tracing
The role
A platform engineer at an insurance company designs and operates Elasticsearch platforms, manages Kibana observability, and optimizes Logstash ingestion and cluster performance. This person also handles capacity planning and disaster recovery.
Full job description
Key Responsibilities
Platform Engineering & Architecture
Design, engineer, and maintain enterprise-scale Elasticsearch platforms supporting critical business applications.
Develop and implement scalable, secure, and highly available Elastic platform architectures.
Handle Elasticsearch cluster administration, configuration, upgrades, and lifecycle management activities.
Define platform standards, operational processes, and engineering best practices.
Drive platform reliability, resiliency, observability, and operational excellence initiatives.
Manage platform health, disaster recovery planning, and backup/recovery strategies utilizing Snapshot & Restore capabilities.
Support production and non-production Elastic environments while ensuring service availability and performance.
Elasticsearch Administration & Operations
Administer and support Elasticsearch clusters including deployment, configuration, monitoring, and troubleshooting.
Manage Index Lifecycle Management (ILM), Data Streams, Index Templates, and data tiering architectures.
Optimize shard allocation, indexing performance, search latency, ingestion pipelines, and cluster resource utilization.
Investigate and resolve complex platform issues involving cluster performance, storage growth, indexing throughput, and data retention.
Perform Elasticsearch version upgrades, migrations, and platform modernization initiatives.
Collaborate with vendors and technical support teams to resolve critical platform incidents.
Observability Engineering
Design And Implement Enterprise Observability Solutions Leveraging
Elasticsearch
Kibana, Logstash, Elastic Agent, Fleet, APM, Metrics, Logs, Distributed Tracing
Alerting Frameworks, Dashboards and Reporting
Enable onboarding and integration of new data sources across observability platforms.
Develop dashboards, visualizations, alerts, and monitoring frameworks to improve operational visibility and proactive issue detection.
Capacity Planning & Cost Optimization
Perform cluster sizing, growth forecasting, and capacity management activities.
Conduct resource utilization assessments and recommend optimization strategies.
Lead storage forecasting and data growth analysis initiatives.
Implement downsampling, retention tuning, storage tiering, and lifecycle management strategies.
Drive platform cost optimization programs while maintaining performance and service-level objectives.
Identify opportunities for infrastructure efficiencies and cost reduction across Elastic environments.
Leadership & Stakeholder Engagement
Lead implementation projects, platform enhancements, migrations, upgrades, and onboarding programs.
Partner closely with Business, Infrastructure, Cloud, Security, and Engineering teams to deliver platform solutions.