Specialist - Technology Services

MetLife · Delhi

  • Experience5–8 yrs
  • SalaryNot disclosed
  • Work modeonsite
  • Posted23 Sept 2026

About MetLife

MetLife is hiring in Delhi in insurance. This role looks for around 5+ years of experience.

Skills

  • Elasticsearch
  • Kibana
  • Logstash
  • Elastic Agent
  • Fleet
  • APM
  • Index Lifecycle Management
  • Data Streams
  • Index Templates
  • Snapshot & Restore
  • cluster administration
  • observability
  • capacity planning
  • disaster recovery
  • backup and recovery
  • monitoring
  • troubleshooting
  • performance optimization
  • storage tiering
  • data retention
  • alerting frameworks
  • dashboards
  • distributed tracing

The role

A platform engineer at an insurance company designs and operates Elasticsearch platforms, manages Kibana observability, and optimizes Logstash ingestion and cluster performance. This person also handles capacity planning and disaster recovery.

Full job description

Key Responsibilities

Platform Engineering & Architecture

Design, engineer, and maintain enterprise-scale Elasticsearch platforms supporting critical business applications.

Develop and implement scalable, secure, and highly available Elastic platform architectures.

Handle Elasticsearch cluster administration, configuration, upgrades, and lifecycle management activities.

Define platform standards, operational processes, and engineering best practices.

Drive platform reliability, resiliency, observability, and operational excellence initiatives.

Manage platform health, disaster recovery planning, and backup/recovery strategies utilizing Snapshot & Restore capabilities.

Support production and non-production Elastic environments while ensuring service availability and performance.

Elasticsearch Administration & Operations

Administer and support Elasticsearch clusters including deployment, configuration, monitoring, and troubleshooting.

Manage Index Lifecycle Management (ILM), Data Streams, Index Templates, and data tiering architectures.

Optimize shard allocation, indexing performance, search latency, ingestion pipelines, and cluster resource utilization.

Investigate and resolve complex platform issues involving cluster performance, storage growth, indexing throughput, and data retention.

Perform Elasticsearch version upgrades, migrations, and platform modernization initiatives.

Collaborate with vendors and technical support teams to resolve critical platform incidents.

Observability Engineering

Design And Implement Enterprise Observability Solutions Leveraging

Elasticsearch

Kibana, Logstash, Elastic Agent, Fleet, APM, Metrics, Logs, Distributed Tracing

Alerting Frameworks, Dashboards and Reporting

Enable onboarding and integration of new data sources across observability platforms.

Develop dashboards, visualizations, alerts, and monitoring frameworks to improve operational visibility and proactive issue detection.

Capacity Planning & Cost Optimization

Perform cluster sizing, growth forecasting, and capacity management activities.

Conduct resource utilization assessments and recommend optimization strategies.

Lead storage forecasting and data growth analysis initiatives.

Implement downsampling, retention tuning, storage tiering, and lifecycle management strategies.

Drive platform cost optimization programs while maintaining performance and service-level objectives.

Identify opportunities for infrastructure efficiencies and cost reduction across Elastic environments.

Leadership & Stakeholder Engagement

Lead implementation projects, platform enhancements, migrations, upgrades, and onboarding programs.

Partner closely with Business, Infrastructure, Cloud, Security, and Engineering teams to deliver platform solutions.