Monitoring & Observability Specialist
Monitoring & Observability Specialist
Monitoring & Observability Specialist
This job was originally posted in Spanish and automatically translated to English.
About the role
💧 Are you passionate about technology and want to see how your work transforms the real world?
At our company, you will be part of a collaborative team that will support you every step of the way. If you are looking for an environment where your impact is tangible and your professional growth is assured...
This opportunity is for you!
🚀 What will your mission be?
Design, evolve, and operate the corporate Monitoring & Observability platform, providing proactive monitoring of the company's and clients' platforms and infrastructures.
Work on defining, implementing, and continuously improving the observability strategy, metrics, logs, alerts, and telemetry, ensuring early detection of incidents, service availability, and performance optimization of distributed platforms and Cloud environments.
What you'll do
Your responsibilities will include:
Design, implement, and evolve Monitoring & Observability solutions.
Define the monitoring, metrics, logs, alerts, and telemetry strategy for the platform.
Administer and optimize tools such as Prometheus, Grafana, OpenTelemetry, ELK, Zabbix, Datadog, or similar.
Design dashboards, technical KPIs, SLIs, SLOs, and availability metrics.
Implement intelligent event correlation and alert noise reduction.
Develop proactive monitoring strategies for early detection of incidents.
Analyze performance, availability, and capacity of platforms, applications, and infrastructures.
Participate in the analysis and resolution of complex incidents (RCA).
Automate operational processes using scripting and DevOps tools.
Collaborate with architecture, development, and operations teams to define observability standards.
Participate in the implementation of OpenTelemetry across the company's various products.
Prepare technical documentation, standards, and procedures related to the observability platform.
Evaluate new technologies and propose continuous improvements to the platform.
What will make you stand out?
🌟 What will make you stand out?
Having enough experience to be autonomous in your day-to-day work.
Being able to hold a fluent conversation in English, as you will work with teams from different countries and both meetings and written communication may be in English.
A degree in Computer Engineering, Telecommunications Engineering, or an equivalent qualification. A Higher National Diploma (ASIR or similar) with demonstrable experience will also be valued.
Training in Monitoring & Observability, Linux, Cloud Computing (Azure and AWS), Docker, automation, DevOps, and microservices architectures.
Certifications related to Linux, Grafana, Prometheus, OpenTelemetry, or equivalent technologies are a plus.
Minimum of 5-7 years of experience in DevOps, SRE, or INFRA roles, focused on Monitoring and Observability.
Demonstrable experience in implementing and evolving observability, monitoring, and centralized log management platforms.
Experience with tools such as Prometheus, Grafana, OpenTelemetry, ELK, Zabbix, Datadog, or similar.
Solid knowledge of Linux, Cloud, containers, microservices, and automation.
-
Experience in analyzing complex incidents, event correlation, defining alerts, and proactive monitoring of critical platforms.
Additional information
So, if you want to make an impact on the world, do it hand in hand with a team that will help you with whatever you need, and in a company where growth opportunities are real,
Idrica is the place for you!
About the role
💧 ¿Te apasiona la tecnología y quieres ver cómo tu trabajo transforma el mundo real?
En nuestra empresa formarás parte de un equipo colaborativo que te apoyará en cada paso. Si buscas un entorno donde tu impacto sea tangible y tu crecimiento profesional esté asegurado…
¡Esta oportunidad es para ti!
🚀 ¿Cuál será tu misión?
Diseñar, evolucionar y operar la plataforma corporativa de Monitoring & Observability, proporcionando una monitorización proactiva de las plataformas e infraestructuras de la compañía y de los clientes.
Trabajar la definición, implantación y mejora continua de la estrategia de observabilidad, métricas, logs, alertas y telemetría, garantizando la detección temprana de incidencias, la disponibilidad de los servicios y la optimización del rendimiento de plataformas distribuidas y entornos Cloud.
What you'll do
Tus responsabilidades incluirán:
Diseñar, implantar y evolucionar soluciones de Monitoring & Observability.
Definir la estrategia de monitorización, métricas, logs, alertas y telemetría de la plataforma.
Administrar y optimizar herramientas como Prometheus, Grafana, OpenTelemetry, ELK, Zabbix, Datadog o similares.
Diseñar cuadros de mando, KPIs técnicos, SLIs, SLOs y métricas de disponibilidad.
Implementar correlación inteligente de eventos y reducción de ruido de alertas.
Desarrollar estrategias de monitorización proactiva para la detección temprana de incidencias.
Analizar rendimiento, disponibilidad y capacidad de plataformas, aplicaciones e infraestructuras.
Participar en el análisis y resolución de incidencias complejas (RCA).
Automatizar procesos operativos mediante scripting y herramientas DevOps.
Colaborar con equipos de arquitectura, desarrollo y operaciones para definir estándares de observabilidad.
Participar en la implantación de OpenTelemetry en los distintos productos de la compañía.
Elaborar documentación técnica, estándares y procedimientos relacionados con la plataforma de observabilidad.
Evaluar nuevas tecnologías y proponer mejoras continuas de la plataforma.
¿Qué te hará destacar?
🌟 ¿Qué te hará destacar?
Tener la suficiente experiencia como para ser autónomo/a en tu día a día.
Poder mantener una conversación fluida en inglés, ya que trabajarás con equipos de diferentes países y tanto las reuniones como la comunicación escrita puede ser en inglés.
Grado en Ingeniería Informática, Ingeniería de Telecomunicaciones o titulación equivalente. También se valorará Formación Profesional de Grado Superior (ASIR o similar) con experiencia demostrable.
Formación en Monitoring & Observability, Linux, Cloud Computing (Azure y AWS), Docker, automatización, DevOps y arquitecturas de microservicios.
Valorable disponer de certificaciones relacionadas con, Linux, Grafana, Prometheus, OpenTelemetry o tecnologías equivalentes.
Experiencia mínima de 5-7 años en posiciones de Devops, SRE o INFRA pero enfocado en Monitoring, Observability.
Experiencia demostrable en implantación y evolución de plataformas de observabilidad, monitorización y gestión centralizada de logs.
Experiencia en herramientas como Prometheus, Grafana, OpenTelemetry, ELK, Zabbix, Datadog o similares.
Conocimientos sólidos de Linux, Cloud, contenedores, microservicios y automatización.
-
Experiencia en análisis de incidencias complejas, correlación de eventos, definición de alertas y monitorización proactiva de plataformas críticas.
Additional information
Así que, si quieres causar un impacto en el mundo, hacerlo de la mano de un equipo que te ayudará en lo que necesites y en una empresa donde las oportunidades de crecimiento son reales,
¡Idrica es tu sitio!
Application managed by IDRICA