Intermedia Intelligent Communications

Ingeniero/a de Fiabilidad de Sitios

Kubernetes
Traducción automática. Consulta el original.

Sobre la oportunidad

Ingeniero/a de Fiabilidad de Sitios

Sobre el Puesto

Buscamos un/a Ingeniero/a de Fiabilidad de Sitios (SRE) para mejorar la fiabilidad de nuestras plataformas de IA y análisis y de los servicios que dependen de ellas. A medida que Intermedia expande sus despliegues de productos a nivel mundial, este puesto fortalecerá las prácticas de SRE en la infraestructura de producción, pipelines de datos, servicios de machine-learning, análisis dirigidos al cliente y capacidades de Voz y Comunicaciones Unificadas impulsadas por IA. Colaborarás con los equipos de IA, datos, producto y plataforma para construir sistemas escalables y observables que ofrezcan información fiable y experiencias de cliente resilientes.

Departamento: Dev & Engineering

Tipo de empleo: Tiempo Completo

Ubicación: Portugal

Aunque es principalmente remoto, este puesto requiere visitas ocasionales a la oficina en Coimbra o en Aveiro. Planeamos abrir una oficina en Oporto en el futuro. Este enfoque brinda a los miembros del equipo la flexibilidad de trabajar de forma remota y, al mismo tiempo, reunirse en la oficina para colaborar y trabajar en equipo.

¿Estás listo/a para dejar tu huella?

Diversidad, Inclusión y Igualdad de Oportunidades

Contratamos, promocionamos y compensamos a los empleados en función de su capacidad para desempeñar sus responsabilidades laborales, sin distinción de raza, color, credo, religión, sexo, género, estado civil, origen nacional, ascendencia, edad, ciudadanía, discapacidad física o mental, orientación sexual o cualquier otra base protegida por la ley aplicable (denominadas colectivamente en nuestro Código de Conducta como "Clases Protegidas").

No toleramos la discriminación laboral en el lugar de trabajo y estamos comprometidos a realizar adaptaciones razonables para las discapacidades identificadas u otras limitaciones según lo exijan todas las leyes aplicables.

Somos una empresa que ofrece igualdad de oportunidades y valoramos la diversidad en nuestra compañía.

No discriminamos por motivos de raza, religión, color, origen nacional, género, orientación sexual, edad, estado civil, condición de veterano o estado de discapacidad.

Descripción

*TODOS LOS CANDIDATOS DEBEN RESIDIR EN PORTUGAL*

Lo que aportarás al puesto

  1. Título de Grado en informática, ingeniería de datos, ingeniería de software, u otra disciplina técnica o científica, o experiencia práctica equivalente.
  1. 4-7 años de experiencia en operaciones de producción, ingeniería de sistemas, SRE o DevOps, despliegue de software y mantenimiento de sistemas de producción distribuidos.
  1. Experiencia con infraestructura en la nube, contenedores, Kubernetes, sistemas distribuidos y servicios de cómputo y almacenamiento escalables.
  1. Experiencia operando tecnologías de procesamiento de datos, orquestación, almacenamiento o análisis, como Kafka, Spark, Airflow, dbt, data warehouses, o servicios en la nube comparables.
  1. Capacidad para utilizar métricas, logs, trazas, comprobaciones de calidad de datos, indicadores de frescura, linaje e indicadores de nivel de servicio para diagnosticar problemas complejos de producción.
  1. Experiencia con prácticas de CI/CD, DataOps o MLOps, pruebas automatizadas, despliegue controlado y reversión de cambios en datos y servicios de IA.
  1. Sólidas habilidades de resolución de problemas en Linux, aplicaciones, redes, APIs, pipelines de datos y dependencias de servicios distribuidos, con atención a la seguridad y los controles de acceso.
  1. Sólidas habilidades analíticas para la resolución de problemas y comunicación interfuncional, con un enfoque proactivo hacia la fiabilidad, el rendimiento y la mejora continua.

Acerca de Intermedia

¿Buscas una empresa donde TU VOZ sea escuchada? ¿Donde puedas MARCAR LA DIFERENCIA? ¿Te desenvuelves BIEN en un entorno de trabajo DINÁMICO? ¿Te levantas cada mañana EMOCIONADO/A por trabajar con GRANDES PERSONAS y crear ÉXITO JUNTOS? Entonces Intermedia es tu lugar.

Intermedia se ha consolidado como un proveedor líder de tecnología de comunicaciones y colaboración en la nube que permite a las empresas conectarse mejor. Tenemos un sólido historial de crecimiento, rentabilidad y creación de un entorno donde todos importan. Todos. Si bien somos dinámicos y, admitámoslo, un poco intensos, te prometemos que no te aburrirás. En Intermedia encontrarás un lugar donde podrás dar rienda suelta a tu pasión por crear y dar soporte a una gran tecnología en la nube. Es más, siempre buscamos promocionar internamente y ¡tenemos muchos empleados que llevan con nosotros 10, 15 y 20+ años!

¡La cultura en Intermedia se basa en el trabajo en equipo y la transparencia. Nos hacemos responsables mutuamente y ¡siempre nos cubrimos las espaldas!

Lo que harás

  1. Ejecutar y mejorar entornos de producción que soporten cargas de trabajo de IA y análisis, pipelines de datos, aplicaciones de análisis y servicios dirigidos al cliente.
  1. Desarrollar software y automatización para gestionar la infraestructura en la nube, plataformas de datos, infraestructura de servicio de modelos y servicios de aplicaciones.
  1. Definir y medir indicadores de nivel de servicio, objetivos de nivel de servicio y presupuestos de errores para servicios de IA y análisis, incluyendo disponibilidad, frescura de datos, finalización de pipelines y latencia de inferencia.
  1. Construir observabilidad de extremo a extremo que correlacione métricas, logs y trazas con señales de calidad de datos, rendimiento de servicios de IA e impacto en el cliente.
  1. Monitorizar y optimizar la fiabilidad, el rendimiento, la capacidad y el coste de cargas de trabajo por lotes y en streaming, consultas de análisis y servicios de inferencia.
  1. Colaborar con los equipos de ingeniería de datos y de machine-learning para que los flujos de trabajo de ingesta, transformación, características, entrenamiento, despliegue y generación de informes estén listos para producción.
  1. Automatizar las comprobaciones de CI/CD y de preparación para producción para pipelines de datos, lanzamientos de modelos y prompts, cambios de esquema, aplicaciones de análisis y dashboards.
  1. Detectar y resolver incidentes de calidad de datos relacionados con datos faltantes, obsoletos, retrasados o anómalos, deriva de esquemas y linaje o dependencias rotas.
  1. Diseñar y probar patrones de degradación elegante, aislamiento de dependencias, reintentos y fallback, y procedimientos de recuperación para servicios de IA, datos o servicios downstream afectados.
  1. Mejorar la fiabilidad de las capacidades de Voz y Comunicaciones Unificadas impulsadas por IA, como reconocimiento de voz, transcripción, resumen, enrutamiento inteligente, asistencia conversacional y texto a voz.
  1. Establecer monitorización operativa para el comportamiento de modelos y servicios de IA, incluyendo latencia, rendimiento, tasas de error, indicadores de deriva y cambios en la calidad de la salida.
  1. Planificar la capacidad y ejecutar pruebas de rendimiento, carga y resiliencia en cargas de trabajo de IA intensivas en cómputo, procesamiento de datos distribuido y servicios de análisis.
  1. Liderar la respuesta a incidentes y la mejora post-incidente para servicios de IA y análisis, utilizando acciones medibles para reducir la recurrencia y el tiempo de recuperación.
  1. Soportar el acceso seguro y fiable a servicios de almacenamiento, procesamiento y consulta en la nube utilizados por productos de análisis y toma de decisiones interna.
  1. Reducir el trabajo operativo repetitivo y mejorar la productividad de ingeniería a través de herramientas de plataforma, runbooks, automatización de autoservicio y estándares operativos claros.

Más oportunidades con un solo perfil

¿Quieres optar a más puestos sin repetir todo el proceso? Crea tu perfil para que te encuentren las empresas que usan Nort.

Crear mi perfil

Tu próximo empleoya está buscándote.

Nort

Plataforma de reclutamiento inverso para programadores