Solaris
Grafana Labs
Staff Software Engineer - SRE | Alemania | Remoto
Sobre la oportunidad
Grafana Labs es la empresa detrás de Grafana Cloud, la plataforma de observabilidad totalmente gestionada y de confianza para más de 10,000 organizaciones, que garantiza la fiabilidad, resuelve incidencias más rápido y optimiza la telemetría a escala. Construida sobre código abierto y estándares abiertos, y diseñada para la interoperabilidad en cualquier pila, Grafana Cloud aporta IA a la observabilidad y observabilidad a la IA, proporcionando a los equipos (y a sus agentes) una visibilidad unificada para que puedan ver, comprender y actuar sobre todos sus datos dispares, dondequiera que residan, y moverse a la velocidad de sus ambiciones. Clientes como Anthropic, Bloomberg, NVIDIA, Microsoft y Salesforce, confían en Grafana Labs.
Somos una empresa 100% remota con miembros de equipo en más de 40 países, respaldada por inversores líderes como Lightspeed Venture Partners, Sequoia Capital, GIC, Coatue, J.P. Morgan, CapitalG y Lead Edge Capital.
Más información en grafana.com grafana.com y síguenos en LinkedIn linkedin.com/company/grafana-labs/ y X twitter.com/grafana.
SOBRE EL PUESTO
Estamos creciendo rápidamente y nos mantenemos fieles a lo que nos hace diferentes: un legado de código abierto, una cultura colaborativa global y una pasión por el trabajo significativo. Nuestro equipo prospera en un entorno impulsado por la innovación donde la transparencia, la autonomía y la confianza impulsan todo lo que hacemos.
Es posible que no cumplas con todos los requisitos, y eso está bien. Si este puesto te entusiasma, nos encantaría que levantaras la mano para lo que podría ser una oportunidad verdaderamente definitoria para tu carrera.
Buscamos un Ingeniero de Software Staff - SRE para ayudarnos a dar soporte a nuestros clientes de Grafana Cloud de mayor valor, aumentando la fiabilidad de nuestras bases de datos Cloud que se basan en Mimir, Loki, Tempo y Pyroscope. Ofrecemos estas bases de datos como un producto SaaS de AWS, GCP y Azure en todas las regiones.
El equipo de SRE está integrado en los equipos de Mimir, Loki y Tempo y se centra en garantizar que los productos de bases de datos de Grafana Cloud ofrezcan una fiabilidad excepcional para nuestros clientes con los SLA más altos. En este puesto, usted:
Buscamos un ingeniero de software Staff que opere en la intersección de las necesidades del cliente, los sistemas de producción y la ingeniería de producto.
Invertimos mucho en la productividad del desarrollador. Puedes usar asistentes de codificación de IA modernos como parte de tu flujo de trabajo diario (tu elección de herramientas, dentro de las directrices de seguridad), respaldados por un presupuesto de uso financiado por la empresa para que puedas iterar rápidamente sin fricciones innecesarias. Fomentamos el desarrollo pragmático asistido por IA: prototipado más rápido, generación de pruebas, refactorizaciones, documentación y seguimiento de incidentes, siempre combinado con una sólida revisión de código y estándares de calidad. También tendrás acceso a los últimos modelos de vanguardia de OpenAI, Anthropic y Google.
Esta es una oportunidad remota y buscamos candidatos del Reino Unido, Suecia, España o Alemania.
En Alemania, el rango de compensación base para este puesto es €109,709 - €131,651.
La compensación real puede variar según el nivel, la experiencia y las habilidades evaluadas en el proceso de entrevista. Los beneficios incluyen acciones, bonificación (si corresponde) y otros beneficios listados aquí [grafana.com/about/careers/#jobs].#LI-Remote #LI-Remote
*Los rangos de compensación son específicos del país. Si está solicitando este puesto desde una ubicación diferente a la indicada anteriormente, su reclutador discutirá el rango salarial y los beneficios definidos para su mercado específico al comienzo del proceso.
Empleador de Igualdad de Oportunidades: Grafana Labs es un empleador de igualdad de oportunidades. Damos la bienvenida a solicitudes de todas las personas, independientemente de su raza, color, nacionalidad, origen, casta, sexo, reasignación de género o expresión, orientación sexual, edad, religión o creencias, discapacidad, condición de veterano, información genética, embarazo, maternidad, estado civil, familiar o de cuidador, o cualquier otra característica protegida por la ley local. Creemos que la igualdad y la diversidad construyen una organización sólida, y trabajamos duro para garantizar que esa sea la base de nuestra organización a medida que crecemos.
#LI-Remote
Para obtener información sobre cómo se utilizan sus datos personales una vez que ha solicitado un puesto, consulte nuestra política de privacidad grafana.com/legal/applicant-and-candidate-privacy-policy/.
TU DÍA A DÍA INCLUIRÁ
- Colaborar estrechamente con los equipos de ingeniería de producto (modelo integrado)
- Ser responsable de la fiabilidad en producción para entornos de clientes complejos y con SLA altos
- Diseñar e implementar automatización para escalar nuestras prácticas de fiabilidad
- Asegurar que nuestros clientes cumplan nuestros objetivos de SLO
- Definir y evolucionar SLOs y modelos de fiabilidad por inquilino
- Reducir proactivamente el consumo de SLO para prevenir incidentes recurrentes
- Servir como punto de escalada principal y guardia para incidentes relevantes
- Liderar la respuesta a incidentes que afecten a clientes y las revisiones post-incidente
- Contribuir a documentos de diseño y revisiones de código
- Influir en el diseño de funcionalidades para garantizar la escalabilidad y operabilidad en producción
- Construir automatización para eliminar el trabajo repetitivo cuando sea necesario
- Mejorar la calidad de las alertas y reducir las escaladas ruidosas
- Reuniones 1:1 regulares con tu manager y colegas
- Revisar y crear SLOs, investigar proactivamente formas en las que podemos reducir aún más el consumo de presupuesto para esos SLOs, lo que puede ser autodirigido o como resultado de aprendizajes de incidentes, y puede incluir mejoras en la monitorización, automatización, aumento de la autocuración, escalado automático, etc.
- Mejorar la observabilidad de los clientes dentro de sus entornos
- Diseñar e implementar soluciones para garantizar que la fiabilidad y escalabilidad de nuestros entornos puedan satisfacer las demandas en rápido crecimiento
- Desarrollar patrones de diseño tolerantes a fallos asegurando que consideramos la fiabilidad en todas las etapas del ciclo de vida del servicio.
- Colaborar con nuestros Líderes de Ingeniería para ayudar a definir e influir en la estrategia de producto, las hojas de ruta y los diseños técnicos.
- Participar en la revisión de PR y colaborar con otros ingenieros en sus Documentos de Diseño.
- Enseñar a otros sobre Ingeniería de Fiabilidad de Sitios y comunicar las mejores prácticas a aplicar en las primeras etapas del desarrollo de nuevas características y funcionalidades.
- Participar en la Respuesta a Incidentes cuando sea aplicable, incluyendo la investigación hasta la resolución, PIR y comunicación con los clientes a través de llamadas de puente cuando sea necesario.
QUÉ BUSCAMOS
- 8+ años de experiencia en ingeniería, 4+ en ingeniería de SRE/CRE/producción. Se da una fuerte preferencia a aquellos con experiencia formal en ingeniería de fiabilidad de clientes.
- Sólida experiencia en Kubernetes en AWS, GCP o Azure, y familiaridad con herramientas de infraestructura como código (Helm, Terraform, Jsonnet, etc.).
- Amplia experiencia en liderazgo técnico, guiando a un equipo a través de proyectos, mentorizando a otros ingenieros del equipo y sirviendo como multiplicador de fuerza.
- Experiencia operando sistemas multi-inquilino en producción
- Amplia experiencia diseñando e implementando SLOs
- Experiencia con uno o más lenguajes de programación (por ejemplo, Go, Python, Java, etc.)
- Experiencia con sistemas operativos Linux internos, y algún conocimiento de redes, almacenamiento en la nube y escalado.
- Excelentes habilidades de resolución de problemas y de solución de problemas.
- Experiencia participando con calma y activamente en la Respuesta a Incidentes sin culpa, haciendo seguimiento de las acciones y escribiendo PIRs (Revisiones Post-Incidente, también conocidas como documentos de autopsia) de alta calidad.
- Capacidad para razonar sobre el rendimiento, la escalabilidad y los modos de fallo.
- Comodidad trabajando dentro de un equipo de ingeniería donde se anima a los individuos a tener un fuerte sentido de autonomía y autodirección.
- Capacidad para colaborar estrechamente con los equipos de ingeniería de producto.
- Valoramos mucho a aquellos que son intelectualmente curiosos, que por defecto son transparentes, que tienen una alta tendencia a la acción y que también son amables (¡esto es importante!)
Por qué prosperarás en Grafana Labs
- Cultura Global 100% Remota - Como empresa exclusivamente remota, reunimos talento de todo el mundo, unidos por una cultura de colaboración y propósito compartido.
- Organización en Crecimiento – Aborda trabajo significativo en un entorno de alto crecimiento y en constante evolución.
- Comunicación Transparente – Espera toma de decisiones abierta y actualizaciones periódicas a nivel de toda la empresa.
- Impulsado por la Innovación – Autonomía y apoyo para entregar un gran trabajo y probar cosas nuevas.
- Raíces de Código Abierto – Construido sobre valores impulsados por la comunidad que dan forma a nuestra forma de trabajar.
- Equipos Empoderados – Cultura de alta confianza y bajo ego que valora los resultados por encima de las apariencias.
- Vías de Crecimiento Profesional – Oportunidades definidas para crecer y desarrollar tu carrera.
- Liderazgo Accesible – Ejecutivos transparentes que están involucrados, son visibles y humanos.
- Personas Apasionadas – Únete a un equipo de personas inteligentes y solidarias que se preocupan profundamente por lo que hacen.
- Incorporación Presencial - Queremos que prosperes desde el día 1 con tus nuevos compañeros 'Grafanistas' para aprender todo sobre lo que hacemos y cómo lo hacemos.
- El Equilibrio es Clave - Operamos una política global de vacaciones anuales de 30 días al año. 3 días de tu derecho a vacaciones anuales se reservan para Días de Cierre de Grafana para permitir que el equipo se desconecte realmente. *Cumpliremos con la legislación local cuando sea aplicable.
