Tabs

Staff Site Reliability Engineer

AWS
Traducción automática. Consulta el original.

Sobre el puesto

Tabs es el Sistema Operativo de IA para Ingresos, creado para equipos modernos de finanzas y contabilidad. Combina una profunda experiencia en ingresos y contabilidad con los agentes y aplicaciones necesarios para gestionar el trabajo de ingresos de principio a fin. Tabs comprende el contexto del cliente y del contrato, aplica la lógica contable y ejecuta flujos de trabajo críticos con controles integrados, auditabilidad y supervisión humana. Con Tabs, los equipos de finanzas pueden pasar de gestionar manualmente los flujos de trabajo de ingresos a dirigir resultados mientras el sistema ejecuta el trabajo.

Buscamos un Staff Site Reliability Engineer para liderar la evolución de la plataforma de Tabs a medida que escalamos. En este puesto, operarás como un contribuidor individual senior, colaborando estrechamente con los equipos de ingeniería y producto para diseñar, construir y operar sistemas que sean fiables, observables y fáciles de desarrollar.

Serás responsable de nuestra dirección de infraestructura, darás forma a cómo enviamos software y establecerás el estándar de excelencia operativa en toda la empresa. Este es un puesto de alto impacto para alguien que disfruta resolviendo problemas complejos de sistemas, influyendo en la arquitectura y elevando el nivel de fiabilidad sin convertirse en un guardián.

Lo que gestionarás

  1. La dirección de infraestructura de AWS y la evolución de la plataforma, incluida la migración de ECS/Fargate hacia un entorno de ejecución más moderno y escalable.
  1. Sistemas de CI/CD con un fuerte énfasis en la experiencia del desarrollador, la seguridad y la automatización (GitHub Actions hoy; madurando CD mañana).
  1. Entornos efímeros y despliegues de vista previa para acelerar la iteración y aumentar la confianza en los cambios.
  1. Estándares de observabilidad en métricas, logs y tracing, incluida la higiene de alertas, dashboards y desarrollo de SLO.
  1. Respuesta a incidentes, postmortems y la cultura de fiabilidad que los rodea.

Lo que harás

  1. Definir y evolucionar estándares de fiabilidad, SLI, SLO y presupuestos de errores.
  1. Mejorar la observabilidad, las alertas y los procesos de incidentes en todos los servicios.
  1. Liderar incidentes de alta gravedad y impulsar seguimientos claros y accionables.
  1. Colaborar con los equipos de ingeniería para diseñar sistemas resilientes y escalables.
  1. Construir automatización para reducir el trabajo repetitivo y disminuir el riesgo operativo.
  1. Mentorizar a ingenieros e influir en las mejores prácticas en todos los equipos.

Requisitos mínimos

Quién eres

  1. Has gestionado sistemas en producción en AWS y puedes liderar cambios a nivel de plataforma.
  1. Piensas en sistemas: riesgo, estrategia de reversión, radio de explosión y bucles de retroalimentación.
  1. Tratas CI/CD y los entornos como productos que deben ser rápidos, fiables y autoservicio.
  1. Influyes a través de la confianza y la claridad en lugar del control.
  1. Equilibras el pragmatismo con la salud del sistema a largo plazo.
  1. Valoras aprender del fracaso y mejorar procesos en lugar de asignar culpas.
  1. Te comunicas con claridad y trabajas bien en equipo.

Experiencia

  1. +10 años en roles de ingeniería de SRE, infraestructura o backend.
  1. Sólida experiencia en ingeniería de software en uno o más lenguajes modernos.
  1. Experiencia operativa experta en sistemas distribuidos en producción a escala.
  1. Profunda experiencia con AWS, herramientas de observabilidad y sistemas de CI/CD.
  1. Comodidad navegando la ambigüedad y estableciendo dirección en un entorno de rápido movimiento.

Información adicional

Este puesto se basa presencialmente en nuestra oficina de Soho en la ciudad de Nueva York.

Beneficios y Ventajas (Empleados a tiempo completo)

  • Compensación y acciones competitivas.
  • PTO ilimitado.
  • Hasta un 100% de prima de seguro médico cubierta por el empleador (médico, dental, visión).
  • Almuerzo proporcionado a través de Sharebite, además de cena para cualquier día posterior en la oficina.
  • Permiso parental de hasta 12 semanas.
  • Beneficios de transporte y aparcamiento libres de impuestos.
  • Seguros voluntarios (Vida, Hospitalización, Enfermedad Crítica, Accidente).
  • Programa de Asistencia al Empleado (Rightway).
  • Membresía gratuita a One Medical.
  • 401k

Tabs es un empleador que ofrece igualdad de oportunidades. Damos la bienvenida a compañeros de todas las identidades y no discriminamos por motivos de raza, etnia, religión, identidad de género, orientación sexual, edad, discapacidad, condición de veterano o cualquier otra característica protegida. Estamos comprometidos a crear un entorno en el que todos puedan crecer, contribuir y sentirse cómodos siendo ellos mismos.

Más oportunidades con un solo perfil

¿Quieres optar a más puestos sin repetir todo el proceso? Crea tu perfil para que te encuentren las empresas que usan Nort.

Crear mi perfil

Tu próximo empleoya está buscándote.

Nort

Plataforma de reclutamiento inverso para programadores