NOS
Medvidi
Senior/Staff DevOps Engineer
Über die Stelle
MEDvidi ist eine KI-gestützte Plattform für psychische Gesundheit, die einen neuen Standard für sichere, effektive und skalierbare psychiatrische Versorgung in den Vereinigten Staaten setzt.
Wir kombinieren zugelassene Anbieter mit proprietären KI-Tools, um eine konsistente, ergebnisorientierte Behandlung für Erkrankungen wie ADHS, Angstzustände, Depressionen und mehr anzubieten. Die Technologie von MEDvidi automatisiert die Dokumentation, Nachverfolgung und Behandlungsplanung, sodass sich die Anbieter auf die Patientenversorgung konzentrieren können, während gleichzeitig die Effizienz und klinische Qualität verbessert wird.
Als unser Senior/Staff DevOps Engineer entscheiden Sie, wohin sich unsere Infrastruktur als Nächstes entwickelt, und nehmen den Rest des Ingenieurteams mit. Dies ist eine praxisorientierte Rolle im wahrsten Sinne des Wortes: Sie legen die technische Richtung fest, setzen sie mit eigenen Händen um und tragen die Verantwortung für Zuverlässigkeit, Kosten, Sicherheit und Entwicklererfahrung im gesamten Unternehmen. Sie arbeiten direkt mit unseren Produktentwicklungsteams zusammen, sind in deren Entwicklungsprozesse eingebunden, beseitigen Infrastruktur-Reibungsverluste und gestalten die Infrastruktur entsprechend den tatsächlichen Produktanforderungen.
Warum diese Rolle
Echte Verantwortung, von Anfang bis Ende. Sie sind für die Ergebnisse verantwortlich, nicht für Aufgaben, einschließlich Ihrer Metriken. Zuverlässigkeit, Kosten, Leistung, Bereitstellungsstatus und Entwicklergeschwindigkeit gehören Ihnen: Sie legen die Ziele fest und bringen proaktiv die Zahlen auf den Tisch.
Technische Führung ohne Management-Overhead. Führen Sie durch Expertise und Initiative, wo die erfahrensten Ingenieure auch diejenigen sind, die im Code arbeiten. Sie geben die Richtung vor und heben den Standard, während Sie praxisorientiert bleiben.
KI-nativ per Default. Agentische KI ist ein erstklassiger Bestandteil unserer Arbeitsweise. Sie werden autonome Agenten delegieren, deren Ergebnisse in Produktionsänderungen integrieren und mitgestalten, wie die gesamte Organisation mit KI aufbaut.
Aufgaben
- Proaktiv die technische Vision und den Quartals-Roadmap für unsere Infrastruktur festlegen und vorantreiben, mit klaren Kompromissen und messbaren Zielen.
- Unsere AWS + Kubernetes (EKS) Infrastruktur betreiben und weiterentwickeln: Cluster-Management, Autoscaling (Karpenter), Richtliniendurchsetzung (Kyverno) und Zero-Downtime-Betrieb.
- End-to-End-Verantwortung für Infrastructure as Code (Terraform, AWS CDK in TypeScript) und unsere GitLab CI/CD (wiederverwendbare/gemeinsame Vorlagen, OIDC, selbstverwaltetes GitLab).
- Beobachtbarkeit (Observability) aufbauen und verantworten, die Teams tatsächlich nutzen (Prometheus, Grafana, OpenTelemetry, OpenSearch, CloudWatch; Log-Pipelines, APM) – eine gemeinsame Sicht auf den Systemzustand, kein Dashboard, das niemand öffnet.
- Blue-Green-Deployments und gesundheitsgesteuerte automatische Rollbacks schnell und unkompliziert halten; Zero-Downtime PostgreSQL Schema-Migrationen (Erweitern/Verkleinern) und CI-Migration-Gating verantworten.
- Security Engineering in einer HIPAA-Umgebung verantworten: Secrets-Hygiene (Rotation, kurzlebige Anmeldeinformationen, Leck-Scanning), PHI-bewusste Handhabung von Logs und Daten sowie Vault als Code verwalten.
- Direkte Zusammenarbeit mit Produktteams, um Infrastruktur-Reibungsverluste zu beseitigen und die Entwicklererfahrung durch Design zu verbessern.
- Agentische KI als Kernbestandteil Ihres Workflows nutzen, indem Sie die Ausgabe autonomer Agenten in die Produktion integrieren.
Anforderungen
- 6+ Jahre Erfahrung im DevOps/Infrastruktur-Engineering, mit starken Systemgrundlagen und solider Linux-Administration und Fehlerbehebung (Leistungsanalyse, Ressourcenmanagement, Prozess-Debugging).
- Praktische Erfahrung mit AWS (EC2, EKS, RDS, ElastiCache, Lambda, SQS, EventBridge, API Gateway, ALB, S3) und produktionsnaher Kubernetes/EKS (Cluster-Management, Node-Skalierung, Richtliniendurchsetzung; Karpenter, Kyverno oder ähnliches).
- Starke Kenntnisse in Infrastructure as Code (Terraform und AWS CDK in TypeScript) und CI/CD-Verantwortung (GitLab CI/CD: wiederverwendbare/gemeinsame Vorlagen, OIDC id_tokens, selbstverwaltetes GitLab).
- Monitoring und Observability in der Praxis (Prometheus, Grafana, OpenTelemetry, OpenSearch, CloudWatch; Log-Shipping und Fehlerverfolgung/APM).
- Praktisches Security Engineering (Secrets-Rotation, kurzlebige Anmeldeinformationen, Leck-Scanning, PHI-bewusste Protokollierung) und HashiCorp Vault als Code (KV, JWT/OIDC-Authentifizierung für CI, Richtliniendesign).
- Blue-Green-Deployments mit automatisierter, gesundheitsgesteuerter Rollback-Funktion; PostgreSQL Zero-Downtime-Schema-Migrationen (Erweitern/Verkleinern) und Migration-Gating in CI.
- Container (Docker, ECR, unveränderliche Tags, Image-Lebenszyklus) und Grundlagen von Netzwerk/Protokollen (Load Balancing, TLS, DNS).
- Praktische Erfahrung mit agentischen KI-Workflows (Claude Code oder ähnliches): Delegation an autonome Agenten und Integration ihrer Ergebnisse in die Produktion.
- Eine entwicklerzentrierte Denkweise, starke Problemlösungsfähigkeiten für komplexe Systemprobleme und ausgeprägte technische Schreibfähigkeiten (Docs-as-Code, ADRs, Design-Dokumente über MRs).
- Fließende Russisch- und Englischkenntnisse (B1).
- Erfahrung in der effektiven Zusammenarbeit in Remote- und verteilten Teams.
Wäre von Vorteil
- Erfahrung in einer regulierten/compliance-intensiven Umgebung (HIPAA, SOC 2 oder ähnlich).
- Konfigurationsmanagement (Ansible) für die Verwaltung von VM-Flotten.
- Node.js Anwendungsbetrieb (pm2, npm), unser Stack ist Node.js + TypeScript.
- GitOps-Tools (ArgoCD, Flux) und tiefere PostgreSQL-Datenbankadministration.
- AWS-Zertifizierungen.
Was wir bieten
- Umfeld mit hoher Wirkung: Eine Chance, zu einem produktgetriebenen Unternehmen im Bereich Medizintechnik beizutragen.
- Wachstum & Vergütung: Klare Wachstumsmöglichkeiten und ein wettbewerbsfähiges Vergütungspaket.
- Remote-First: Langfristige, vollständig remote durchgeführte Zusammenarbeit unter einem B2B-Modell.
- Gesundheit & Wohlbefinden: Krankenversicherung nach der Probezeit, plus Sport- und Wellnessvergütung.
- Karriereentwicklung: Klare Wachstumsmöglichkeiten, einschließlich personalisierter Englischstunden über Preply.
- Freizeit: 19 bezahlte Urlaubstage pro Jahr, 4 zusätzliche Wellnesstage pro Jahr und bezahlte Krankheitstage für die ersten 5 Arbeitstage.
- Kultur: Aufmerksame Geschenke zu wichtigen Lebensereignissen und Offline-Firmenveranstaltungen.
Bereit, etwas zu bewirken? Senden Sie uns Ihr Profil, lassen Sie uns gemeinsam etwas Sinnvolles aufbauen.
MEDvidi ist ein Arbeitgeber, der Chancengleichheit fördert. Wir feiern Vielfalt und setzen uns dafür ein, ein integratives Umfeld für alle Mitarbeiter und Auftragnehmer zu schaffen. Alle qualifizierten Bewerber erhalten eine Berücksichtigung ohne Rücksicht auf Rasse, Hautfarbe, Religion, Geschlecht, sexuelle Orientierung, Geschlechtsidentität, nationale Herkunft, Behinderung oder Veteranenstatus.
