GFT Technologies SE
99x
AI/ML Ops Engineer
JavaScriptTypeScriptAWSTerraform
Automatische Übersetzung. Prüfe das Original.
Über die Stelle
Wir suchen einen AI/ML Ops Engineer zur Unterstützung der Bereitstellung, Überwachung und operativen Zuverlässigkeit von KI-gestützten Systemen in Produktionsumgebungen.
Diese Rolle kombiniert Elemente von DevOps, Cloud Engineering und Support für KI-Systeme.
Der ideale Kandidat sollte sich im Umgang mit Cloud-Infrastruktur, Überwachungstools und modernen KI-Workflows wohlfühlen und eng mit den Engineering- und KI-Teams zusammenarbeiten.
Hauptverantwortlichkeiten
- Unterstützung bei der Bereitstellung und dem operativen Management von KI/ML-Anwendungen und -Diensten
- Überwachung von KI-Systemen mithilfe von Logs, Metriken, Tracing und Observability-Tools
- Fehlerbehebung und Debugging von KI-Workflows, Pipelines und Laufzeitfehlern
- Unterstützung bei der Wartung skalierbarer, sicherer und zuverlässiger Cloud-Infrastruktur
- Unterstützung bei Prompt-Experimenten, Versionsverfolgung und A/B-Testing-Aktivitäten
- Zusammenarbeit mit Engineering-Teams zur Verbesserung der Systemzuverlässigkeit, Leistung und Automatisierung
- Pflege von CI/CD-Workflows und Bereitstellungspipelines für KI-Dienste
- Teilnahme an der Untersuchung von Vorfällen, Ursachenanalyse und operativen Supportaktivitäten
Bevorzugte Fähigkeiten & Erfahrung
- Erfahrung mit AWS Cloud-Diensten
- Erfahrung mit JavaScript/TypeScript ist erforderlich, während Kenntnisse anderer Programmiersprachen von Vorteil sind
- Vertrautheit mit Monitoring- und Observability-Tools wie: Amazon CloudWatch & Datadog
- Verständnis von Konzepten wie Logging, Metriken, Tracing und Alerting
- Vertrautheit mit KI/ML-Workflows und LLM-basierten Anwendungen
- Erfahrung mit Containern, APIs und Bereitstellungspipelines
- Verständnis von DevOps, Cloud-Infrastruktur und operativen Best Practices
- Kenntnisse von Infrastructure-as-Code-Tools wie Terraform oder CloudFormation
- Bachelor-Abschluss in Informatik, Ingenieurwesen, Data Science oder einem verwandten Bereich
- 2+ Jahre Erfahrung in DevOps, Platform Engineering, SRE, MLOps oder KI-infrastrukturbezogenen Rollen
Was wir suchen
- Starke Problemlösungs- und Debugging-Fähigkeiten
- Interesse an modernen KI-Betriebspraktiken und produktiven KI-Systemen
- Gute Kommunikations- und Kollaborationsfähigkeiten
- Praktische Denkweise mit Fokus auf Zuverlässigkeit, Skalierbarkeit und kontinuierliche Verbesserung
- Fähigkeit, in einem schnelllebigen und sich entwickelnden technologischen Umfeld zu arbeiten
