Range Generation Next LLC
Steampunk
Senior LLMOps Engineer
Überblick
Wir suchen einen erfahrenen Senior LLMOps Engineer, der produktionsreife Large Language Model (LLM)-Pipelines, Deployment-Architekturen und Monitoring-Systeme in Unternehmensumgebungen entwirft, implementiert und wartet. Der Senior LLMOps Engineer spielt eine entscheidende Rolle bei der Operationalisierung von generativen KI-Fähigkeiten und stellt sicher, dass LLM-basierte Anwendungen skalierbar, sicher, zuverlässig und konform mit aufkommenden KI-Risiko- und Governance-Frameworks sind. Diese Rolle umfasst Modelldepot, Orchestrierung, Evaluierung, Optimierung und Retrieval-Augmented Generation (RAG)-Pipelines.
Beiträge
- Architektur, Aufbau und Wartung skalierbarer LLM- und Retrieval-Augmented Generation (RAG)-Pipelines, einschließlich Model-Hosting, Inferenzoptimierung, Retrieval-Schichten und Frameworks für das Kontextmanagement.
- Leitung des Designs und der Implementierung sicherer GenAI-Infrastrukturen in Cloud-Umgebungen, um Zuverlässigkeit, Leistung, Skalierbarkeit und Kosteneffizienz zu gewährleisten.
- Aufbau und Verwaltung automatisierter Evaluierungssysteme, die die LLM-Ausgabequalität, Sicherheit, Latenz und Einhaltung von KI-Governance-Anforderungen bewerten.
- Entwicklung von CI/CD-Workflows, die auf LLM- und GenAI-basierte Anwendungen zugeschnitten sind, einschließlich Dataset-Versioning, Model-Lineage und automatisiertem Testen von Prompt- und Modellverhalten.
- Zusammenarbeit mit AI Product Engineers und Data Scientists, um LLM-basierte Prototypen in unternehmensweite, wartbare Systeme zu überführen.
- Integration von Vektordatenbanken, Model-Gateways, Content-Filtern und Guardrail-Frameworks in End-to-End LLM- und RAG-Lösungen.
- Implementierung von Observability- und Monitoring-Lösungen, die Leistungskennzahlen, Halluzinationsraten, Kostenprofile und Benutzerinteraktionsmuster verfolgen.
- Leitung von Fehlerbehebungen und Ursachenanalysen bei Problemen im Zusammenhang mit LLM-Deployment, Inferenzleistung, Retrieval-Pipelines oder der allgemeinen Pipeline-Zuverlässigkeit.
- Entwicklung und Wartung von Python-basierten Diensten, Integrationen und Automatisierungen zur Unterstützung von LLM- und RAG-Pipelines.
- Bleiben Sie auf dem Laufenden über aufkommende LLM-Architekturen, Inferenzoptimierungen, Fine-Tuning-Techniken und relevante MLSecOps-Muster.
- Sicherstellung der Einhaltung von Datenschutz-, ethischen KI-, Sicherheits- und KI-Governance-Frameworks während des gesamten Pipeline-Designs und Betriebs.
- Mentoring von Junior-Ingenieuren und Beitrag zu Best Practices, Tools und wiederverwendbaren Infrastrukturmustern im Bereich KI-Engineering.
Sie tragen zum Wachstum unserer AI & Data Exploitation Practice bei!
Qualifikationen
- Fähigkeit, eine Sicherheitsfreigabe der US-Regierung zu erhalten und aufrechtzuerhalten.
- Bachelor-Abschluss und 10+ Jahre Gesamterfahrung.
- 5+ Jahre Erfahrung in Software Engineering, Data Engineering, MLOps oder Cloud Engineering, davon 2+ Jahre speziell im Bereich LLM oder GenAI-Betrieb.
- Praktische Erfahrung im Design, Aufbau und der Wartung von Retrieval-Augmented Generation (RAG)-Pipelines.
- Fließende Kenntnisse in Python.
- Umfangreiche Erfahrung in der Bereitstellung von Modellen mit Frameworks wie Hugging Face Transformers, vLLM, TensorRT-LLM oder ähnlichen.
- Erfahrung mit operativen Tools und Frameworks wie FastAPI, PyTorch, LangChain, LlamaIndex und Vektordatenbanken wie FAISS, Milvus, Pinecone oder ähnlichen.
- Fortgeschrittene Kenntnisse von Cloud-Plattformen wie AWS, Azure oder GCP, einschließlich Model-Hosting, verteilter Rechenleistung und sicherer Netzwerk-Patterns.
- Praktische Erfahrung im Aufbau von CI/CD-Pipelines, automatisierten Test-Frameworks und der Bereitstellung von Umgebungen für KI/ML-Workloads.
- Erfahrung mit Docker, Kubernetes und Infrastructure-as-Code-Tools wie Terraform oder CloudFormation.
- Kenntnisse in MLSecOps, KI-Governance, Model-Härtung, Prompt-Injection-Abwehr und Überwachung der Inhalts-Sicherheit.
- Starkes Verständnis von Logging, Observability und Performance-Profiling für Hochdurchsatz-LLM-Inferenzsysteme.
- Ausgezeichnete schriftliche und mündliche Kommunikationsfähigkeiten mit der Fähigkeit, Trade-offs und architektonische Entscheidungen technischen und nicht-technischen Stakeholdern zu erklären.
- Nachgewiesene Fähigkeit, langfristiges Plattformdenken mit operativem Tagesgeschäft und schneller Problemlösung zu verbinden.
- Erfahrung in agilen Entwicklungsumgebungen und mit modernen Projektmanagement-Tools.
Über steampunk
Steampunk ermittelt das Gehalt anhand mehrerer Faktoren, darunter, aber nicht beschränkt auf, geografischer Standort, vertragliche Anforderungen, Ausbildung, Wissen, Fähigkeiten, Kompetenzen und Erfahrung. Die prognostizierte Gehaltsspanne für diese Position beträgt
$145,000 bis $185,000. Die angezeigte Schätzung stellt eine typische jährliche Gehaltsspanne für diese Position dar. Das Jahresgehalt ist nur ein Aspekt des gesamten Vergütungspakets von Steampunk für Mitarbeiter. Erfahren Sie hier mehr über zusätzliche Steampunk-Leistungen.
Identitätserklärung
Im Rahmen des Bewerbungsprozesses wird erwartet, dass Sie während Vorstellungsgesprächen und Bewertungen auf der Kamera sichtbar sind. Wir behalten uns das Recht vor, Ihr Bild zur Überprüfung Ihrer Identität und zur Verhinderung von Betrug aufzunehmen.
Wir sind ein Arbeitgeber, der Chancengleichheit fördert, und alle qualifizierten Bewerber erhalten eine Anstellung ohne Rücksicht auf Rasse, Hautfarbe, Religion, Geschlecht, nationale Herkunft, Behinderungsstatus, geschützten Veteranenstatus oder andere gesetzlich geschützte Merkmale. Steampunk nimmt am E-Verify-Programm teil.
Steampunk ist ein Change Agent in der Bundesauftragnehmerbranche und bringt neues Denken in Kunden in den Bereichen Homeland, Federal Civilian, Health und DoD ein. Durch unsere Human-Centered Delivery-Methodik verändern wir die Erwartungen, die unsere Bundeskunden an eine echte gemeinsame Rechenschaftspflicht bei der Lösung ihrer schwierigsten Missionsherausforderungen haben. Wenn Sie mehr über unsere Geschichte erfahren möchten, besuchen Sie steampunk.com.
