Roku
InterImage
AI/ML Softwareentwickler
Erforderliche Qualifikationen
**Geheimhaltungsstufe ODER Top Secret erforderlich**
- 7+ Jahre Erfahrung im Entwurf, der Erstellung und dem Versand von full-stack-Webanwendungen.
- Praktische AWS-Erfahrung – Compute, Storage, IAM, OpenSearch oder ähnliches (GovCloud-Erfahrung von Vorteil).
- Starke Kenntnisse in Python und modernem JavaScript; komfortabel damit, ein Feature über den gesamten Stack hinweg zu verantworten.
- Reale Erfahrung im Aufbau mit LLMs und GenAI: RAG, Embeddings, Prompt-Design und Modell APIs – nicht nur die Nutzung von Chat-Tools.
- Systemintegrationserfahrung: REST APIs und Datenaustausch mit Enterprise-Systemen.
- Umfangreiche Erfahrung in der Entwicklung von Python-Anwendungen von Grund auf, einschließlich Tests und Bereitstellung
- Praktische Erfahrung mit full stack-Entwicklung (front-end + back-end)
- Kenntnisse in Datenbankdesign und -verwaltung (SQL und/oder NoSQL)
- Erfahrung mit Datenaufbereitung, -transformation und Skripting für Datenpipelines
- Vertrautheit mit der Nutzung von LLMs (z. B. ChatGPT oder ähnliche) zur Verbesserung von Entwicklungsworkflows
- Erfahrung im Erstellen und Nutzen von APIs
- Verständnis von Best Practices in der Softwareentwicklung (Versionskontrolle, Tests, CI/CD)
Wir suchen einen hochqualifizierten Full Stack Entwickler mit fundierter Expertise im Software-Design, um moderne Anwendungen zu entwerfen, zu erstellen und zu skalieren, die datenintensive Systeme und Generative AI-Funktionen integrieren. Diese Rolle liegt an der Schnittstelle von Software-Engineering, Data Engineering und KI-Innovation und unterstützt die Entwicklung von Enterprise-Lösungen, die große Datensätze und fortschrittliche Sprachmodelle nutzen.
Kleines Team, echte Nutzer, funktionierende Software, die in jedem Sprint demonstriert wird.
PixelRain AI ist ein kleines, schnell wachsendes KI-Unternehmen, das eine KI-gestützte Produktlebenszyklus-Wissensplattform für einen Kunden des US-Kriegsministeriums (DoW) liefert: gesteuerte Erfassung technischer Dokumente, ein Enterprise-Ontologie- und Wissensgraphen sowie generative KI-Anwendungen, die Wartungsplanungs-Produkte entwerfen und technische Fragen mit Zitaten beantworten – laufend in der Cloud-Umgebung des Kunden, mit einer Offline-Variante für den Einsatz ohne Netzverbindung.
Hauptverantwortlichkeiten
Sie werden eng mit funktionsübergreifenden Teams zusammenarbeiten, um skalierbare Anwendungen zu entwerfen, zu entwickeln und bereitzustellen und gleichzeitig die Integration von LLM/GenAI-Technologien in Produktionsumgebungen voranzutreiben.
Full Stack Entwicklung
- Entwurf, Entwicklung und Wartung von End-to-End-Webanwendungen (front-end, back-end und APIs)
- Erstellung skalierbarer backend-Dienste unter Verwendung von Python-Frameworks (z. B. Flask, FastAPI, Django)
- Entwicklung responsiver, benutzerfreundlicher front-end-Oberflächen unter Verwendung moderner Frameworks (React, Angular oder ähnliche)
- Architektur und Implementierung von RESTful und/oder GraphQL APIs
- Sicherstellung von Anwendungsleistung, Skalierbarkeit und Sicherheit über den gesamten Stack hinweg
Datenbank & Data Engineering
- Entwurf, Entwicklung und Optimierung von relationalen und/oder NoSQL-Datenbanksystemen
- Erstellung effizienter Datenmodelle und Schemata zur Unterstützung von Anwendungen im großen Maßstab
- Entwicklung von Skripten und Pipelines zur Erfassung, Transformation und Verwaltung von Datenflüssen
- Fehlerbehebung bei Leistungseinbrüchen und Sicherstellung der Datenintegrität
- Arbeit mit großen, komplexen Datensätzen zur Ermöglichung von Analyse- und KI-Anwendungsfällen
Generative AI / LLM Integration
- Erstellung, Test und Bereitstellung von LLM-gestützten Anwendungen und Workflows
- Integration von Generative AI-Funktionen in bestehende Plattformen und Benutzererlebnisse
- Bewertung und Beurteilung von LLM-Ausgaben hinsichtlich Leistung, Genauigkeit und Benutzerfreundlichkeit
- Implementierung von Retrieval-Augmented Generation (RAG)-Pipelines und Vektordatenbank-Integrationen
- Unterstützung von Fine-Tuning, Prompt Engineering und Optimierung von Modellen für missionsspezifische Anwendungsfälle
Systemdesign & Architektur
- Beitrag zum Design von skalierbaren, verteilten Systemarchitekturen
- Zusammenarbeit mit Ingenieuren zur Integration von KI-Komponenten in Enterprise-Umgebungen
- Abwägung von Kompromissen zwischen Leistung, Kosten und Skalierbarkeit
- Unterstützung von CI/CD-Pipelines und DevSecOps-Best Practices für die Bereitstellung
Kunden- & Missionsunterstützung
- Übersetzung von unklaren Anforderungen in technische Lösungen
- Unterstützung von Stakeholdern beim Verständnis sich entwickelnder KI/Technologie-Optionen
- Bereitstellung von Anleitungen zu Best Practices für die Integration von KI in Geschäftsabläufe
Alle Erfahrungsstufen werden berücksichtigt: Gehalt basiert auf Erfahrungsstufe und technischen Kompetenzen
Gehalt: 105,000 - 190,000
InterImage ist ein Arbeitgeber, der Chancengleichheit fördert. Alle qualifizierten Bewerber erhalten eine Anstellung ohne Rücksicht auf Rasse, Hautfarbe, Religion, Geschlecht, sexuelle Orientierung, Geschlechtsidentität, nationale Herkunft, Alter, Behinderung oder Veteranenstatus oder eine andere anwendbare staatliche oder bundesstaatliche geschützte Klasse. InterImage bietet im Rahmen des Rehabilitation Act, Abschnitt 503, und des Vietnam Era Veterans’ Readjustment Assistance Act, eine positive Diskriminierung bei der Beschäftigung für qualifizierte Personen mit Behinderungen und Veteranen.
Bevorzugte / Nice-to-Have-Qualifikationen
- Erfahrung in der Bereitstellung und Verwaltung von LLMs lokal und in AWS-Umgebungen
- Praktische Erfahrung mit dem Fine-Tuning von Modellen und deren Integration in Produktionssysteme
- Erfahrung im Aufbau von RAG-Lösungen und der Arbeit mit Vektordatenbanken (z. B. Pinecone, FAISS)
- Kenntnisse in Prompt Engineering und Techniken zur Inhaltsfilterung
- Vertrautheit mit Frameworks wie LangChain, LlamaIndex oder OpenAI Function Calling
- Erfahrung mit Modelldestillation und -optimierung
- Erfahrung mit Wissensgraphen und Graphdatenbanken (z. B. Neo4j)
- Erfahrung in Cloud-Umgebungen (AWS, Azure oder GCP)
