Steampunk

Ingeniero Senior de LLMOps

PythonAWSGCPDockerKubernetesTerraform
Traducción automática. Consulta el original.

Descripción general

Buscamos un Ingeniero Senior de LLMOps con experiencia para diseñar, implementar y mantener pipelines de modelos de lenguaje grandes (LLM) de nivel de producción, arquitecturas de implementación y sistemas de monitorización en entornos empresariales. El Ingeniero Senior de LLMOps desempeñará un papel fundamental en la operacionalización de capacidades de IA generativa, asegurando que las aplicaciones basadas en LLM sean escalables, seguras, fiables y cumplan con los marcos emergentes de riesgo y gobernanza de IA. Este rol abarca la implementación de modelos, orquestación, evaluación, optimización y pipelines de Generación Aumentada por Recuperación (RAG).

Contribuciones

  1. Diseñar, construir y mantener pipelines escalables de LLM y Generación Aumentada por Recuperación (RAG), incluyendo alojamiento de modelos, optimización de inferencia, capas de recuperación y marcos de gestión de contexto.
  1. Liderar el diseño e implementación de infraestructura GenAI segura en entornos cloud, asegurando fiabilidad, rendimiento, escalabilidad y eficiencia de costes.
  1. Construir y gestionar sistemas de evaluación automatizados que evalúen la calidad de la salida del LLM, la seguridad, la latencia y el cumplimiento de los requisitos de gobernanza de IA.
  1. Desarrollar flujos de trabajo de CI/CD adaptados para aplicaciones basadas en LLM y GenAI, incluyendo versionado de datasets, linaje de modelos y pruebas automatizadas de comportamientos de prompts y modelos.
  1. Colaborar con Ingenieros de Producto de IA y Científicos de Datos para producir prototipos basados en LLM en sistemas mantenibles de nivel empresarial.
  1. Integrar bases de datos vectoriales, pasarelas de modelos, filtros de contenido y marcos de salvaguarda en soluciones integrales de LLM y RAG.
  1. Implementar soluciones de observabilidad y monitorización que rastreen métricas de rendimiento, tasas de alucinación, perfiles de costes y patrones de interacción del usuario.
  1. Liderar la resolución de problemas y el análisis de causa raíz para incidencias relacionadas con la implementación de LLM, el rendimiento de inferencia, los pipelines de recuperación o la fiabilidad general del pipeline.
  1. Desarrollar y mantener servicios, integraciones y automatizaciones basadas en Python que soporten pipelines de LLM y RAG.
  1. Mantenerse al día con las arquitecturas emergentes de LLM, optimizaciones de inferencia, técnicas de ajuste fino y patrones relevantes de MLSecOps.
  1. Garantizar el cumplimiento de los marcos de privacidad de datos, IA ética, seguridad y gobernanza de IA a lo largo del diseño y las operaciones del pipeline.
  1. Mentorizar a ingenieros junior y contribuir a las mejores prácticas de ingeniería de IA, herramientas y patrones de infraestructura reutilizables.

¡Contribuirás al crecimiento de nuestra Práctica de Explotación de Datos e IA!

Cualificaciones

  1. Capacidad para obtener y mantener una autorización de seguridad del gobierno de EE. UU.
  1. Título de Grado y más de 10 años de experiencia total.
  1. Más de 5 años de experiencia en ingeniería de software, ingeniería de datos, MLOps o ingeniería cloud, con más de 2 años centrados específicamente en operaciones de LLM o GenAI.
  1. Experiencia práctica en el diseño, construcción y mantenimiento de pipelines de Generación Aumentada por Recuperación (RAG).
  1. Dominio de Python.
  1. Sólida experiencia en la implementación de modelos utilizando frameworks como Hugging Face Transformers, vLLM, TensorRT-LLM o similares.
  1. Experiencia con herramientas y frameworks operativos como FastAPI, PyTorch, LangChain, LlamaIndex y bases de datos vectoriales como FAISS, Milvus, Pinecone o similares.
  1. Conocimientos avanzados de plataformas cloud como AWS, Azure o GCP, incluyendo alojamiento de modelos, computación distribuida y patrones de redes seguras.
  1. Experiencia práctica en la construcción de pipelines de CI/CD, frameworks de pruebas automatizadas y aprovisionamiento de entornos para cargas de trabajo de IA/ML.
  1. Experiencia con Docker, Kubernetes e herramientas de infraestructura como código como Terraform o CloudFormation.
  1. Familiaridad con MLSecOps, gobernanza de IA, endurecimiento de modelos, defensas contra inyección de prompts y monitorización de seguridad de contenido.
  1. Sólida comprensión de la monitorización, observabilidad y perfilado de rendimiento para sistemas de inferencia de LLM de alto rendimiento.
  1. Excelentes habilidades de comunicación escrita y verbal, con capacidad para explicar compensaciones y decisiones arquitectónicas a partes interesadas técnicas y no técnicas.
  1. Capacidad demostrada para equilibrar el pensamiento de plataforma a largo plazo con operaciones prácticas y resolución rápida de problemas.
  1. Experiencia trabajando en entornos de desarrollo Agile y utilizando herramientas modernas de gestión de proyectos.

Sobre steampunk

Steampunk se basa en varios factores para determinar el salario, incluyendo, entre otros, la ubicación geográfica, los requisitos contractuales, la educación, el conocimiento, las habilidades, las competencias y la experiencia. La compensación proyectada para este puesto es

145.000 $ a 185.000 $. La estimación mostrada representa un rango salarial anual típico para este puesto. El salario anual es solo un aspecto del paquete total de compensación de Steampunk para los empleados. Obtenga más información sobre los beneficios adicionales de Steampunk aquí.

Declaración de Identidad

Como parte del proceso de solicitud, se espera que esté en cámara durante las entrevistas y evaluaciones. Nos reservamos el derecho de tomar su fotografía para verificar su identidad y prevenir el fraude.

Somos un empleador que ofrece igualdad de oportunidades y todos los solicitantes cualificados recibirán consideración para el empleo sin distinción de raza, color, religión, sexo, origen nacional, discapacidad, condición de veterano protegido o cualquier otra característica protegida por la ley. Steampunk participa en el programa E-Verify.

Steampunk es un Agente de Cambio en la industria de contratación federal, aportando nuevas ideas a clientes en los sectores de Seguridad Nacional, Civil Federal, Salud y DoD. A través de nuestra metodología de entrega Centrada en el Humano, estamos cambiando fundamentalmente las expectativas que nuestros clientes federales tienen de una verdadera responsabilidad compartida en la resolución de sus desafíos de misión más difíciles. Si desea obtener más información sobre nuestra historia, visite steampunk.com.

Más oportunidades con un solo perfil

¿Quieres optar a más puestos sin repetir todo el proceso? Crea tu perfil para que te encuentren las empresas que usan Nort.

Crear mi perfil

Tu próximo empleoya está buscándote.

Nort

Plataforma de reclutamiento inverso para programadores