Together AI

Ingeniero de plataformas, Model Shaping

PythonAWSGCPKubernetesGoTerraform
Traducción automática. Consulta el original.

SOBRE EL PUESTO

El equipo de Model Shaping en Together AI trabaja en productos e investigación para adaptar modelos base abiertos a aplicaciones posteriores. Desarrollamos servicios que permiten a los desarrolladores de machine learning elegir los mejores modelos para sus tareas y mejorarlos aún más utilizando datos específicos del dominio. Además, desarrollamos nuevos métodos para un entrenamiento y evaluación de modelos más eficientes, inspirándonos en un amplio espectro de ideas en machine learning, procesamiento de lenguaje natural y sistemas de ML.

Como Ingeniero de Plataforma en Model Shaping, trabajarás en la intersección de la ingeniería backend y la infraestructura, construyendo las capas fundamentales de la plataforma de Together para la personalización y evaluación de modelos. Diseñarás, desarrollarás y operarás tanto los servicios backend como los sistemas subyacentes que nos permiten escalar de manera sostenible y fiable los flujos de trabajo de producción lanzados por nuestros usuarios, así como los experimentos de investigación internos.

Operarás en un entorno interfuncional, colaborando con otros ingenieros e investigadores del equipo para mejorar la infraestructura en función de las necesidades de los proyectos en los que trabajan. También interactuarás con otros equipos de ingeniería en Together (como Comercio, Ingeniería de Datos e Infraestructura en la Nube) para integrar los servicios desarrollados por Model Shaping con los sistemas desarrollados por dichos equipos.

RESPONSABILIDADES

  1. Diseñar y construir los sistemas e infraestructura de Together para la personalización de modelos, incluyendo funciones orientadas al usuario y mejoras internas
  1. Contribuir a las mejoras de fiabilidad de la plataforma, participando en una rotación de guardia y mejorando los procesos de respuesta ante incidentes
  1. Crear y mejorar herramientas internas para el despliegue, la integración continua y la observabilidad
  1. Construir una plataforma de orquestación de trabajos que abarque múltiples centros de datos, soportando un panorama de hardware altamente heterogéneo
  1. Colaborar con equipos que desarrollan servicios internos, codiseñando estos servicios e incorporándolos en los sistemas construidos dentro de Together

REQUISITOS

  1. 3+ años de experiencia en la construcción de infraestructura o componentes backend de servicios de producción
  1. Amplia experiencia en el diseño, operación y resolución de problemas en entornos de producción Linux y plataformas basadas en Kubernetes
  1. Sólida formación en ingeniería de software en Python o Go
  1. Experiencia con herramientas de automatización de infraestructura (Terraform, Ansible), pilas de monitorización/observabilidad (Prometheus, Grafana) y tuberías de CI/CD (GitHub Actions, ArgoCD)
  1. Experiencia en administración de entornos en la nube (p. ej., AWS/GCP/Azure), preferiblemente con un entorno híbrido de metal desnudo/nube
  1. Sólidas habilidades de comunicación, disposición para documentar sistemas y procesos, y colaborar con compañeros de diversa experiencia técnica
  1. Capacidad para operar en toda la pila, desde operaciones de clúster y automatización de infraestructura hasta el desarrollo de servicios backend

LA EXPERIENCIA EN CUALQUIERA DE LAS SIGUIENTES ÁREAS TE HARÁ DESTACAR

  1. Desarrollo de sistemas de producción a gran escala con requisitos de alta fiabilidad
  1. Marcos de orquestación de tuberías (p. ej., Kubeflow, Argo Workflows, Flyte)
  1. Gestión de cargas de trabajo de GPU en clústeres HPC, idealmente con experiencia práctica en la operación de la pila de redes de NVIDIA (p. ej., NCCL, firmware de Mellanox, GPUDirect RDMA)
  1. Despliegue de servicios para entrenamiento o inferencia de IA
  1. Fundamentos de redes, incluyendo TCP/IP, DNS, enrutamiento, equilibrio de carga, TLS y herramientas de depuración de red
  1. Mantenimiento o contribución a proyectos de código abierto

SOBRE TOGETHER AI

Together AI, la Nube Nativa de IA, está diseñada específicamente para ingenieros de IA. Los desarrolladores de aplicaciones de IA obtienen una inferencia de alto rendimiento que escala de manera fiable, ajuste fino y aprendizaje por refuerzo para crear modelos especializados de nivel fronterizo, y preentrenamiento a escala masiva para una inteligencia totalmente personalizada, todo ello en torno a un mercado de modelos abiertos líderes que los equipos pueden ejecutar, adaptar y poseer.

Con la confianza de Cursor, Decagon, ElevenLabs, Salesforce y Zoom, Together sirve más de 400 billones de tokens al mes.

COMPENSACIÓN

Ofrecemos una compensación competitiva, capital en la startup, seguro médico y otros beneficios, así como flexibilidad en términos de trabajo remoto.

El rango salarial base en EE. UU. para este puesto a tiempo completo es de $200,000 - $290,000.

Nuestros rangos salariales se determinan según la ubicación, el nivel y el puesto. La compensación individual se determinará en función de la experiencia, las habilidades y los conocimientos relacionados con el trabajo.

IGUALDAD DE OPORTUNIDADES

Together AI es un empleador que ofrece igualdad de oportunidades y se enorgullece de ofrecer igualdad de oportunidades de empleo a todos, independientemente de la raza, color, ascendencia, religión, sexo, origen nacional, orientación sexual, edad, ciudadanía, estado civil, discapacidad, identidad de género, condición de veterano y más.

Por favor, consulte nuestra política de privacidad en together.ai/privacy

Más oportunidades con un solo perfil

¿Quieres optar a más puestos sin repetir todo el proceso? Crea tu perfil para que te encuentren las empresas que usan Nort.

Crear mi perfil

Tu próximo empleoya está buscándote.

Nort

Plataforma de reclutamiento inverso para programadores