Together AI

Ingeniero/a Senior de Machine Learning , Voice AI

PythonGo
Traducción automática. Consulta el original.

SOBRE EL PUESTO

Together AI está construyendo la mejor infraestructura de inferencia para aplicaciones de voz. Nuestra plataforma de Voice AI impulsa agentes y aplicaciones de voz en tiempo real de nivel de producción, ofreciendo modelos de conversión de voz a texto y de texto a voz con la mejor latencia y fiabilidad de su clase.

Buscamos un/a Ingeniero/a Senior de ML para liderar la capa de servicio de modelos para cargas de trabajo de voz. Trabajarás directamente con motores de inferencia como TRT-LLM y SGLang para optimizar la forma en que servimos modelos como Whisper, Parakeet, Orpheus y Kokoro, llevando la latencia y el rendimiento al límite. Perfilarás el uso de GPU, diseñarás estrategias de procesamiento por lotes para audio en streaming y asegurarás que las nuevas arquitecturas de modelos puedan pasar de la investigación a la producción rápidamente. Esta es una contratación fundamental en un equipo pequeño de alto impacto. La inferencia de voz presenta desafíos únicos (audio en streaming, tokenización, presupuestos de latencia en tiempo real) que requieren un enfoque dedicado de ingeniería de ML. Darás forma a cómo Together sirve modelos de voz a medida que la industria se desplaza de arquitecturas de canalización (ASR → LLM → TTS) hacia sistemas de voz a voz de extremo a extremo.

RESPONSABILIDADES

  1. Liderar la pila de servicio de modelos que impulsa la plataforma de voz de Together en STT, TTS y voz a voz.
  1. Trabajar directamente con aceleradores de última generación (H100s, H200s, B200s) para optimizar la inferencia de modelos de voz.
  1. Colaborar con socios de modelos (Cartesia, Deepgram, Rime y otros) para llevar sus modelos a producción en la infraestructura de Together.
  1. Construir marcos de evaluación de calidad que guíen la selección de modelos para los clientes e informen la hoja de ruta.
  1. Unirte a un equipo pequeño en etapa inicial con un impacto significativo en un área de producto de rápido crecimiento.
  1. Optimizar el rendimiento de la inferencia para modelos de voz (STT, TTS, voz a voz), apuntando al mejor TTFB, rendimiento y utilización de GPU de su clase en nuestro conjunto de modelos seleccionado.
  1. Poner en producción modelos de voz en endpoints serverless y dedicados, incluyendo estrategias de procesamiento por lotes, inferencia en streaming y gestión de memoria adaptada a cargas de trabajo de audio.
  1. Construir y mantener un marco de evaluación de modelos de voz, midiendo WER en diferentes acentos, idiomas y condiciones de ruido para STT; y naturalidad, latencia y precisión de pronunciación para TTS.
  1. Habilitar nuevas arquitecturas de modelos en nuestra pila de servicio a medida que el campo evoluciona, incluyendo LLMs nativos de audio, modelos basados en códecs (SNAC) y sistemas de voz a voz.
  1. Colaborar con socios de modelos para integrar y optimizar sus modelos (Cartesia, Deepgram, Rime y otros) ejecutándose en la infraestructura de Together.
  1. Perfilar y depurar el rendimiento en toda la pila de inferencia, desde kernels de GPU hasta cuellos de botella a nivel de framework, y entregar mejoras medibles.
  1. Trabajar con el equipo de ingeniería de plataforma para asegurar que la capa de servicio cumpla con los requisitos de latencia y fiabilidad de las APIs de voz en tiempo real.
  1. Contribuir a las capacidades de ajuste fino de modelos de voz (STT y TTS) a medida que permitimos a los clientes construir experiencias de voz diferenciadas en Together.
  1. Sentar las bases para múltiples productos nuevos en el futuro.

REQUISITOS

  1. 5+ años de experiencia en ingeniería de ML, con enfoque en servicio de modelos, optimización de inferencia o infraestructura de ML.
  1. Experiencia práctica con motores de servicio LLM (vLLM, SGLang, TensorRT-LLM o similares), con comodidad para leer y modificar los componentes internos del motor, no solo usando APIs.
  1. Sólido dominio de Python y PyTorch; experiencia con perfilado y optimización de GPU (CUDA, gestión de memoria, depuración a nivel de kernel).
  1. Historial de entrega de sistemas de ML a producción con mejoras de rendimiento medibles.
  1. Fuerte sentido de producto: piensas en lo que realmente necesitan los desarrolladores que crean aplicaciones de voz, no solo en lo que es técnicamente interesante.
  1. Comodidad trabajando en un equipo pequeño en etapa inicial donde asumirás múltiples roles y trabajarás con agilidad.
  1. Licenciatura o Máster en Informática, Ingeniería Eléctrica o campo relacionado, o experiencia práctica equivalente.
  1. La experiencia con ML de voz y audio (ASR, arquitecturas TTS, procesamiento de señales de audio) es una gran ventaja pero no es obligatoria; puedes aprender esto rápidamente si tienes fundamentos sólidos de ingeniería de ML.
  1. La familiaridad con códecs de audio y esquemas de tokenización (SNAC, Encodec, DAC) es una ventaja.
  1. La experiencia en entrenamiento o ajuste fino de modelos de voz es una ventaja.

SOBRE TOGETHER AI

Together AI, la nube nativa de IA, está diseñada específicamente para ingenieros de IA. Los desarrolladores de aplicaciones de IA obtienen una inferencia de alto rendimiento que escala de manera fiable, ajuste fino y aprendizaje por refuerzo para crear modelos especializados de vanguardia, y pre-entrenamiento a gran escala para una inteligencia totalmente personalizada, todo alrededor de un mercado de modelos abiertos líderes que los equipos pueden ejecutar, adaptar y poseer.

Con la confianza de Cursor, Decagon, ElevenLabs, Salesforce y Zoom, Together sirve 400+ billones de tokens al mes.

COMPENSACIÓN

Ofrecemos una compensación competitiva, capital (equity) en la startup, seguro médico y otros beneficios competitivos. El rango salarial base en EE. UU. para este puesto a tiempo completo es:

$200,000 - $260,000 + capital + beneficios.

Nuestros rangos salariales se determinan según la ubicación, el nivel y el rol. La compensación individual se determinará según la experiencia, las habilidades y el conocimiento relacionado con el trabajo.

IGUALDAD DE OPORTUNIDADES

Together AI es un empleador que ofrece igualdad de oportunidades y se enorgullece de ofrecer igualdad de oportunidades de empleo a todos, independientemente de la raza, color, ascendencia, religión, sexo, origen nacional, orientación sexual, edad, ciudadanía, estado civil, discapacidad, identidad de género, estatus de veterano y más.

Por favor, consulta nuestra política de privacidad en together.ai/privacy

Más oportunidades con un solo perfil

¿Quieres optar a más puestos sin repetir todo el proceso? Crea tu perfil para que te encuentren las empresas que usan Nort.

Crear mi perfil

Tu próximo empleoya está buscándote.

Nort

Plataforma de reclutamiento inverso para programadores