Range Generation Next LLC
InterImage
Desarrollador/a de Software de IA/ML
Cualificaciones Requeridas
**Se requiere autorización de acceso clasificado Secreto o Confidencial**
- + de 7 años diseñando, construyendo y lanzando aplicaciones web full-stack.
- Experiencia práctica en AWS — cómputo, almacenamiento, IAM, OpenSearch o similar (experiencia en GovCloud es una ventaja).
- Sólida experiencia en Python y JavaScript moderno; cómodo/a asumiendo la responsabilidad de una característica en toda la pila tecnológica.
- Experiencia real en la construcción con LLMs e IA Generativa: RAG, embeddings, diseño de prompts y APIs de modelos — no solo el uso de herramientas de chat.
- Experiencia en integración de sistemas: APIs REST e intercambio de datos con sistemas empresariales.
- Sólida experiencia en el desarrollo de aplicaciones de Python desde cero, incluyendo pruebas y despliegue
- Experiencia práctica en desarrollo full stack (front-end + back-end)
- Dominio del diseño y la gestión de bases de datos (SQL y/o NoSQL)
- Experiencia en manipulación de datos, transformación y scripting para canalizaciones de datos
- Familiaridad con el uso de LLMs (por ejemplo, ChatGPT o similar) para mejorar los flujos de trabajo de desarrollo
- Experiencia en la construcción y el consumo de APIs
- Comprensión de las mejores prácticas de desarrollo de software (control de versiones, pruebas, CI/CD)
Buscamos un/a Desarrollador/a Full Stack altamente cualificado/a con una sólida experiencia en diseño de software para diseñar, construir y escalar aplicaciones modernas que integren sistemas intensivos en datos y capacidades de IA Generativa. Este puesto se sitúa en la intersección de la ingeniería de software, la ingeniería de datos y la innovación en IA, apoyando el desarrollo de soluciones empresariales que aprovechan grandes conjuntos de datos y modelos de lenguaje avanzados. PixelRain AI es una pequeña empresa de IA de rápido movimiento que ofrece una plataforma de conocimiento del ciclo de vida del producto impulsada por IA para un cliente del Departamento de Guerra (DoW) de EE. UU.: ingesta controlada de documentos técnicos, una ontología empresarial y un grafo de conocimiento, y aplicaciones de IA generativa que redactan productos de planificación de mantenimiento y responden preguntas de ingeniería con citas, ejecutándose en el entorno de nube del cliente, con una variante sin conexión para uso desconectado. Equipo pequeño, usuarios reales, software funcional demostrado en cada sprint. Trabajará en estrecha colaboración con equipos multifuncionales para arquitectar, desarrollar y desplegar aplicaciones escalables, al tiempo que ayuda a impulsar la integración de tecnologías de LLM/IA Generativa en entornos de producción.
Se aceptan todos los niveles de habilidad: el salario se basa en el nivel de habilidad y las competencias técnicas
Salario: 105,000 - 180,000
InterImage es un Empleador de Igualdad de Oportunidades. Todos los solicitantes cualificados recibirán consideración para el empleo sin distinción de raza, color, religión, sexo, orientación sexual, identidad de género, origen nacional, edad, discapacidad o condición de veterano, o cualquier otra clase protegida aplicable estatal o federal. InterImage proporciona acción afirmativa en el empleo para Individuos Cualificados con Discapacidad y Veteranos Protegidos en cumplimiento de la Sección 503 de la Ley de Rehabilitación y la Ley de Asistencia para el Reajuste de los Veteranos de la Era de Vietnam.
Responsabilidades Clave
Desarrollo Full Stack
- Diseñar, desarrollar y mantener aplicaciones web de extremo a extremo (front-end, back-end y APIs)
- Construir servicios backend escalables utilizando frameworks de Python (por ejemplo, Flask, FastAPI, Django)
- Desarrollar interfaces front-end responsivas y fáciles de usar utilizando frameworks modernos (React, Angular o similares)
- Arquitectar e implementar RESTful y/o GraphQL APIs
- Garantizar el rendimiento, la escalabilidad y la seguridad de las aplicaciones en toda la pila tecnológica
Base de Datos e Ingeniería de Datos
- Diseñar, desarrollar y optimizar sistemas de bases de datos relacionales y/o NoSQL
- Crear modelos y esquemas de datos eficientes para soportar aplicaciones a gran escala
- Desarrollar scripts y canalizaciones para ingerir, transformar y gestionar flujos de datos
- Solucionar cuellos de botella de rendimiento y garantizar la integridad de los datos
- Trabajar con conjuntos de datos grandes y complejos para habilitar casos de uso de análisis e IA
Integración de IA Generativa / LLM
- Construir, probar y desplegar aplicaciones y flujos de trabajo basados en LLM
- Integrar capacidades de IA Generativa en plataformas y experiencias de usuario existentes
- Evaluar y valorar los resultados de LLM en cuanto a rendimiento, precisión y usabilidad
- Implementar canalizaciones de Generación Aumentada por Recuperación (RAG) e integraciones de bases de datos vectoriales
- Soportar el ajuste fino, la ingeniería de prompts y la optimización de modelos para casos de uso específicos de la misión
Diseño y Arquitectura de Sistemas
- Contribuir al diseño de arquitecturas de sistemas escalables y distribuidos
- Colaborar con ingenieros para integrar componentes de IA en entornos empresariales
- Equilibrar las compensaciones entre rendimiento, coste y escalabilidad
- Soportar canalizaciones de CI/CD y las mejores prácticas de DevSecOps para el despliegue
Soporte al Cliente y a la Misión
- Traducir requisitos ambiguos en soluciones técnicas
- Ayudar a los interesados a comprender las opciones tecnológicas/de IA en evolución
- Proporcionar orientación sobre las mejores prácticas para integrar la IA en los flujos de trabajo empresariales
Cualificaciones Preferidas / Deseables
- Experiencia en el despliegue y la gestión de LLMs localmente y en entornos de AWS
- Experiencia práctica en el ajuste fino de modelos y su integración en sistemas de producción
- Experiencia en la construcción de soluciones RAG y el trabajo con bases de datos vectoriales (por ejemplo, Pinecone, FAISS)
- Conocimiento de ingeniería de prompts y técnicas de filtrado de contenido
- Familiaridad con frameworks como LangChain, LlamaIndex o llamadas a funciones de OpenAI
- Experiencia en destilación y optimización de modelos
- Exposición a grafos de conocimiento y bases de datos de grafos (por ejemplo, Neo4j)
- Experiencia trabajando en entornos de nube (AWS, Azure o GCP)
