Together AI

Machine Learning Engineer - Inference

PythonRust
Automatische Übersetzung. Prüfe das Original.

ÜBER DIE ROLLE

Together AI sucht einen Machine Learning Engineer zur Verstärkung unseres Inference Engine Teams, mit Fokus auf die Optimierung und Verbesserung der Leistung unserer KI-Inferenzsysteme. Diese Rolle beinhaltet die Arbeit mit hochmodernen Large Language Models und die Sicherstellung, dass diese effizient und effektiv in großem Maßstab laufen. Wenn Sie sich für KI-Inferenz, PyTorch und die Entwicklung von Hochleistungssystemen begeistern, möchten wir von Ihnen hören. Diese Position bietet die Möglichkeit zur engen Zusammenarbeit mit KI-Forschern und Ingenieuren, um Spitzen-KI-Lösungen zu entwickeln. Werden Sie Teil unserer Zukunft bei TOGETHER AI!

VERANTWORTLICHKEITEN

  1. Entwerfen und Erstellen der Produktionssysteme, die die Together AI-Inferenz-Engine antreiben und Zuverlässigkeit und Leistung in großem Maßstab ermöglichen.
  1. Entwickeln und Optimieren von Laufzeit-Inferenzdiensten für groß angelegte KI-Anwendungen.
  1. Zusammenarbeit mit Forschern, Ingenieuren, Produktmanagern und Designern, um neue Funktionen und Forschungsmöglichkeiten in die Welt zu bringen.
  1. Durchführung von Design- und Code-Reviews, um hohe Qualitätsstandards zu gewährleisten.
  1. Erstellen von Diensten, Tools und Entwicklerdokumentationen zur Unterstützung der Inferenz-Engine.
  1. Implementieren robuster und fehlertoleranter Systeme für die Datenaufnahme und -verarbeitung.

ANFORDERUNGEN

  1. 3+ Jahre Erfahrung im Schreiben von hochperformantem, gut getestetem Code für die Produktion.
  1. Beherrschung von Python und PyTorch.
  1. Nachgewiesene Erfahrung im Aufbau von Hochleistungsbibliotheken und -werkzeugen.
  1. Ausgezeichnetes Verständnis von Low-Level-Betriebssystemkonzepten, einschließlich Multithreading, Speicherverwaltung, Netzwerken, Speicherung, Leistung und Skalierung.
  1. Bevorzugt: Kenntnisse bestehender KI-Inferenzsysteme wie TGI, vLLM, TensorRT-LLM, Optimum
  1. Bevorzugt: Kenntnisse von KI-Inferenztechniken wie spekulativer Dekodierung.
  1. Bevorzugt: Kenntnisse in CUDA/Triton-Programmierung.
  1. Von Vorteil: Kenntnisse in Rust, Cython und Compilern.

ÜBER TOGETHER AI

Together AI, die AI Native Cloud, ist speziell für KI-Ingenieure konzipiert. KI-Anwendungsentwickler erhalten hochperformante Inferenz, die zuverlässig skaliert, Fine-Tuning und Reinforcement Learning zur Erstellung spezialisierter Modelle auf dem neuesten Stand der Technik sowie Pre-Training in massivem Maßstab für vollständig benutzerdefinierte Intelligenz, alles rund um einen Marktplatz führender Open-Source-Modelle, die Teams ausführen, anpassen und besitzen können.

Vertraut von Cursor, Decagon, ElevenLabs, Salesforce und Zoom, bedient Together über 400 Billionen Tokens pro Monat.

VERGÜTUNG

Wir bieten wettbewerbsfähige Vergütung, Startup-Aktienoptionen, Krankenversicherung und andere wettbewerbsfähige Leistungen. Die Gehaltsspanne für diese Vollzeitstelle in den USA beträgt 200.000 $ - 300.000 $ plus Aktienoptionen plus Leistungen. Unsere Gehaltsspannen werden nach Standort, Niveau und Rolle bestimmt. Die individuelle Vergütung wird anhand von Erfahrung, Fähigkeiten und fachspezifischem Wissen ermittelt.

CHANCENGLEICHHEIT

Together AI ist ein Arbeitgeber, der Chancengleichheit fördert und stolz darauf ist, allen Personen gleiche Beschäftigungsmöglichkeiten zu bieten, unabhängig von Rasse, Hautfarbe, Herkunft, Religion, Geschlecht, nationaler Herkunft, sexueller Orientierung, Alter, Staatsbürgerschaft, Familienstand, Behinderung, Geschlechtsidentität, Veteranenstatus und mehr.

Bitte beachten Sie unsere Datenschutzrichtlinie unter together.ai/privacy

Mehr Möglichkeiten mit einem Profil

Für mehr Stellen berücksichtigt werden, ohne den ganzen Prozess zu wiederholen? Erstellen Sie Ihr Profil, damit Unternehmen auf Nort Sie finden.

Profil erstellen

Dein nächster Jobsucht schon nach dir.

Nort

Reverse-Recruiting- Plattform für Entwickler

RechtlichesNutzungsbedingungenDatenschutznortjobs © 2026