Anthropic

Anthropic Fellows Program, AI Safety & Security

PythonGo
Automatische Übersetzung. Prüfe das Original.

ÜBER ANTHROPIC

Die Mission von Anthropic ist es, zuverlässige, interpretierbare und steuerbare KI-Systeme zu entwickeln. Wir möchten, dass KI sicher und vorteilhaft für unsere Nutzer und die Gesellschaft als Ganzes ist. Unser Team ist eine schnell wachsende Gruppe engagierter Forscher, Ingenieure, Politikexperten und Wirtschaftsführer, die zusammenarbeiten, um vorteilhafte KI-Systeme zu entwickeln.

ÜBERBLICK ÜBER DAS Anthropic FELLOWS PROGRAM

Das Anthropic Fellows Program wurde entwickelt, um Talente in der KI-Forschung und -Entwicklung zu fördern. Wir stellen vielversprechenden technischen Talenten – unabhängig von Vorerfahrung – Finanzmittel und Mentoring zur Verfügung.

Fellows werden hauptsächlich externe Infrastrukturen (z. B. Open-Source-Modelle, öffentliche APIs) nutzen, um an einem empirischen Projekt zu arbeiten, das mit unseren Forschungsprioritäten übereinstimmt, mit dem Ziel, ein öffentliches Ergebnis zu erzielen (z. B. eine Paper-Einreichung). In einem unserer früheren Jahrgänge haben über 80% der Fellows Paper veröffentlicht. Wir führen jedes Jahr mehrere Jahrgänge von Fellows durch und prüfen Bewerbungen fortlaufend.

KI-SICHERHEITS-FELLOWS

MENTOREN, FORSCHUNGSBEREICHE & VERGANGENE PROJEKTE

Fellows durchlaufen einen Prozess zur Projektauswahl und zum Mentoren-Matching. Mögliche Mentoren sind:

  1. Sam Bowman
  1. Sara Price
  1. Alex Tamkin
  1. Nina Panickssery
  1. Trenton Bricken
  1. Logan Graham
  1. Jascha Sohl-Dickstein
  1. Joe Benton
  1. Collin Burns
  1. Fabien Roger
  1. Samuel Marks
  1. Kyle Fish
  1. Ethan Perez

Unsere Mentoren leiten Projekte in ausgewählten KI-Sicherheitsforschungsbereichen, wie zum Beispiel:

  1. Skalierbare Aufsicht: Entwicklung von Techniken, um hochleistungsfähige Modelle hilfreich und ehrlich zu halten, auch wenn sie die menschliche Intelligenz in verschiedenen Bereichen übertreffen.
  1. Adversarial Robustness und KI-Kontrolle: Schaffung von Methoden, um sicherzustellen, dass fortschrittliche KI-Systeme in unbekannten oder adversen Szenarien sicher und harmlos bleiben.
  1. Modellorganismen: Erstellung von Modellorganismen für Fehlausrichtungen, um unser empirisches Verständnis dafür zu verbessern, wie Fehlausrichtungsfehler entstehen könnten.
  1. Modellinterne / Mechanistische Interpretierbarkeit: Verbesserung unseres Verständnisses der internen Funktionsweise großer Sprachmodelle, um gezieltere Interventionen und Sicherheitsmaßnahmen zu ermöglichen.
  1. KI-Wohlfahrt: Verbesserung unseres Verständnisses potenzieller KI-Wohlfahrt und Entwicklung entsprechender Bewertungen und Abhilfemaßnahmen.

Auf unseren Blogs Alignment Science alignment.anthropic.com/ und Frontier Red Team red.anthropic.com/ können Sie über vergangene Projekte lesen, darunter:

  1. Subliminal Learning: Language Models Transmit Behavioral Traits via Hidden Signals in Data: alignment.anthropic.com/2025/subliminal-learning/ Alex Cloud und Minh Le, u. a., Mentoren einschließlich Samuel Marks und Owain Evans
  1. Open-Source-Schaltkreise: anthropic.com/research/open-source-circuit-tracing Michael Hanna und Mateusz Piotrowski mit Mentoring von Emmanuel Ameisen und Jack Lindsey

Eine vollständige Liste repräsentativer Projekte für jeden Bereich finden Sie in diesen Blogbeiträgen: Introducing the Anthropic Fellows Program for AI Safety Research [alignment.anthropic.com/2024/anthropic-fellows-program/#:~:text=We're%20launching%20the%20Anthropic,time%20on%20AI%20safety%20research]. Recommendations for Technical AI Safety Research Directions alignment.anthropic.com/2025/recommended-directions/.

KI-SICHERHEITS-FELLOWS

MENTOREN, FORSCHUNGSBEREICHE & VERGANGENE PROJEKTE

Fellows durchlaufen einen Prozess zur Projektauswahl und zum Mentoren-Matching. Mögliche Mentoren sind:

  1. Nicholas Carlini
  1. Keri Warr
  1. Evyatar Ben Asher
  1. Keane Lucas
  1. Newton Cheng

Auf unseren Blogs Alignment Science alignment.anthropic.com/ und Frontier Red Team red.anthropic.com/ können Sie einige vergangene Fellows-Projekte lesen, darunter:

  1. KI-Agenten finden $4.6M an Exploits in Blockchain Smart Contracts: red.anthropic.com/2025/smart-contracts/ Winnie Xiao und Cole Killian, betreut von Nicholas Carlini und Alwin Peng
  1. Stärkung von Red Teams: Ein modulares Gerüst für Kontrollbewertungen: alignment.anthropic.com/2025/strengthening-red-teams/ Chloe Loughridge et al., betreut von Jon Kutasov und Joe Benton

WAS UNS UNTERSCHEIDET

Wir glauben, dass die wirkungsvollste KI-Forschung "Big Science" sein wird. Bei Anthropic arbeiten wir als ein einziges, zusammenhängendes Team an nur wenigen groß angelegten Forschungsbemühungen. Und wir schätzen Wirkung – die Förderung unserer langfristigen Ziele einer steuerbaren, vertrauenswürdigen KI – anstatt an kleineren und spezifischeren Rätseln zu arbeiten. Wir betrachten KI-Forschung als eine empirische Wissenschaft, die ebenso viel mit Physik und Biologie gemeinsam hat wie mit traditionellen Anstrengungen in der Informatik. Wir sind eine äußerst kollaborative Gruppe und veranstalten häufig Forschungsdiskussionen, um sicherzustellen, dass wir zu jedem Zeitpunkt die wirkungsvollste Arbeit verfolgen. Daher schätzen wir Kommunikationsfähigkeiten sehr.

Der einfachste Weg, unsere Forschungsrichtungen zu verstehen, ist, unsere aktuelle Forschung zu lesen. Diese Forschung setzt viele der Richtungen fort, an denen unser Team vor Anthropic gearbeitet hat, darunter: GPT-3, Circuit-Based Interpretability, Multimodal Neurons, Scaling Laws, AI & Compute, Concrete Problems in AI Safety und Learning from Human Preferences.

KOMMEN SIE ZU UNS!

Anthropic ist eine Public Benefit Corporation mit Hauptsitz in San Francisco. Wir bieten wettbewerbsfähige Vergütung und Leistungen, optionale Aktienoptionsspenden, großzügigen Urlaub und Elternzeit, flexible Arbeitszeiten und einen schönen Büroraum für die Zusammenarbeit mit Kollegen. Leitfaden zur KI-Nutzung durch Bewerber: Informieren Sie sich über unsere Richtlinie anthropic.com/candidate-ai-guidance zur Nutzung von KI in unserem Bewerbungsprozess.

INTERVIEWPROZESS

Bewerbungen für unseren Januar-Jahrgang sind jetzt geöffnet – bewerben Sie sich hier bis zum 18. Oktober. bit.ly/afpsafety

Der Interviewprozess umfasst eine erste Bewerbung & Referenzprüfung, technische Bewertungen & Interviews sowie eine Forschungsdiskussion.

Wir ermutigen Sie, sich auch dann zu bewerben, wenn Sie glauben, nicht jede einzelne Qualifikation zu erfüllen. Nicht alle starken Kandidaten erfüllen jede einzelne aufgeführte Qualifikation. Forschung zeigt, dass Personen, die sich als Angehörige unterrepräsentierter Gruppen identifizieren, anfälliger für das Impostor-Syndrom sind und an ihrer Kandidatur zweifeln. Daher bitten wir Sie dringend, sich nicht vorzeitig auszuschließen und eine Bewerbung einzureichen, wenn Sie an dieser Arbeit interessiert sind. Wir glauben, dass KI-Systeme wie die, die wir entwickeln, enorme soziale und ethische Auswirkungen haben. Wir denken, dass dies die Repräsentation noch wichtiger macht, und wir bemühen uns, eine Vielfalt von Perspektiven in unserem Team zu vereinen.

VERGÜTUNG

Das erwartete Basisstipendium für diese Rolle beträgt 3,850 USD / 2,310 GBP / 4,300 CAD pro Woche, mit einer Erwartung von 40 Stunden pro Woche für 4 Monate (mit möglicher Verlängerung).

LOGISTIK

Logistikanforderungen: Um am Fellows-Programm teilnehmen zu können, müssen Sie eine Arbeitserlaubnis in den USA, Großbritannien oder Kanada besitzen und sich während des Programms in diesem Land aufhalten.

Arbeitsplatzstandorte: Wir haben ausgewiesene gemeinsame Arbeitsplätze in London und Berkeley, von denen aus die Fellows arbeiten und Mentoren zu Besuch kommen. Wir sind auch offen für Remote-Fellows in Großbritannien, den USA oder Kanada. Wir werden Sie während des Programms nach Ihrer Verfügbarkeit fragen, von Berkeley oder London aus (Voll- oder Teilzeit) zu arbeiten.

Visumsponsorship: Wir können derzeit keine Visa für Fellows sponsern. Um am Fellows-Programm teilnehmen zu können, müssen Sie eine Vollzeit-Arbeitserlaubnis in Großbritannien, den USA oder Kanada besitzen oder diese unabhängig erwerben.

Programmdauer: Das Programm läuft 4 Monate Vollzeit. Wenn Sie nicht die volle Dauer einhalten können, bewerben Sie sich trotzdem und geben Sie Ihre Einschränkungen in der Bewerbung an. Wir prüfen diese Anfragen von Fall zu Fall.

Bitte beachten Sie: Wir garantieren nicht, dass wir Fellows Vollzeitangebote machen werden. Eine starke Leistung während des Programms kann jedoch darauf hindeuten, dass ein Fellow gut für Vollzeitstellen bei Anthropic geeignet wäre. In früheren Jahrgängen erhielten 25-50% der Fellows ein Vollzeitangebot, und wir haben viele weitere dabei unterstützt, großartige Arbeit im Bereich KI-Sicherheit und -Schutz bei anderen Organisationen zu leisten.

Bewerbungen und Interviews werden von Constellation constellation.org/ verwaltet, unserem Partner für Rekrutierung und Programmmanagement. Constellation betreibt auch den Arbeitsplatz in Berkeley und bietet Programmunterstützung für Fellows, die an KI-Sicherheits- und Schutzprojekten arbeiten; Fellows an fähigkeitsorientierten Projekten werden direkt von Anthropic unterstützt. Alle Bewerber nutzen derzeit dasselbe Bewerbungsportal, aber wir arbeiten daran, die Bewerbungen für sicherheits- und schutzorientierte sowie fähigkeitsorientierte Projekte in zukünftigen Runden zu trennen.

BEWERBEN SIE SICH HIER BIS ZUM 18. OKTOBER. bit.ly/afpsafety

Das Folgende sind die Richtlinien von Anthropic für Vollzeitstellen. Diese gelten NICHT für das Fellows-Programm.

Standortbasierte Hybridrichtlinie: Derzeit erwarten wir, dass alle Mitarbeiter mindestens 25% der Zeit in einem unserer Büros anwesend sind. Einige Rollen erfordern jedoch möglicherweise mehr Zeit in unseren Büros.

Visumsponsorship: Wir sponsern Visa! Wir können jedoch nicht für jede Rolle und jeden Kandidaten erfolgreich Visa sponsern. Aber wenn wir Ihnen ein Angebot machen, werden wir alle zumutbaren Anstrengungen unternehmen, um Ihnen ein Visum zu besorgen, und wir beauftragen einen Einwanderungsanwalt, um dabei zu helfen.

Wir ermutigen Sie, sich auch dann zu bewerben, wenn Sie glauben, nicht jede einzelne Qualifikation zu erfüllen. Nicht alle starken Kandidaten erfüllen jede einzelne aufgeführte Qualifikation. Forschung zeigt, dass Personen, die sich als Angehörige unterrepräsentierter Gruppen identifizieren, anfälliger für das Impostor-Syndrom sind und an ihrer Kandidatur zweifeln. Daher bitten wir Sie dringend, sich nicht vorzeitig auszuschließen und eine Bewerbung einzureichen, wenn Sie an dieser Arbeit interessiert sind. Wir glauben, dass KI-Systeme wie die, die wir entwickeln, enorme soziale und ethische Auswirkungen haben. Wir denken, dass dies die Repräsentation noch wichtiger macht, und wir bemühen uns, eine Vielfalt von Perspektiven in unserem Team zu vereinen.

Ihre Sicherheit ist uns wichtig. Um sich vor möglichen Betrügereien zu schützen, denken Sie daran, dass Anthropic-Recruiter Sie nur von E-Mail-Adressen @anthropic.com kontaktieren. In einigen Fällen arbeiten wir möglicherweise mit geprüften Personalvermittlungsagenturen zusammen, die sich als im Auftrag von Anthropic arbeitend ausgeben. Seien Sie vorsichtig bei E-Mails von anderen Domains. Legitimen Anthropic-Recruitern werden niemals Geld, Gebühren oder Bankinformationen vor Ihrem ersten Tag verlangt. Wenn Sie jemals unsicher über eine Kommunikation sind, klicken Sie nicht auf Links – besuchen Sie anthropic.com/careers anthropic.com/careers direkt, um bestätigte Stellenangebote zu finden.

WAS SIE ERWARTET

  • 4 Monate Vollzeitforschung
  • Direkte Betreuung durch Anthropic-Forscher
  • Zugang zu einem gemeinsamen Arbeitsplatz (entweder in Berkeley, Kalifornien oder London, UK)
  • Vernetzung mit der breiteren KI-Sicherheits- und -Schutzforschungsgemeinschaft
  • Wöchentliches Stipendium von 3,850 USD / 2,310 GBP / 4,300 CAD + Leistungen (diese variieren je nach Land)
  • Finanzierung für Rechenleistung (ca. $15k/Monat) und weitere Forschungsausgaben

ÜBER DIE ARBEITSSTRÖME HINWEG KÖNNTEN SIE GUT PASSEN, WENN SIE

  1. Motiviert sind, sicherzustellen, dass KI sicher und vorteilhaft für die Gesellschaft als Ganzes ist
  1. Begeistert sind, in die empirische KI-Forschung einzusteigen und an einer Vollzeitstelle bei Anthropic interessiert wären
  1. Einen starken technischen Hintergrund in Informatik, Mathematik oder Physik haben
  1. In schnelllebigen, kollaborativen Umgebungen erfolgreich sind
  1. Ideen schnell umsetzen und klar kommunizieren können

KANDIDATEN MÜSSEN SEIN

  1. Fließend in Python-Programmierung
  1. Verfügbar, um Vollzeit am Fellows-Programm teilzunehmen

LOGISTIK

Mindestbildung: Bachelor-Abschluss oder eine gleichwertige Kombination aus Bildung, Ausbildung und/oder Erfahrung

Erforderlicher Studienbereich: Ein Bereich, der für die Rolle relevant ist, nachgewiesen durch Kursarbeit, Ausbildung oder Berufserfahrung

Mindestjahre an Erfahrung: Die erforderliche Berufserfahrung korreliert mit den internen Anforderungsstufen für die Position

STARKE KANDIDATEN KÖNNTEN AUCH HABEN

  1. Starken Hintergrund in einer Disziplin, die für einen bestimmten Fellows-Arbeitsstrom relevant ist (z. B. Wirtschaftswissenschaften, Sozialwissenschaften oder Cybersicherheit)
  1. Erfahrung in Forschungs- oder Ingenieurbereichen, die sich auf ihren Arbeitsstrom beziehen

EINZIGARTIGE KANDIDATENKRITERIEN

Sie könnten besonders gut für diesen Arbeitsstrom geeignet sein, wenn Sie:

  1. Motiviert sind, katastrophale Risiken durch fortgeschrittene KI-Systeme zu reduzieren
  1. Erfahrung mit empirischen ML-Forschungsprojekten haben
  1. Erfahrung mit großen Sprachmodellen haben
  1. Erfahrung in einem der oben genannten Forschungsbereiche haben
  1. Eine Erfolgsbilanz bei Open-Source-Beiträgen haben

Sie könnten besonders gut für diesen Arbeitsstrom geeignet sein, wenn Sie:

  1. Motiviert sind, katastrophale Risiken durch fortgeschrittene KI-Systeme zu reduzieren
  1. Zu Open-Source-Projekten in LLM- oder sicherheitsnahen Repositories beigetragen haben
  1. Nachgewiesene Erfolge bei der Schaffung von Klarheit und Eigenverantwortung bei unklaren technischen Problemen erzielt haben
  1. Erfahrung mit Pentesting, Schwachstellenforschung oder anderer offensiver Sicherheitsarbeit haben
  1. Eine nachgewiesene Bereitschaft haben, die "schmutzige Arbeit" zu leisten, die qualitativ hochwertige Ergebnisse liefert
  1. CVEs gemeldet oder Bug-Bounties erhalten haben
  1. Erfahrung mit empirischen ML-Forschungsprojekten haben
  1. Erfahrung mit deep learning-Frameworks und Experimentenmanagement haben

Mehr Möglichkeiten mit einem Profil

Für mehr Stellen berücksichtigt werden, ohne den ganzen Prozess zu wiederholen? Erstellen Sie Ihr Profil, damit Unternehmen auf Nort Sie finden.

Profil erstellen

Dein nächster Jobsucht schon nach dir.

Nort

Reverse-Recruiting- Plattform für Entwickler

RechtlichesNutzungsbedingungenDatenschutznortjobs © 2026