Anthropic

Engenheiro(a) / Cientista de Pesquisa, Alinhamento

PythonKubernetes
Tradução automática. Consulte o original.

SOBRE A ANTHROPIC

A missão da Anthropic é criar sistemas de IA confiáveis, interpretáveis e direcionáveis. Queremos que a IA seja segura e benéfica para nossos usuários e para a sociedade como um todo. Nossa equipe é um grupo em rápido crescimento de pesquisadores, engenheiros, especialistas em políticas e líderes empresariais comprometidos, trabalhando juntos para construir sistemas de IA benéficos.

SOBRE A VAGA

Você quer construir e executar experimentos elegantes e completos de machine learning para nos ajudar a entender e direcionar o comportamento de sistemas de IA poderosos. Você se preocupa em tornar a IA útil, honesta e inofensiva, e está interessado nas maneiras pelas quais isso pode ser desafiador no contexto de capacidades em nível humano. Você poderia se descrever como um cientista e um engenheiro. Como Engenheiro(a) de Pesquisa em Ciência de Alinhamento, você contribuirá para pesquisas experimentais exploratórias em segurança de IA, com foco em riscos de futuros sistemas poderosos (como aqueles que designaríamos como ASL-3 ou ASL-4 sob nossa Política de Escala Responsável anthropic.com/news/anthropics-responsible-scaling-policy), muitas vezes em colaboração com outras equipes, incluindo Interpretabilidade, Ajuste Fino e a Equipe Vermelha de Fronteira.

Nosso blog alignment.anthropic.com/ fornece uma visão geral dos tópicos que a equipe de Ciência de Alinhamento está explorando atualmente ou explorou anteriormente. Nossos tópicos atuais de foco incluem...

PROJETOS REPRESENTATIVOS

  1. Supervisão Escalável: Desenvolvendo técnicas para manter modelos altamente capazes úteis e honestos, mesmo quando superam a inteligência humana em vários domínios.
  1. Controle de IA: Criando métodos para garantir que sistemas avançados de IA permaneçam seguros e inofensivos em cenários desconhecidos ou adversários.
  1. Testes de Estresse de Alinhamento lesswrong.com/posts/EPDSdXr8YbsDkgsDG/introducing-alignment-stress-testing-at-anthropic: Criando organismos modelo de desalinhamento lesswrong.com/posts/ChDH335ckdvpxXaXX/model-organisms-of-misalignment-the-case-for-a-new-pillar-of-1 para melhorar nossa compreensão empírica de como as falhas de alinhamento podem surgir.
  1. Pesquisa de Alinhamento Automatizado: Construindo e alinhando um sistema que possa acelerar e melhorar a pesquisa de alinhamento.
  1. Avaliações de Alinhamento: Compreendendo e documentando as propriedades emergentes de modelos de maior risco e mais preocupantes por meio de avaliações de alinhamento e bem-estar pré-implantação (veja nosso Cartão do Sistema Claude 4 www-cdn.anthropic.com/6be99a52cb68eb70eb9572b4cafad13df32ed995.pdf), casos de segurança de risco de desalinhamento e coordenação com avaliadores terceirizados.
  1. Pesquisa de Salvaguardas job-boards.greenhouse.io/anthropic/jobs/4459012008: Desenvolvendo defesas robustas contra ataques adversários, frameworks de avaliação abrangentes para segurança de modelos e sistemas automatizados para detectar e mitigar riscos potenciais antes da implantação.
  1. Bem-estar do Modelo: Investigando e abordando questões potenciais de bem-estar do modelo, status moral e relacionadas. Veja nosso anúncio de programa anthropic.com/research/exploring-model-welfare e a avaliação de bem-estar no cartão do sistema Claude 4 www-cdn.anthropic.com/07b2a3f9902ee19fe39a36ca638e5ae987bc64dd.pdf para mais informações.
  1. Testar a robustez de nossas técnicas de segurança treinando modelos de linguagem para subverter nossas técnicas de segurança e ver quão eficazes elas são em subverter nossas intervenções.
  1. Executar experimentos de aprendizado por reforço multiagente para testar técnicas como Debate de IA arxiv.org/abs/1805.00899.
  1. Construir ferramentas para avaliar eficientemente a eficácia de novos jailbreaks gerados por LLM.
  1. Escrever scripts e prompts para produzir eficientemente perguntas de avaliação para testar as habilidades de raciocínio dos modelos em contextos relevantes para a segurança.
  1. Contribuir com ideias, figuras e textos para artigos de pesquisa, posts de blog e apresentações.
  1. Executar experimentos que alimentam esforços chave de segurança de IA na Anthropic, como o design e implementação de nossa Política de Escala Responsável anthropic.com/news/anthropics-responsible-scaling-policy.

CANDIDATOS NÃO PRECISAM TER

Observação: Para esta função, realizamos todas as entrevistas em Python e preferimos que os candidatos estejam baseados na Bay Area.

  1. 100% das habilidades necessárias para realizar o trabalho
  1. Certificações formais ou credenciais educacionais

A faixa de remuneração anual para esta função está listada abaixo. Para funções de vendas, a faixa fornecida é a faixa de Ganhos Alvo ("OTE") da função, o que significa que a faixa inclui tanto as comissões de vendas/bônus de vendas alvo quanto o salário base anual para a função.

Salário Anual: $350,000—$500,000 USD

Política híbrida baseada em localização: Atualmente, esperamos que todos os funcionários estejam em um de nossos escritórios pelo menos 25% do tempo. No entanto, algumas funções podem exigir mais tempo em nossos escritórios.

Patrocínio de visto: Nós patrocinamos vistos! No entanto, não conseguimos patrocinar vistos com sucesso para todas as funções e todos os candidatos. Mas se fizermos uma oferta, faremos todos os esforços razoáveis para conseguir um visto para você, e contamos com um advogado de imigração para ajudar com isso.

Encorajamos você a se candidatar mesmo que não acredite que atende a todas as qualificações. Nem todos os candidatos fortes atenderão a todas as qualificações listadas. Pesquisas mostram que pessoas que se identificam como pertencentes a grupos sub-representados são mais propensas a experimentar a síndrome do impostor e duvidar da força de sua candidatura, então pedimos que você não se exclua prematuramente e envie uma candidatura se estiver interessado(a) neste trabalho. Acreditamos que sistemas de IA como os que estamos construindo têm enormes implicações sociais e éticas. Acreditamos que isso torna a representação ainda mais importante, e nos esforçamos para incluir uma variedade de perspectivas diversas em nossa equipe.

Sua segurança é importante para nós. Para se proteger de possíveis golpes, lembre-se de que os recrutadores da Anthropic entram em contato apenas de endereços de e-mail @anthropic.com. Em alguns casos, podemos fazer parceria com agências de recrutamento verificadas que se identificarão como trabalhando em nome da Anthropic. Tenha cuidado com e-mails de outros domínios. Recrutadores legítimos da Anthropic nunca pedirão dinheiro, taxas ou informações bancárias antes do seu primeiro dia. Se você tiver alguma dúvida sobre uma comunicação, não clique em nenhum link - visite anthropic.com/careers anthropic.com/careers diretamente para ver as vagas confirmadas.

Orientação sobre o Uso de IA por Candidatos: Saiba mais sobre nossa política anthropic.com/candidate-ai-guidance para usar IA em nosso processo de candidatura.

VOCÊ PODE SER UMA BOA OPÇÃO SE VOCÊ

  1. Tiver experiência significativa em engenharia de software, ML ou pesquisa
  1. Tiver alguma experiência contribuindo para projetos de pesquisa empírica em IA
  1. Tiver alguma familiaridade com pesquisa técnica em segurança de IA
  1. Preferir projetos colaborativos de ritmo acelerado a esforços solo extensos
  1. Cobrir o que for necessário, mesmo que vá além da sua descrição de cargo
  1. Se importar com os impactos da IA

LOGÍSTICA

Educação mínima: Bacharelado ou uma combinação equivalente de educação, treinamento e/ou experiência

Área de estudo exigida: Uma área relevante para a função, conforme demonstrado por cursos, treinamento ou experiência profissional

Anos mínimos de experiência: Os anos de experiência exigidos correlacionarão com os requisitos de nível de cargo interno para a posição

CANDIDATOS FORTES PODEM TAMBÉM

  1. Ter experiência em autoria de artigos de pesquisa em machine learning, NLP ou segurança de IA
  1. Ter experiência com LLMs
  1. Ter experiência com aprendizado por reforço
  1. Ter experiência com clusters Kubernetes e bases de código compartilhadas complexas

COMO SOMOS DIFERENTES

Acreditamos que a pesquisa de IA de maior impacto será "big science". Na Anthropic, trabalhamos como uma única equipe coesa em apenas alguns esforços de pesquisa em larga escala. E valorizamos o impacto — avançar em nossos objetivos de longo prazo de IA direcionável e confiável — em vez de trabalhar em quebra-cabeças menores e mais específicos. Vemos a pesquisa de IA como uma ciência empírica, que tem tanto em comum com a física e a biologia quanto com os esforços tradicionais em ciência da computação. Somos um grupo extremamente colaborativo e realizamos discussões de pesquisa frequentes para garantir que estamos buscando o trabalho de maior impacto em qualquer momento. Como tal, valorizamos muito as habilidades de comunicação.

A maneira mais fácil de entender nossas direções de pesquisa é ler nossa pesquisa recente. Esta pesquisa continua muitas das direções em que nossa equipe trabalhou antes da Anthropic, incluindo: GPT-3, Interpretabilidade Baseada em Circuitos, Neurônios Multimodais, Leis de Escala, IA e Computação, Problemas Concretos em Segurança de IA e Aprendizado com Preferências Humanas.

VENHA TRABALHAR CONOSCO!

A Anthropic é uma corporação de benefício público com sede em São Francisco. Oferecemos remuneração e benefícios competitivos, doação opcional de ações, licença parental e de férias generosa, horários de trabalho flexíveis e um espaço de escritório agradável para colaborar com colegas.

Mais oportunidades com um só perfil

Quer aparecer para várias vagas sem repetir todo o processo? Crie seu perfil e seja encontrado pelas empresas que usam a Nort.

Criar meu perfil

Seu próximo empregojá está te procurando.

Nort

Plataforma de recrutamento reverso para programadores