Chercheur en sécurité & alignement IA

Mission principale

Veille à ce que les systèmes avancés restent fiables, honnêtes et alignés sur les valeurs humaines.

5 responsabilités clés

  • Étudier les comportements à risque des modèles avancés (déception, manipulation).
  • Développer des méthodes d'interprétabilité pour comprendre les modèles de l'intérieur.
  • Concevoir des protocoles de red teaming et de tests adverses.
  • Construire des méthodes de supervision scalable et de reward modeling.
  • Contribuer aux standards de sécurité de l'industrie et de la recherche.

Compétences clés

Interprétabilité mécanistique, red teaming, supervision scalable, reward modeling.

Ce qui est attendu

Anticiper les risques avant qu'ils ne se matérialisent. L'expertise en safety a connu une prime de rémunération en forte hausse.

Évolutions possibles

Research Lead alignement, gouvernance IA de haut niveau, policy et régulation.

Offres en ce moment

Aucune offre pour ce métier en ce moment.

Soyez alerté dès qu’un poste de Chercheur en sécurité & alignement IA est publié.

Créer une alerte emploi →