Chercheur en sécurité & alignement IA
Mission principale
Veille à ce que les systèmes avancés restent fiables, honnêtes et alignés sur les valeurs humaines.
5 responsabilités clés
- Étudier les comportements à risque des modèles avancés (déception, manipulation).
- Développer des méthodes d'interprétabilité pour comprendre les modèles de l'intérieur.
- Concevoir des protocoles de red teaming et de tests adverses.
- Construire des méthodes de supervision scalable et de reward modeling.
- Contribuer aux standards de sécurité de l'industrie et de la recherche.
Compétences clés
Interprétabilité mécanistique, red teaming, supervision scalable, reward modeling.
Ce qui est attendu
Anticiper les risques avant qu'ils ne se matérialisent. L'expertise en safety a connu une prime de rémunération en forte hausse.
Évolutions possibles
Research Lead alignement, gouvernance IA de haut niveau, policy et régulation.
Offres en ce moment
Aucune offre pour ce métier en ce moment.
Soyez alerté dès qu’un poste de Chercheur en sécurité & alignement IA est publié.
Créer une alerte emploi →