En vedette
Chercheur en sûreté de l’IA
£168,000–£252,000/an (£14,000–£21,000/mois) — Négociable
Description du poste
Vous évaluez les systèmes IA face aux risques d’usage abusif, d’alignement, de robustesse et de défaillances pertinentes pour le produit. Les livrables sont des constats actionnables pour ingénierie et produit.
Exigences
- Expérience de recherche ou d’application en AI safety, alignement, évaluation des risques ou ML connexe
- Familiarité avec red teaming, revue RLHF, constitutional AI ou documentation de risques modèles
- Capacité à rédiger des constats étayés pour publics techniques et non techniques
- Bon jugement sur incertitude, gravité et compromis de mitigation
- Familiarité avec red teaming, revue RLHF, constitutional AI ou documentation de risques modèles
- Capacité à rédiger des constats étayés pour publics techniques et non techniques
- Bon jugement sur incertitude, gravité et compromis de mitigation
Responsabilités
- Concevoir et mener des évaluations de sûreté pour modèles et workflows IA
- Documenter constats, mitigations et risques résiduels avant lancement
- Travailler avec red team IA, policy, ingénierie et produit
- Améliorer les harnais de test et processus de revue de sûreté
- Documenter constats, mitigations et risques résiduels avant lancement
- Travailler avec red team IA, policy, ingénierie et produit
- Améliorer les harnais de test et processus de revue de sûreté
Avantages
- Influence directe sur les décisions de risque IA en production
- Travail avec équipes techniques, policy et relation client
- Construction de méthodes d’évaluation pratiques, pas seulement théoriques
- Travail avec équipes techniques, policy et relation client
- Construction de méthodes d’évaluation pratiques, pas seulement théoriques