Vous avez déployé et opéré des agents basés sur des modèles de langage en production, avec une expérience directe de leurs défaillances et de leur adoption réelle en entreprise. Cette mission consiste à partager votre expertise sur la fiabilité, l'évaluation et la mise à l'échelle des agents IA dans des environnements complexes, via des entretiens conversationnels portant sur vos retours d'expérience concrets.
AI Safety Experts - English & Norwegian
Mercor · Data & Machine Learning
Vous rejoignez une équipe dédiée au test d'adversité des modèles d'IA conversationnels, en identifiant leurs vulnérabilités face à des entrées malveillantes, des manipulations et des biais. Cette mission consiste à générer des données d'entraînement de haute qualité pour renforcer la robustesse et la sécurité des systèmes d'IA. Vous êtes idéalement un expert en red teaming avec une expérience préalable en tests de sécurité adversariaux et une maîtrise fluide de l'anglais et du norvégien.
Travail à réaliser
- Tester les modèles d'IA par des techniques de jailbreak, injections de prompts et cas d'exploitation de biais pour identifier les failles de sécurité.
- Annoter les défaillances détectées, classifier les vulnérabilités selon des taxonomies établies et signaler les risques systémiques.
- Produire des rapports, ensembles de données et cas d'attaque documentés et reproductibles destinés aux clients.
- Appliquer des cadres de travail et benchmarks structurés pour assurer la cohérence des tests et la qualité des artefacts livrés.
Compétences requises
Rémunération et engagement
48–62 USD /heure
Rémunération telle qu'affichée par la plateforme, sans garantie de revenu ou d'heures.
Pays et langue
Expérience non précisée
Ouvert aux pays suivants : États-Unis.
Langue requise : NB.
Processus de candidature
Candidature via work.mercor.com : création de profil, évaluation de compétences, puis mise en relation avec des projets correspondant à votre profil.
Source et vérification
Source officielle : https://work.mercor.com/jobs/list_AAABn7GObBBGIgY5X6xOHKof/ai-safety-experts-english-norwegian
Dernière vérification : 6 octobre 2026.
Missions similaires
Vous rejoignez une équipe de red teaming pour tester la robustesse et la sécurité de modèles d'IA conversationnels. Votre mission consiste à générer des entrées adversariales (jailbreaks, injections de prompts, cas de détournement) pour découvrir les vulnérabilités des systèmes d'IA avant leur déploiement. Vous annotez les défaillances, classez les risques et produisez des datasets documentés que les clients peuvent exploiter pour améliorer leurs modèles.
Cette mission consiste à tester des modèles d'IA conversationnels en tant qu'expert en sécurité de l'IA, en générant des données d'entraînement adversariales pour identifier les vulnérabilités. Vous produirez des rapports et des datasets structurés qui permettront aux clients d'améliorer la robustesse et la sécurité de leurs systèmes d'IA. Le profil recherché maîtrise l'analyse critique de contenu, la rigueur méthodologique et la communication technique.