Mission ouverteVérifié récemment

AI Safety Experts - English & Thai

Mercor · Data & Machine Learning

Vous rejoindrez une équipe de red teaming pour tester la robustesse et la sécurité de modèles d'IA conversationnels en simulant des attaques adversariales. La mission consiste à générer des données d'entraînement de haute qualité en identifiant des vulnérabilités, des biais et des cas d'abus via des techniques structurées et documentées. Ce rôle s'adresse à des experts capables de penser comme un attaquant pour renforcer la défense des systèmes d'IA.

Travail à réaliser

  • Conduire des tests adversariaux sur des modèles d'IA conversationnels en explorant les jailbreaks, injections de prompts et cas de détournement.
  • Générer et annoter des données de vulnérabilités, classifier les risques systémiques et signaler les défaillances détectées.
  • Documenter les résultats de manière reproductible sous forme de rapports, datasets et cas d'attaque actionnables pour les clients.
  • Appliquer des taxonomies et benchmarks pour structurer les tests et assurer la cohérence entre les différents projets.

Compétences requises

Red teamingAI adversarial testingPrompt injectionJailbreak techniquesRisk assessmentData annotationTechnical writingVulnerability analysis

Rémunération et engagement

24–35 USD /heure

Rémunération telle qu'affichée par la plateforme, sans garantie de revenu ou d'heures.

Pays et langue

Expérience non précisée

Ouvert aux pays suivants : États-Unis.

Langue requise : TH.

Processus de candidature

Candidature via work.mercor.com : création de profil, évaluation de compétences, puis mise en relation avec des projets correspondant à votre profil.

Source et vérification

Source officielle : https://work.mercor.com/jobs/list_AAABn7GLjhJVpIggt7BKFIF9/ai-safety-experts-english-thai

Dernière vérification : 6 octobre 2026.

Missions similaires

Vous avez déployé et opéré des agents basés sur des modèles de langage en production, avec une expérience directe de leurs défaillances et de leur adoption réelle en entreprise. Cette mission consiste à partager votre expertise sur la fiabilité, l'évaluation et la mise à l'échelle des agents IA dans des environnements complexes, via des entretiens conversationnels portant sur vos retours d'expérience concrets.

Mercor·États-Unis
Mission ouverteVérifié récemment100–500 USD /heure

Vous rejoignez une équipe de red teaming pour tester la robustesse et la sécurité de modèles d'IA conversationnels. Votre mission consiste à générer des entrées adversariales (jailbreaks, injections de prompts, cas de détournement) pour découvrir les vulnérabilités des systèmes d'IA avant leur déploiement. Vous annotez les défaillances, classez les risques et produisez des datasets documentés que les clients peuvent exploiter pour améliorer leurs modèles.

Mercor·États-Unis
Mission ouverteVérifié récemment16–22 USD /heure

Cette mission consiste à tester des modèles d'IA conversationnels en tant qu'expert en sécurité de l'IA, en générant des données d'entraînement adversariales pour identifier les vulnérabilités. Vous produirez des rapports et des datasets structurés qui permettront aux clients d'améliorer la robustesse et la sécurité de leurs systèmes d'IA. Le profil recherché maîtrise l'analyse critique de contenu, la rigueur méthodologique et la communication technique.

Mercor·États-Unis
Mission ouverteVérifié récemment16–22 USD /heure

Explorer

Missions par pays · Toutes les missions