Overview

Hindi Trust & Safety Data Trainer | $15/hr Remote Jobs in India at Crossing Hurdles

Title: Hindi Trust & Safety Data Trainer | $15/hr Remote

Company: Crossing Hurdles

Location: India

Hindi Trust & Safety Data Trainer Work Snapshot

  • Job Type: Contract
  • Location: Remote
  • Compensation: Up to $15 per hour
  • Commitment: Flexible / project-based (hourly)

Roles & Responsibilities

  • Review and evaluate AI-generated safety-related content and moderation decisions for accuracy, policy compliance, reasoning quality, and contextual safety
  • Label and quality-check Trust & Safety datasets across categories such as hate speech, harassment, self-harm, violence, misinformation, malicious activity, and harmful content
  • Perform red-teaming and adversarial testing to identify unsafe outputs, policy loopholes, attack patterns, and edge-case vulnerabilities in AI systems
  • Compare and rank AI-generated responses based on safety alignment, clarity, severity assessment, and adherence to moderation guidelines
  • Analyze nuanced Hindi and English content, including slang, coded language, cultural references, and context-sensitive harmful behavior patterns
  • Document safety risks, escalation patterns, policy gaps, and mitigation recommendations using structured rationales and consistent evaluation standards
  • Apply and localize Trust & Safety policies across Hindi and English content while maintaining linguistic accuracy and cultural relevance
  • Support AI model improvement through annotation workflows, quality assurance reviews, policy enforcement, and detailed documentation practices

Requirements

  • Education: Bachelor s degree or higher in Communications, Linguistics, Psychology, Law/Policy, Security Studies, or a related field; equivalent professional experience also considered
  • Native or near-native Hindi proficiency with strong English communication skills (C1 or above) for multilingual moderation and policy interpretation tasks
  • Professional experience in Trust & Safety, content moderation, risk operations, compliance, investigations, policy enforcement, or related safety-focused functions
  • Proven experience with LLM red-teaming or adversarial testing, including identifying edge cases and documenting mitigation strategies for unsafe AI behavior
  • Strong understanding of safety domains including hate & harassment, self-harm, violence, misinformation, malicious activity, sexual content, and bias assessment
  • Ability to work with explicit, disturbing, or psychologically sensitive content while maintaining professionalism and consistent judgment
  • Excellent analytical writing skills with strong attention to detail, reproducible reasoning, and the ability to follow evolving moderation guidelines
  • Familiarity with AI tools and platforms such as ChatGPT, Gemini, Perplexity, or similar systems, along with prior AI training or annotation experience preferred
Upload your CV/resume or any other relevant file. Max. file size: 800 MB.