Overview
Hindi Trust & Safety Data Trainer | $15/hr Remote Jobs in India at Crossing Hurdles
Title: Hindi Trust & Safety Data Trainer | $15/hr Remote
Company: Crossing Hurdles
Location: India
Hindi Trust & Safety Data Trainer Work Snapshot
- Job Type: Contract
- Location: Remote
- Compensation: Up to $15 per hour
- Commitment: Flexible / project-based (hourly)
Roles & Responsibilities
- Review and evaluate AI-generated safety-related content and moderation decisions for accuracy, policy compliance, reasoning quality, and contextual safety
- Label and quality-check Trust & Safety datasets across categories such as hate speech, harassment, self-harm, violence, misinformation, malicious activity, and harmful content
- Perform red-teaming and adversarial testing to identify unsafe outputs, policy loopholes, attack patterns, and edge-case vulnerabilities in AI systems
- Compare and rank AI-generated responses based on safety alignment, clarity, severity assessment, and adherence to moderation guidelines
- Analyze nuanced Hindi and English content, including slang, coded language, cultural references, and context-sensitive harmful behavior patterns
- Document safety risks, escalation patterns, policy gaps, and mitigation recommendations using structured rationales and consistent evaluation standards
- Apply and localize Trust & Safety policies across Hindi and English content while maintaining linguistic accuracy and cultural relevance
- Support AI model improvement through annotation workflows, quality assurance reviews, policy enforcement, and detailed documentation practices
Requirements
- Education: Bachelor s degree or higher in Communications, Linguistics, Psychology, Law/Policy, Security Studies, or a related field; equivalent professional experience also considered
- Native or near-native Hindi proficiency with strong English communication skills (C1 or above) for multilingual moderation and policy interpretation tasks
- Professional experience in Trust & Safety, content moderation, risk operations, compliance, investigations, policy enforcement, or related safety-focused functions
- Proven experience with LLM red-teaming or adversarial testing, including identifying edge cases and documenting mitigation strategies for unsafe AI behavior
- Strong understanding of safety domains including hate & harassment, self-harm, violence, misinformation, malicious activity, sexual content, and bias assessment
- Ability to work with explicit, disturbing, or psychologically sensitive content while maintaining professionalism and consistent judgment
- Excellent analytical writing skills with strong attention to detail, reproducible reasoning, and the ability to follow evolving moderation guidelines
- Familiarity with AI tools and platforms such as ChatGPT, Gemini, Perplexity, or similar systems, along with prior AI training or annotation experience preferred