

Results-oriented Senior AI Trainer and LLM Evaluator with over nine years of experience in AI initiatives, including data annotation, LLM evaluation, and quality assurance. Expertise in benchmark-testing conversational AI and STEM reasoning models using structured rubrics. Strong analytical background in electrical engineering and information technology, with proficiency in Python, SQL, and data validation.
AI Evaluation & Alignment: RLHF, Human Preference Ranking, Comparative Response Evaluation, Hallucination Detection, Bias & Safety Mitigation
Prompt Engineering: Prompt Optimization, Advanced Instruction Following, Few-Shot Prompting, Adversarial Testing (Red Teaming)
Advanced AI Capabilities: Agentic System Evaluation, Tool Use Validation, Multimodal Annotation, NLP, Search Relevance, Query Classification
Model Evaluation
Domain Expertise: STEM Evaluation, Rubric-Based Scoring, Model Benchmarking, Quality Assurance Reporting
Data Annotation: Video Annotation, Image Annotation, Text Labeling
Technical Proficiencies: Python, SQL, JSON, Microsoft Excel, Data Validation Pipelines