At Keywords Studios, I support AI model training by executing QA/QC use cases for data collection, analyzing AI outputs against validated user data, and designing prompts that stress-test conversational behavior.
I've evaluated LLM accuracy, safety, clarity, and contextual relevance through structured rubrics, annotation, benchmarking, and regression testing. Previously at GRG Health, I conducted primary and secondary healthcare market research, analyzed complex datasets, and translated findings into strategic reports and recommendations.
