At Turing, I evaluate and benchmark large language model outputs across coding, reasoning, and technical domains. I design edge-case tests and validation prompts, and help curate supervised datasets to improve model fine-tuning accuracy.
I built Aegis AI, a multi-service RAG security platform using MongoDB Atlas Vector Search and real-time WebSocket telemetry. At Harvin Technologies, I integrated LLMs with web platforms using the Gemini API and developed prompt-chaining pipelines that increased retrieval accuracy and response relevance by 40%.

