
I design scalable, reproducible data pipelines for LLM training and alignment—covering collection, filtering, labeling, augmentation, and versioning.
What you’ll get:
Best for:
Teams struggling with noisy data, inconsistent results, or slow iteration.