arxiv preprint - Show, Don’t Tell: Aligning Language Models with Demonstrated Feedback

In this episode, we discuss Show, Don’t Tell: Aligning Language Models with Demonstrated Feedback by Omar Shaikh, Michelle Lam, Joey Hejna, Yijia Shao, Michael Bernstein, Diyi Yang. The paper introduces Demonstration ITerated Task Optimization (DITTO), a method for customizing language model outputs using fewer than ten demonstrations as feedback. DITTO, based on online imitation learning, aligns the model’s outputs to user-specific behavior by generating comparison data iteratively. DITTO outperforms existing methods like few-shot prompting and supervised fine-tuning by an average of 19% in matching fine-grained styles and tasks.

arxiv preprint – Show, Don’t Tell: Aligning Language Models with Demonstrated Feedback