RFT, DPO, SFT: Fine-tuning with OpenAI — Ilan Bigio, OpenAI
This talk explores various fine-tuning techniques for OpenAI models, including Supervised Fine-Tuning (SFT), Direct Preference Optimization (DPO), and Reinforcement Fine-Tuning (RFT). The presenter, Ilan Bigio from OpenAI's developer experience team, emphasizes that fine-tuning is a specialized tool for optimizing models beyond what prompt engineering can achieve, particularly for specific domains or behaviors. The discussion covers the data requirements, use cases, and limitations of each method, offering practical examples and best practices.
World's Fair 2025 106 min