Radio and PodcastRadio and PodcastLive Radio & Podcasts
Reward Models Data Brew Episode 40 artwork
Technology

Reward Models Data Brew Episode 40

Data Brew by Databricks by Databricks

Mar 20, 202539:58Technology

In this episode, Brandon Cui, Research Scientist at MosaicML and Databricks, dives into cutting-edge advancements in AI model optimization, focusing on Reward Models and Reinforcement Learning from Human Feedback (RLHF)....