Radio and PodcastRadio and PodcastLive Radio & Podcasts
#072 ML Татьяна Шаврина. Бенчмарки Для LLM Или Как Оценивать Большие Языковые Модели? artwork
Technology

#072 ML Татьяна Шаврина. Бенчмарки Для LLM Или Как Оценивать Большие Языковые Модели?

Machine Learning Podcast by Mikhail

Apr 17, 202580:46Technology

В гостях сегодня Татьяна Шаврина, старший научный сотрудник Института Языкознания РАН. Обсуждаем бенчмарки - стандартизированные наборы тестов, метрик и протоколов оценки, предназначенные для объективного измерения произ...