Настроить Cookies
Мы используем Cookies для улучшения работы сайта
Настроить Cookies
Настройки Cookies
Файлы cookie, необходимые для корректной работы сайта, всегда включены. Другие файлы cookie можно настроить.
Основные файлы cookie
Всегда включены. Эти файлы cookie необходимы для работы веб-сайта и его функций. Их нельзя отключить. Они устанавливаются в ответ на ваши запросы, например, при настройке параметров конфиденциальности, входе в систему или заполнении форм.
Аналитические файлы cookie
Disabled
Эти файлы cookie собирают информацию, которая помогает нам понять, как используются наши веб-сайты, насколько эффективны наши маркетинговые кампании, а также помогает нам персонализировать наши веб-сайты для вас.
Рекламные файлы cookie
Disabled
Эти файлы cookie предоставляют рекламным компаниям информацию о вашей активности в интернете, чтобы помочь им показывать вам более релевантную рекламу или ограничивать количество показов рекламы. Эта информация может быть передана другим рекламным компаниям.
"Я их слепила из того, что было”, или как генерировать данные для вашей модели?
Тезисы
Многим компаниям сегодня нужна большая языковая модель в собственном контуре: проверять гипотезы на расшифровках телефонных разговоров, гонять эксперименты на чувствительных данных, которые нельзя отдавать наружу, но качество исходных моделей устраивает не всех. В поисках того самого golden dataset, который разом починит все проблемы, приходят к тому, что такого датасета не существует, а то, что лежит в открытом доступе, не устраивает по качеству. В этом докладе я расскажу, как мы пришли к разработке собственных данных, зачем это нужно и на какие грабли успели наступить по пути.
Многим компаниям сегодня нужна большая языковая модель в собственном контуре: проверять гипотезы на расшифровках телефонных разговоров, гонять эксперименты на чувствительных данных, которые нельзя отдавать наружу, но качество исходных моделей устраивает не всех. В поисках того самого golden dataset, который разом починит все проблемы, приходят к тому, что такого датасета не существует, а то, что лежит в открытом доступе, не устраивает по качеству. В этом докладе я расскажу, как мы пришли к разработке собственных данных, зачем это нужно и на какие грабли успели наступить по пути.
Информация о спикере
Владислав Попов
Data Scientist, Точка Банк
Крутой бобер
  • Владислав Попов
    Data Scientist, Точка Банк
    Крутой бобер
Все доклады трека