Настроить Cookies
Мы используем Cookies для улучшения работы сайта
Настроить Cookies
Настройки Cookies
Файлы cookie, необходимые для корректной работы сайта, всегда включены. Другие файлы cookie можно настроить.
Основные файлы cookie
Всегда включены. Эти файлы cookie необходимы для работы веб-сайта и его функций. Их нельзя отключить. Они устанавливаются в ответ на ваши запросы, например, при настройке параметров конфиденциальности, входе в систему или заполнении форм.
Аналитические файлы cookie
Disabled
Эти файлы cookie собирают информацию, которая помогает нам понять, как используются наши веб-сайты, насколько эффективны наши маркетинговые кампании, а также помогает нам персонализировать наши веб-сайты для вас.
Рекламные файлы cookie
Disabled
Эти файлы cookie предоставляют рекламным компаниям информацию о вашей активности в интернете, чтобы помочь им показывать вам более релевантную рекламу или ограничивать количество показов рекламы. Эта информация может быть передана другим рекламным компаниям.
Валидация потока UGC, от простых решений к сложным пайплайнам
Тезисы
Везде, где есть контент, генерируемый пользователем, рано или поздно возникает необходимость этот самый контент как-то фильтровать, и делать это довольно быстро.

В рамках доклада рассмотрим, в каких случаях требуется предварительная проверка, как работать с разными типами контента, какие инструменты использовать, в каком порядке, где набрать датасет и что делать, если одна из ваших ML-моделей стала показывать погоду на Марсе вместо хоть сколько-то предсказуемых скоров.

Доклад рассчитан на backend-разработчиков, аналитиков и дата-саентистов. Слушатели смогут понять и развернуть у себя пайплайн проверки пользовательского контента.
Везде, где есть контент, генерируемый пользователем, рано или поздно возникает необходимость этот самый контент как-то фильтровать, и делать это довольно быстро.

В рамках доклада рассмотрим, в каких случаях требуется предварительная проверка, как работать с разными типами контента, какие инструменты использовать, в каком порядке, где набрать датасет и что делать, если одна из ваших ML-моделей стала показывать погоду на Марсе вместо хоть сколько-то предсказуемых скоров.

Доклад рассчитан на backend-разработчиков, аналитиков и дата-саентистов. Слушатели смогут понять и развернуть у себя пайплайн проверки пользовательского контента.
Видеозапись доклада
Появится здесь после конференции
Информация о спикере
Андрей Шубин
Старший разработчик, Яндекс
Разработчик с опытом работы в компаниях разного размера: от местечковых контор до международных корпораций. В сфере IT занят 15 лет, из которых 11 занимаюсь бэкэндом. Сейчас занят в команде классификации и фильтрации контента.

Примеры моих предыдущих выступлений:
Фантастические грабли электронной коммерции, и где они обитают
ML в электронной коммерции Оно вам надо
Все доклады секции