1 / 8Полезно тем, кто строит или оптимизирует системы модерации контента и хочет снизить затраты без потери качества.
Команда рассказывает, как построила multilabel guardrail-классификатор для автоматического выявления небезопасного контента в реальном времени на двух языках. Система работает как защитный слой, отсекающий проблемные материалы до того, как они попадут к пользователям.
Ключевая часть материала — оптимизация: классификатор удалось сделать в три раза быстрее и дешевле. Авторы разбирают, что именно изменили в архитектуре и пайплайне, и приводят конкретные цифры по ежедневным затратам.
Для киноиндустрии это релевантно платформам с пользовательским контентом, стриминговым сервисам с комментариями и UGC, а также системам модерации отзывов и рецензий. Подход multilabel позволяет ловить несколько типов нарушений одновременно. Технические детали — на сайте источника.
Материал агрегирован; полный текст — на сайте Хабр — ИТ-новости.
Увеличить1 / 8