Компьютерра PDA 29.05.2010-04.06.2010
Шрифт:
Автор: Григорий Рудницкий
Опубликовано 31 мая 2010 года
Проблема соблюдения авторских прав постоянно преследует разработчиков YouTube. Пользователи загружали и продолжают загружать на крупнейший видеосайт пиратский контент, а правообладатели во всём винят Google, которому Youtube принадлежит. Как решить эту проблему? Вручную проверять каждый ролик - слишком долго и дорого. В Google разработали автоматическую систему распознавания нелегального видео Content ID.
Правообладатели передают компании Google копии видеофайлов, которые они хотели бы защитить от нелегальной публикации (для них это совершенно
Директор по разработкам YouTube Оливер Хэкман ответил на вопросы "Компьютерры" и рассказал о распознавании пиратского видео, фильтрации порнографии, новом интерфейсе сайта и HTML5.
– Сколько произведений зарегистрировано в базе данных Content ID? Есть ли среди них российские?
– Сейчас в нашей базе больше миллиона файлов. Мы обновляем её двумя способами. Когда владелец контента присылает нам файл, мы его добавляем в базу напрямую. Здесь используется два канала, причём первый работает несколько быстрее, чем второй. Мы пользуемся более скоростным каналом для обновления базы данных по спортивным мероприятиям, чтобы максимально быстро обеспечить защиту правообладателей именно в этой области. Если же речь идёт о защите контента, для которого оперативность не столь важна, то мы используем менее скоростной канал.
Что же касается объема российского контента в системе, то могу сказать, что референтного материала по российскому контенту у нас пока маловато, поскольку лишь один партнер выразил желание работать с нами – это телеканал Russia Today.
– Насколько часты ложные срабатывания Content ID?
– Их практически нет. Мы с самого начала проектировали систему именно таким образом, чтобы количество ложных срабатываний были минимальным.
– Почему порнографический контент практически никогда не встретишь на YouTube, а пиратское видео то и дело попадается? Как реализован процесс фильтрации порнографии? Кто занимается поиском порнороликов – программы или люди-модераторы?
– Вы говорите о двух фундаментально различающихся явлениях. Начнем с порнографического вопроса. У нас есть очень четкие правила сообщества, где сказано, что обнажёнка в таких-то пределах не допускается. Поэтому мы легко можем обучить наших сотрудников принимать решения даже в очень сложных ситуациях, связанных с порнографическим материалом. В отношении порнографии у нас работают как автоматизированные методы отбраковки, так и ручной просмотр. Вообще, с порнографией все достаточно просто. Любой человек поймет, что вот такое количество обнажёнки допустимо, а вот такое – уже нет. Но если говорить о трейлере какого-нибудь фильма, то мы зачастую сами не можем разобраться, хочет ли автор видео, чтобы его видела широкая публика, или нет. Приходится ждать какого-либо решения и сигнала правообладателя по данному вопросу. И как только мы получаем ту или иную рекомендацию, то сразу вводим в свою систему соответствующий алгоритм.
– Год назад Google сообщал, что на Youtube загружается около 11 часов видео в минуту. А сколько сейчас?
– С тех пор все изменилось. Теперь ежеминутно загружается 24 часа нового контента.
– Какой процент нарушающих права файлов фильтруется автоматически, а какой процент снимается по претензии правообладателя?
– Точной цифры я не знаю.
– Есть и другая проблема. Если речь идёт о каком-то громком событии или популярном фрагменте фильма, то его могут выложить на YouTube сразу несколько пользователей. В результате возникает никому не нужное дублирование файлов. Возможно ли решить эту проблему?
– Вы правы, меня это тоже раздражает. Мы в курсе этой проблемы и работаем над её минимизацией. Вместе с тем, она несколько сложнее, чем может показаться. Часто ролики хотя бы минимально, но различаются. Я полагаю, что автоматическое удаление идентичных роликов было бы неверным шагом. Ведь всегда есть мизерная вероятность того, что идентичный файл чем-то все-таки отличается от того, что уже есть. Возможно, что это мизерное отличие состоит в какой-то важной крупице информации. Проще говоря, у нас есть желание подступиться к этой проблеме, но конкретных способов её решения пока нет. Вообще говоря, здесь есть множество разных аспектов – этических, юридических. Мы обычно стараемся не редактировать список найденного по вашему запросу, хотя можно было бы и таким образом решить проблему дублирования.
– Не кажется ли вам несколько устаревшим десятиминутное ограничение длительности загружаемого файла?
– Напомню, что мы ввели это ограничение не по техническим причинам. Мы легко можем поддерживать файлы любой длины. Более того, некоторые привилегированные пользователи, прежде всего университеты, имеют право загружать материалы гораздо большей длительности. Правило десяти минут было введено для защиты авторских прав, чтобы затруднить загрузку целых фильмов или телепередач. Конечно, мы могли бы заявить, что поскольку сейчас у нас установлена система Content ID, которая полностью устраняет данную проблему. С технической точки зрения это правильно, но про человеческий фактор тоже ведь нельзя забывать. У нас пока недостаточно партнеров в рамках Content ID. Если большинство поставщиков контента воспользуется системой Content ID, мы спокойно сможем убрать десятиминутное ограничение.
Важно и другое. Есть существенная разница между просмотром видео по телевидению и в интернете. Самый популярные ролики в интернете обычно очень короткие и очень конкретные, их средняя длительность составляет от трёх до пяти минут. Поэтому десятиминутное ограничение кардинально не влияет ни на что. Но если оно действительно может создать серьёзные неудобства, мы снимаем это ограничение, что делается, к примеру, при публикации университетских лекций.
– Недавно на портале YouTube радикально поменялся интерфейс. С чем это было связано?
– Основная причина изменения дизайна страницы пользовательского канала состоит в том, что YouTube уже пять лет, но радикально при этом дизайн не пересматривался. Мы просто добавляли кнопку за кнопкой в течение всех этих пяти лет, а интерфейс постепенно становился все более тяжелым и запутанным. Например, у нас было очень много строк с текстом, размещенных в нижней части страницы, сейчас же мы оставили всего две строки, что выглядит гораздо аккуратнее и понятнее. То же самое касается и верхних блоков страницы, а также функций управления в самом плеере. Короче говоря, смена дизайна – это естественное событие в жизни любого веб-сайта.