Опять об авторских правах. Бывший ведущий обвинил Google в копировании своего голоса для ИИ
IT-индустрия18 февраля, 08:00
Об этом пишет издание Gizmodo.
Во второй половине 2024 года Google добавил в NotebookLM функцию Audio Overviews, которая позволяет пользователям превращать страницы заметок и документов в короткие подкасты. Искусственный интеллект обычно создает подкаст с мужским и женским ведущими. По словам Грина, мужской голос был явно обучен на его работе и теперь его имитирует, при этом компания не получила его разрешения и не предложила компенсацию.
«Без его согласия Google пыталась воспроизвести узнаваемый голос господина Грина — голос, который стал иконическим благодаря десятилетиям работы на радио и публичных комментариях, — для создания синтетических аудиопродуктов, имитирующих его манеру речи, ритм и личность,» говорится в иске, поданном в суд округа Санта-Клара в Калифорнии.
Дэвид Грин более десяти лет был соведущим награжденного подкаста NPR Morning Edition, а сейчас ведет подкаст KCRW Left, Right & Center.
После запуска функции ИИ-подкастов в 2024 году пользователи отмечали, что голоса получились чрезвычайно естественными. Forbes назвал их «жутко человеческими», а WIRED отметил, что ритм и манера речи виртуальных ведущих, включая фразы и словесные наполнители, делали продукт заметным.
В иске отмечается, что компания «неправомерно использовала карьеру, идентичность и средства к существованию любимого ведущего радио и подкастов как сырье для прибыли технологической компании без какой-либо компенсации».
Грин узнал о сходстве от коллег и обратился в фирму по экспертизе искусственного интеллекта. Тесты показали 53−60% вероятности, что голос принадлежит ему. Руководитель фирмы пришел к выводу, что «по нашему уверенному мнению, модель Google Podcast была обучена на голосе Дэвида Грина».
В Google заявили, что «звук мужского голоса в Audio Overviews основан на оплачиваемом профессиональном актере, которого наняла компания».
Тема использования интеллектуальной и творческой собственности в ИИ остается острой. Модели требуют большого количества данных для обучения, но из-за недостаточного регулирования часто возникает противоречие между законным использованием материалов и правами авторов. Кроме того, имитация голоса или образа создает ситуации, когда люди теряют контроль над своим голосом или изображением, ведь пользователи могут заставлять модели говорить и делать что угодно. В 2024 году известный пример — Скарлетт Йоханссон пожаловалась на OpenAI из-за якобы использования ее голоса для ChatGPT, даже после того как актриса отказалась участвовать в проекте.