реклама
Новости Software

Meta✴ обвинили в использовании пиратских копий книг для обучения ИИ

Юристы Meta предостерегали компанию от использования пиратских копий книг для обучения искусственного интеллекта, но это всё равно было сделано, гласит поданный против компании иск по авторским правам, поданный ещё минувшим летом, сообщает Reuters.

 Источник изображения: Lukas / pixabay.com

Источник изображения: Lukas / pixabay.com

Накануне были объединены иски против Meta, поданные комиком Сарой Сильверман (Sarah Silverman), лауреатом Пулитцеровской премии Майклом Шейбоном (Michael Chabon) и рядом других авторов, которые утверждают, что компания без разрешения использовала их произведения для обучения большой языковой модели Llama. В документах приводятся журналы переписки на одном из серверов Discord, один из участников которой, работающий в Meta исследователь Тим Деттмерс (Tim Dettmers), описывает свою дискуссию с юридическим отделом компании о том, будет ли законным обучение ИИ на электронных копиях книг.

Адвокаты Meta заявили ему, что «данные нельзя использовать [для обучения модели], или модели нельзя будет публиковать, если они обучены на этих данных». Но в компании признали, что всё-таки использовали эти данные для обучения первой версии Llama. Собеседники Деттмерса, впрочем, уверяют, что использование защищённой авторским правом литературы должно «подпадать под добросовестное использование» — действующую в США правовую доктрину, которая в определённых случаях допускает использование защищённых авторским правом произведений без согласия их авторов.

В этом году в адрес технологических компаний было подано множество исков со стороны различных авторов, которые обвиняют разработчиков ИИ в незаконном использовании произведений, защищённых авторским правом. Их победа может создать угрозу для зарождающейся отрасли генеративного ИИ, поскольку из-за необходимости выплаты отчислений стоимость разработки моделей вырастет. Прошедший предварительное одобрение европейский «Закон об ИИ» предписывает разработчикам раскрывать данные, которые они используют для обучения своих моделей.

В феврале Meta представила первую версию большой языковой модели Llama и раскрыла массив использованных для её обучения данных, в том числе блок, объём которого, по некоторым сведениям, содержит 196 640 книг. Минувшим летом была представлена вторая версия Llama, и Meta уже не стала раскрывать, какие данные были использованы для её обучения. Компании, управляющие сервисами с аудиторией менее 700 млн пользователей в месяц, могут использовать Llama 2 бесплатно.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме
window-new
Soft
Hard
Тренды 🔥
Путин запретил пользоваться услугами в сфере кибербезопасности из недружественных стран с 2025 года 41 мин.
Microsoft задержит выпуск ИИ-функции Recall, которая записывает все действия пользователя 2 ч.
Beyond Good and Evil 20th Anniversary Edition ещё никогда не была так близка к релизу — для переиздания уже выпускают патчи 2 ч.
Президент России запретил ИБ-сервисы и услуги из недружественных стран 3 ч.
В «Рувики» появятся ИИ-алгоритмы уже в этом году 3 ч.
«Самое хардкорное "Диско" со времён Disco»: сотрудники ZA/UM рассказали об отменённой игре во вселенной Disco Elysium, которая могла спасти студию 3 ч.
AWS выделит $230 млн на поддержку стартапов в области генеративного ИИ, но деньги они вряд ли увидят 4 ч.
Акции Adobe взлетели на 17 % на фоне успешного квартального отчёта 5 ч.
Глава FromSoftware: Bloodborne заслуживает выйти на ПК 5 ч.
Инсайдер уточнил, когда выйдут Fable и Gears of War: E-Day 6 ч.
Спрос на ЦОД в Азиатско-Тихоокеанском регионе значительно превышает предложение 45 мин.
Суд взыскал с производителя электроники «Ангстрем» более €1 млрд в пользу «ВЭБ.РФ» 52 мин.
Глобальный рынок смартфонов столкнулся с перенасыщением 58 мин.
«Ростех» разработал компактный модуль Com Express Type 6 Compact на процессоре «Эльбрус-2С3» 2 ч.
«Ростех» представил самый маленький компьютер на «Эльбрусе» — как два Raspberry Pi 3 ч.
AWS, но в космосе: Phantom Space и Assured Space Access создадут космическое облако Phantom Cloud 3 ч.
MSI представила корпус MAG PANO 100 PZ с панорамным обзором и поддержкой плат с тыльными разъёмами 4 ч.
Срок эксплуатации суперкомпьютеров растёт, несмотря на прекращение поддержки оборудования 4 ч.
Tesla устроит на свои заводы более 1000 роботов-гуманоидов Optimus в следующем году, пообещал Илон Маск 4 ч.
Western Digital создала самый ёмкий в мире кристалл 3D QLC NAND — на 2 Тбит 5 ч.