Обновить
1

Пользователь

3,2
Рейтинг
2
Подписчики
Отправить сообщение

Им бы следовало сделать анализатор, который будет сравнивать сгенерированное произведение с уже существующими произведениями, и выдавать индекс похожести. Чтобы пользователь понимал, не надел ли он чужие тапки. А дальше уже вся ответственность должна ложится на пользователя, если он захочет обнародовать свой шедевр.
Технически это возможно, хотя и требует немалых вычислительных ресурсов. Но опять возникает проблема другого плана - как получать эталонные хеши произведений? Это требует разрешения использовать авторскую собственность для обучения ИИ. А авторы упираются. Хотя это в их интересах, и направлено на защиту от случайного повторения оригинальных авторских мелодий.

А интерпретация «множества миров», впервые предложенная [4] физиком Хью Эвереттом в его докторской диссертации в Принстонском университете в Нью‑Джерси в середине 1950-х годов

В самом деле, интерпретация «множества миров» была предложена самим Эвереттом?

Тем не менее, физики и философы не могут прийти к единому мнению даже по поводу базовых вещей.

Эти “физики и философы” - они внутри одного человека? Речь о концептуальном дуализме ученого?
Иначе это как спор между трактористом и шахматистом, о шахматном и колхозном полях.

Задача, которая стоила десять дней, по-прежнему стоит десять дней, но внутри этих десяти дней у человека появились паузы: ютуб, сигареты, восемь походов на кофепоинт, да что угодно — в ожидании, когда агент допишет большую фичу и прогонит тесты.

Удивительное совпадение. Как так совпало, что автоматическая разработка оказалась по скорости равна ручной? Коллективный сговор на всех уровнях?
В авиации все понятно - скорость соответствует оптимальному режиму эксплуатации самолета, и не связана с ограниченными возможностями живого пилота. Замена человека на автоматику не влияет на скорость и время полета.

Точной копии не было, конечно же, но и нарушений авторских прав тоже не получалось.

Не совсем так. Речь скорее о технической возможности тиражирования, а не о его правомерности. Вопрос о возможном нарушении не затрагивается.
Аппараты, для воспроизведения и записи музыки на болванки CD-R и CD-RW, оснащены обязательной аппаратной системой защиты от бесконтрольного цифрового копирования SCMS (Serial Copy Management System), которая блокирует создание более чем одной копии носителя защищенного копирайтом.
Защита SCMS не распространяется на аналоговые входы (тюльпаны-RCA). Перезаписать защищенный диск через аналоговое подключение можно без ограничений, но с небольшими потерями в качестве звука.

Граница проходит там, где судебная экспертиза усмотрела достаточное сходство.

Обычно граница достаточно строго установлена законом. В ином случае естественно все остается на усмотрение судей. Учитывая авторитет GEMA в Германии, и общие антиамериканские настроения в ЕС, суд предсказуемо склонился в сторону истцов.

Теория струн формулируется так - “Вы все дураки, а я Дартаньян. Хотя нет, я тоже дурак. Поэтому давайте уже что-то с этим делать”.
Еще Теорию струн можно сравнить с табличкой “Объезд”. Ее установили умные люди, которые уже ездили вперед, все проверили, и убедились что впереди тупик. Поэтому сразу установили табличку “Объезд”. Но они пока еще не проверили, есть ли там объезд на самом деле. Просто проявили инициативу, и пригласили остальных проверить наличие объезда.

какие команды плохие, а какие хорошие?

Команда добрая. Аргументы злые!

Так им же вменяют воспроизведение, а не хранение. Какая разница, в каком виде оно хранится.

Тонкость в терминологии. Если речь о программе, то “воспроизведение” это точное копирование. Иначе программа не заработает. Если речь о музыкальном произведении, то исполнение Рабиновичем на балалайке это тоже “воспроизведение”. Где проходит граница, после которой можно говорить о “воспроизведении”, это достаточно субъективное решение.

Схожести с исходником. Иначе как определять схожесть, если нет исходника?

Схожесть с произведением. Для сравнения могли продемонстрировать суду абсолютно любую запись. Реальным исходником при обучении мог быть кавер исполненный Рабиновичем. В таком случае все равно сохранится узнаваемость, и будет сходство с оригинальным исполнением, и вообще с любым другим кавером.

Тут же явно до Suno решили докопаться, ну и докопались.

О чем и речь. Этот процесс это поиск лазеек в законе. Основано на размытых формулировках, и более свободной трактовке нарушений авторских прав в немецком законодательстве.

Среди этих уже отобранных сессий серьёзное действие, которое пользователь явно не запрашивал, обнаружили в 6,3% случаев с ручным подтверждением и в 2,4% случаев с Auto mode.

ЛЛМ: Прошу разрешения отформатировать диск Д:
Пользователь: Разрешаю.
ЛЛМ: Ой, я опечаталась, и отформатировала диск С:

Антропик: А вот мы, в нашем продвинутом режиме Auto mode, вообще не разрешаем команду “Формат”. Так намного безопаснее. Хотя “опечатки” у ЛЛМ все равно случаются. Но не в 6,3% случаев, а всего лишь в 2,4%.

Так ведь реальная студийная аудиозапись (например, на Spotify) - это просто набор нулей и единиц

Им вменяют обучение на материалах Ютуба, с обходом механизма блокирующего автоматическое скачивание. На Ютубе куча каверов, миксов, и прочего. Модель при обучении обрабатывает все, и сохраняет нечто усредненное в собственном формате пригодном для генерации. Вероятность выбрать что-то одно, и сохранить фрагмент в оригинальном виде, равна нулю.

И наверняка сравнение было, потому что в таких случаях проводится судебная экспертиза

Тогда формулировки были бы другими, и были бы указаны конкретные исходники из которых взяты фрагменты. Но формулировки говорят о чисто субъективной оценке схожести.

Это называется кавер.

О чем и речь. Модель способна разве что исполнить кавер, имеющий заметное сходство с оригинальным произведением. Но при этом он будет уникальным для каждого пользователя.
Сама идея, что сервис по созданию музыки будет воспроизводить запись одинаковую для всех пользователей, просто абсурдна. Пользователям нужно что-то новое и оригинальное. Если модель будет копировать старое, и выдавать одинаковый результат для разных пользователей, то это быстро вскроется. И тогда сами пользователи подадут на них в суд за мошенничество.

так как иметь большой хвост и выжить - это надо хорошее здоровье иметь, значит и детям хорошие гены передаст.

И что в этом общего, если сравнивать с длинным сопроводительным письмом? Я могу понять “логику” ЛЛМ, почему оно нашло сходство. Но если автор-человек не зоолог, то использование такой аналогии объяснить сложно.

Ну можно потратить, а можно изобразить что потратил (отправив красивое вдумчивое сопроводительное письмо), а потратить 5 минут или меньше.

Ну так не час здесь “изображается”, а старание. ЛЛМ иногда сокращает предложение, выбрасывая слова без учета влияния на смысл. Для него сходство с исходной формой все еще достаточное, чисто математически.

В моменте спрос значительно превысил предложение. В такой ситуации есть возможность поднять цены, получить доп средства, и развернуть больше мощности. Типичная ситуация на растущем рынке.

Пользователи любых моделей, закрытых и открытых, сейчас платят в основном именно за вычислительные мощности. Смысл в том, что пользователь получает огромные ресурсы на короткое время. За счет этого задача решается быстро. Он конечно может на собственном слабом оборудовании решить задачу, но это займет неприемлемо много времени.

Гонки вооружений нет. У работодателя и соискателя общий враг - большой поток информации, и их собственная лень.
Концепция статьи не совсем точна.
Площадка для поиска работы - слуга двух господ. Она должна угождать обоим. Но она попадает в замкнутый круг противоречий. Она помогает ленивому соискателю обмануть работодателя. Но при этом, следуя интересам второй стороны, она помогает работодателю разоблачить хитрого соискателя. Площадка по сути воюет сама с собой. В итоге все приводит к тому, что правила для обеих сторон ужесточаются, и площадка становится угнетателем для обеих сторон. И работодатель и соискатель вынуждены прогибаться под требования площадки, и в целом обе стороны от этого проигрывают.

Павлиний хвост честно сообщает о здоровье павлина, потому что больной павлин такой хвост не отрастит.

Автор по образованию зоолог? Откуда взялась эта страная аналогия с больным павлином? Которая здесь не очень-то и подходит, потому что павлин не отращивает хвост целенаправленно.

Час чужого времени, потраченный на тебя лично, нельзя было изобразить.

Изобразить час времени? Что это вообще значит?

модель ИИ может сохранять части оригинальных произведений.
Произведений, а не аудиозаписей. Речь идет не о фрагментах реальных студийных или концертных записей, а об абстрактом произведении, которое по сути “ноты + текст”. Поэтому в формулировках было существенно похожи. Не было технического сравнения с реальными аудиозаписями, чтобы определить где и в каком году это было исполнено оригинальными артистами.

Если б не воспроизвела, то и прицепиться было бы не к чему.

Претензия заключается в использовании произведений для обучения ИИ, без разрешения автора. А воспроизведение фрагментов это доказательство того, что произведения использовались для обучения.
Хотя это сомнительно, так как могли использоваться кавер-версии, которые тоже обладают достаточным сходством, но не являются собственностью автора оригинального произведения.

В новости сказано так: Суд согласился с тем, что Suno запомнила и воспроизвела шесть произведений

Упрощенный перевод. В источниках сказано что совпадали лишь отдельные элементы, или произведение было просто узнаваемым.
https://www.juve-patent.com/cases/munich-regional-court-stops-suno-using-gema-protected-music/
В ходе устного слушания GEMA заявила, что ей удалось документально подтвердить, что система Suno создает аудиоконтент, который по мелодии, гармонии и ритму частично соответствует шести всемирно известным произведениям.
Суд также постановил, что Suno несет ответственность, когда ИИ, сгенерировавший результаты в Германии, воспроизводил узнаваемые оригинальные элементы песен.
В деле GEMA против Suno простые подсказки приводили к результатам, которые были существенно похожи на оригинальные музыкальные произведения.
Вот самая суровая формулировка, но и она не утверждает что были получены копии произведений.
Суд установил, что спорные песни фактически хранились в музыкальных моделях ИИ ответчика, размещенных на серверах в Германии. Это может происходить посредством процесса, называемого «запоминанием»: вместо простого изучения общих закономерностей на основе обучающих данных, модель ИИ может сохранять части оригинальных произведений и впоследствии воспроизводить их. Суд пришел к выводу, что сходство между оригинальными песнями и результатами, сгенерированными ИИ, было слишком обширным и специфическим, чтобы быть случайным.

Языковые модели зачастую выдают всякие там куски датасетов, если написать нужный джейлбрейк.

Да, из языковых моделей могут быть извлечены короткие фрагменты, имеющие высокую степень схожести с материалом датасета. Но это естественно и неизбежно, иначе невозможно было бы сохранить точные определения и точное описание формул в текстовых LLM. А если ИИ не может точно запомнить формулу или определение, то он будет бесполезен, потому что будет врать когда нужно будет вывести формулу или определение.

Amazon инвестирует $1 млрд в команду инженеров, которые будут выезжать в офис клиентов и внедрять ИИ‑агенты

И $2 млрд в команду, которая будет таких агентов ликвидировать.

В этом вся подлая суть мысленных экспериментов – частенько сама реальная физика в них не учитывается.

Реальная физика убегает в панике, как только к ней приближается наблюдатель.

Треш-стрим это отдельное нарушение. Еще тайная съемка. И дискредитация продукции компании (у нас запрещенной).

Информация

В рейтинге
1 576-й
Зарегистрирован
Активность

Специализация

Инженер встраиваемых систем
Младший