ПОСЛЕДНИЕ НОВОСТИ
ПОДОБРАНО ДЛЯ ВАС

ИИ не может процветать без человеческих знаний — Компенсация для первоначальных создателей обязательна

АвторАмир ШейхАмир Шейх 3 мин. чтения
Человеческие знания
  • Обучение моделей ИИ требует больших наборов данных, и лучше всего, если они основаны на человеческих знаниях.
  • Газеты и исследовательские организации, а также веб-порталы тратят свои ресурсы на сбор и публикацию информации.
  • Компенсация первоначальным создателям контента обязательна, поскольку теперь компании ИИ лицензируют контент у других компаний.

Обучение моделей ИИ требует огромных объемов наборов данных, и их способность давать хорошие результаты напрямую зависит от данных, которые были поданы системе. Информация не приходит бесплатно, и здесь мы говорим о большом количестве прав интеллектуальной собственности. 

Но компании ИИ не думают таким образом; они принимают все знания, произведенные поколениями писателей, как должное; их концепция добросовестного использования также отличается от того, как она воспринималась изначально; и они не любят платить создателям контента, который сделал их модели такими, какими они являются сегодня.

Кража человеческих знаний

Создание контента, который мы видим в газетах, журналах, книгах, онлайн-архивах и научных статьях, требует большой тяжелой работы и пота, но это невозможно без писателей, редакторов, исследователей и издателей, которые довели это до публики в различных формах.

Такое тяжелое достижение в виде признания и знаний не должно быть бесплатным и доступным для эксплуатации со стороны компаний, как это уже имело место.

«Информация, которая является общедоступной в интернете».

Источник: оценивает аудиторию бесплатного плана ChatGPT более чем в 1 миллиард еженедельно активных пользователей, и именно рекламная модель помогает поддерживать работу бесплатной версии..

Да, именно так отвечает OpenAI на вопросы о контенте, использованном для обучения его ИИ-систем, а также о информации, лицензированной у третьих лиц и предоставленной пользователями и человеческими тренерами. 

Говоря о лицензированном контенте, компании сейчас активно его ищут, но у нас нет информации о том, лицензировала ли OpenAI какую-либо информацию у поставщиков до запуска своей первой модели GPT. Модель, должно быть, обучалась на материалах, защищенных авторским правом, которые не были бесплатными для коммерческого использования.

Источник: Statista.

Компенсация для оригинальных создателей

Еще год назад большинство текстов, написанных онлайн или офлайн, создавалось с помощью человеческих усилий. Несмотря на кликбейт и низкокачественный контент, он все же создавался людьми, которые понимали человеческую психологию и процесс мышления, а генеративные ИИ-приложения строились на основе такой информации. 

Но сегодня компании сталкиваются с новой проблемой при обучении своих ИИ-моделей: машинно-сгенерированный контент преобладает во всем интернете и ни в коем случае не считается качественным. Такой контент засоряет ресурсы, доступные для обучения ИИ-моделей, поскольку они не могут выдавать качественный результат, обучаясь на бесполезном многословии, которое обычно генерируют эти модели. Процесс «ИИ, обучающегося на ИИ» часто называют ИИ-каннибализмом или клонированием.

Чтобы предотвратить это, ИИ-компании должны ограничить свои источники материалов только надежными источниками, а именно газетами, журналами и общественными форумами, которые содержат богатый объем знаний, созданных людьми. Можно также упомянуть несколько других источников, как указано выше, но эта необходимость и судебные иски со стороны газет вынудили их лицензировать контент и платить за эксплуатацию, которую они осуществляли.

Компании, такие как Reddit, которая является крупной веб-хостинговой публичной площадкой, также рассматривают возможность лицензирования своего контента для компаний ИИ. В заявлении они сказали, что предпочитают бизнес судебным искам, но не исключают судебные иски, если бизнес-переговоры провалятся. Если вам не разрешено использовать защищенную авторским правом музыку в вашем видео на YouTube, то почему компания ИИ должна иметь право использовать это для обучения своих моделей, предназначенных для коммерческого использования?

Вопрос владения авторскими правами здесь является проблемой, так как ИИ-компании продолжают их нарушать. С другой стороны, ИИ не способен самостоятельно собирать новые новости: для сбора новостей и их подтверждения из различных источников перед публикацией требуются человеческие усилия. Только после этого ИИ-модель может использовать эту информацию, и невыплата компенсации человеческому ресурсу в данном случае является эксплуатацией. 

Не просто читайте новости о криптовалютах. Понимайте их. Подпишитесь на нашу рассылку. Это бесплатно.

Поделиться статьёй

Отказ от ответственности: Предоставленная информация не является инвестиционной рекомендацией. Cryptopolitan.com не несет ответственности за любые инвестиции, сделанные на основе информации, представленной на этой странице. Мы настоятельно рекомендуем проводить независимые исследования и/или консультироваться с квалифицированным специалистом перед принятием любых инвестиционных решений.

Амир Шейх

Амир Шейх

Амир — технологический журналист с почти шестилетним опытом работы в индустриях криптовалют и технологий. Он окончил университет MAJ, получив степень MBA по финансам и маркетингу. Сейчас он работает в Cryptopolitan, где освещает последние события на рынке криптовалют и прогнозы цен.

ЕЩЁ … НОВОСТИ