ПОСЛЕДНИЕ НОВОСТИ
ПОДОБРАНО ДЛЯ ВАС

Технологические гиганты расширяют границы, чтобы удовлетворить аппетит ИИ к данным

АвторДжеймс КинотиДжеймс Киноти 3 мин. чтения
ИИ
  • Технологические гиганты прибегают к спорным методам сбора данных для ИИ.
  • OpenAI транскрибирует видео с YouTube, а Google и Meta рассматривают возможность покупки защищённого авторским правом контента.
  • Возникают правовые и этические дебаты вокруг использования ИИ огромных массивов данных.

Независимо от того, идет ли речь о работе OpenAI, Google и Meta, финансировании ИИ в промышленном секторе, который включает различные средства, такие как сбор или накопление огромных объемов цифровых данных разными креативными, но противоречивыми способами, очевидно, что возможности автоматизации растут. Примечательно, что усилия, включающие действия, такие как принятие мер, outlined выше (т.е. учет правовых ограничений и корпоративной политики), эквивалентны значительному количеству данных, используемых для обучения систем ИИ.

Инициатива Whisper от OpenAI: добыча разговоров на YouTube

Наша история Whisper началась всего год назад. Существует острая нехватка первоклассных английских текстов, что вызывает задержки в доставке образования. Whisper был следующим шагом Google. Он понял океан диалогов YouTube и был разработан как текст, приложение для преобразования текста в речь. Сам инструмент на базе ИИ, состоящий из более чем миллиона часов видео с YouTube, проверенных ИИ для генерации новых текстов (по сути, новых разговоров), был использован для обучения моделей ИИ, от новейших до GPT-4, последней версии чат-бота ChatGPT.

Хотя некоторые сотрудники утверждали, что видеоматериалы OpenAI и Microsoft будут плагиатом с YouTube во всех аспектах, этика плагиата оставалась спорной; кроме того, некоторые сотрудники признали, что невозможно точно согласовать действия с намерениями YouTube. Аналогичным образом, приобретение возражений против алгоритмической обработки видео для извлечения текстового содержания для питания моделей ИИ могло быть расценено как угроза авторским правам создателей видео, вызывая возмущение. 

Meta, материнская компания Facebook и Instagram, также была обеспокоена использованием элементов, защищенных авторским правом, от издательств, таких как Simon & Schuster и других. В то же время она обсуждала приобретение общего веб-контента, потенциально рискуя попасть в ловушку нарушения авторских прав.

Кризис данных: стимулирование нестандартных подходов

Сбор данных, полный конкуренции, помогает отметить ключевую позицию данных и идентифицировать их в развитии технологий ИИ. Язык требует все больших обучающих наборов данных для ИИ, включая Commonwealth, которые сегодня манипулируются вплоть до Wikipedia и Reddit извне этих источников. Для технологических компаний, особенно тех, которые испытывают трудности с доступом к очень распространенным источникам данных, таким как традиционные хранилища данных, создание моделей на базе ИИ может быть альтернативным решением, которое может быть достаточно желательным в таких случаях.

Технологические компании указывают, что сбор данных необходим для обучения ИИ, в то время как тот же процесс ставится под вопрос в суде. В свою защиту, OpenAI и Microsoft выиграли дело об обвинении в незаконном использовании материалов, защищенных авторским правом. Тем не менее, они заявили, что их действия подпадают под правовой принцип добросовестного использования. В последние годы количество заявок, поданных в Бюро авторского права США владельцами авторских прав, превысило 10 000, что ясно показывает, что законодательство об авторском праве в эпоху ИИ уникально и ново. Следовательно, основные игроки всегда сталкиваются с опасностями, связанными с нарушением множества произведений под предлогом того, что для моделей, использующих ИИ на этой основе, нет лицензированных целей.

Необходимость в массивных наборах данных

В целом, работа Kaipan’s de Jared, ученого по масштабам, была непреднамеренно эпической в развитии ИИ. Контент, основанный на данных, является одним из компонентов ИИ, необходимых для процесса обучения, но он не может функционировать хорошо без моделей, которые были хорошо обучены и эффективно работают. С ростом технологий искусственного интеллекта спрос на данные для успеха на рынке растет высокими темпами, оставляя компании с вопросами, связанными с правом, этикой и конфиденциальностью. Поэтому алгоритмы искусственного интеллекта должны использовать эти наборы данных для успеха на рынке.

Поведение в сборе данных VIP-лиц искажается для улучшений AI; типичный методологический принцип грубеет. Будь то через одно из их выступлений на YouTube или создание синтетических данных генеративными методами, эти компании являются лидерами в миссии по выяснению того, что на самом деле представляют собой вопросы права, этики и конфиденциальности.

Они могут стать шуткой на море позже. Из-за появления огромных наборов данных, необходимых для управления процессом инноваций, лидерам общества необходимо активно участвовать в конструктивном диалоге для разработки правил и стандартов, в которых усилия по инновациям балансируются с этическими принципами прав интеллектуальной собственности и конфиденциальности.

Оригинальная история из: https://www.nytimes.com/2024/04/06/technology/tech-giants-harvest-data-artificial-intelligence.html

Самые умные крипто-энтузиасты уже читают нашу рассылку. Хотите присоединиться? Присоединяйтесь.

Поделиться статьёй

Отказ от ответственности. Предоставленная информация не является торговой рекомендацией. Cryptopolitan.com Мы не несем ответственности за любые инвестиции, сделанные на основе информации, представленной на этой странице. Мы настоятельно рекомендуем проводить независимое исследование и/или проконсультироваться с квалифицированным специалистом перед принятием любых инвестиционных решений.

Джеймс Киноти

Джеймс Киноти

Энтузиаст криптовалют Джеймс получает удовольствие от обмена знаниями в области финтеха, криптовалют, блокчейна и передовых технологий. Его главная страсть — новейшие инновации в криптоиндустрии, криптогейминг, искусственный интеллект, технологии блокчейна и другие смежные направления. Его миссия: быть в курсе трансформационных приложений в различных отраслях.

ЕЩЁ … НОВОСТИ