テック巨人たちがAIのデータ欲を満たすため境界を押し広げる

- テック大手はAIデータの収集に際し、物議を醸す手法に頼っている。
- OpenAIはYouTube動画を文字起こししており、GoogleとMetaは著作権で保護されたコンテンツの購入を検討している。
- 膨大なデータセットをAIが利用することに対する法的・倫理的な議論が生じている。
OpenAI、Google、Metaの作業があるかどうか、AIが産業部門を資金提供しているかどうか、これには、創造的かつ論争の的となるさまざまな方法で、異なる創造的かつ論争の的となる方法で、膨大な量のデジタルデータを収集または蓄積することを含むさまざまな手段が含まれているが、自動化能力と機能が増加していることは明らかである。特に、上記の措置(すなわち、法的制限および企業方針を考慮に入れること)を含む行動を伴う努力は、AIシステムを訓練するために使用される膨大な量のデータに相当する。
OpenAIのWhisperイニシアチブ:YouTubeの会話を採掘する
私たちのWhisperストーリーは昨年始まりました。教育の提供に遅れを生じさせるほど、一流の英語テキストが圧倒的に不足しています。WhisperはGoogleの次のステップでした。YouTubeの対話の海を理解し、テキスト生成アプリケーションとして開発されました。AI搭載のこのツールは、100万時間以上のYouTube動画がAIによって監査され、新しいテキスト(本質的には新しい会話)を生成するために使用されており、最先端のモデルから最新のChatGPTチャットボットであるGPT-4に至るまで、AIモデルのトレーニングに利用されています。
一部の従業員が、OpenAIのMicrosoftによる映像がYouTubeからの盗用になると主張したものの、盗用の倫理は依然として議論の余地がありました。さらに、一部の労働者は、YouTubeの意図と正確に整合させることは不可能であると認めています。同様に、AIモデルに供給するために動画からテキストコンテンツを抽出する際にアルゴリズム的に処理することへの異議申し立ての取得は、動画クリエイターの著作権への脅威と見なされ、怒りを招いた可能性があります。
FacebookとInstagramの親会社であるMetaも、Simon & Schusterなどの出版社からの著作権で保護された要素の使用について懸念していました。同時に、一般的なウェブコンテンツの取得についても議論しており、著作権侵害に巻き込まれる可能性がありました。
データの処理:非伝統的なアプローチを推進する
競争に満ちたデータ収集は、データの重要な位置を指摘し、AI技術の開発においてそれを特定するのに役立ちます。AIへの言語入力には、現在ではこれらのソースの外側からWikipediaやRedditまで操作されるコモンウェルスなどのトレーニングデータセットがますます必要とされています。伝統的なデータストアのような一般的なデータソースへの到達に困難を抱えているテック企業にとって、AI搭載モデルの作成は、そのような場合に望ましい代替解決策となり得ます。
テクノロジー企業のデータ収集は、AIトレーニングに必要であると示唆しているが、同じプロセスは法廷で法的に疑問視されている。彼らの防御において、OpenAIおよびMicrosoftは、著作権素材の違法な使用に関する告発に対して勝利した。それでもなお、彼らの行動は公平使用の法的原則の範囲内にあると述べた。近年、著作権保有者によって米国著作権庁に提出された申請の数は10,000件を超えており、これはAI時代の著作権法が独自かつ新規であることを明確に示している。したがって、主要なプレイヤーは常に、AIを使用するモデルにライセンスされた目的がないという偽名の下で、多くの作品の侵害に関連する危険に直面している。
大規模データセットの必要性
全体として、Jared Kaipanのスケールサイエンティストとしての仕事は、AI開発において意図せずとも壮大なものとなりました。データ駆動型のコンテンツはトレーニングプロセスに必要なAIの構成要素の一つですが、適切にトレーニングされ効果的に動作するモデルなしでは機能しません。AI技術の増加に伴い、市場で成功するためのデータへの需要は高い率で高まっており、企業には法、倫理、プライバシーに関する疑問が残されています。したがって、AIアルゴリズムは市場で成功するためにこれらのデータセットを使用しなければなりません。
VIPsのデータ収集行動は、AIの強化のために歪められており、典型的な方法論の誓いは粗雑になっている。YouTubeのトークのいずれかを通じても、合成データ生成の作成を通じても、これらの企業は、法律、倫理、およびプライバシーの問題が真に何であるかを発見するという使命においてリーダーである。
彼らは後に海の上で冗談の的になるかもしれません。イノベーションプロセスを推進するために必要な膨大なデータセットの出現により、社会の指導者は、知的財産権とプライバシーの倫理原則とイノベーションの取り組みのバランスを取るためのルールと基準を開発するために建設的な対話に積極的に参加することが求められています。
元のストーリー:https://www.nytimes.com/2024/04/06/technology/tech-giants-harvest-data-artificial-intelligence.html
暗号通貨のニュースを読むだけでなく、それを理解しましょう。ニュースレターに登録してください。無料です。
免責事項。 ここに提供される情報は取引助言ではありません。 Cryptopolitan.com 当社は、このページに提供される情報に基づいて行われたいかなる投資に対しても責任を負いません。いかなる投資判断を下す前に、独立した調査および/または資格を有する専門家への相談を強く推奨します。

ジェームス・キノティ
暗号通貨愛好家のジェームズは、フィンテック、暗号通貨、ブロックチェーン、そしてフロンティアテクノロジーに関する知識を共有することに喜びを感じています。暗号通貨業界の最新イノベーション、暗号通貨ゲーム、AI、ブロックチェーン技術、その他のテクノロジーが彼の関心の中心です。彼の使命は、さまざまな業界における変革的なアプリケーションの動向を追いかけることです。















