人工知能モデルの開発に使用される大規模データセットは、数百万冊の書籍、論文、その他の出版物を含む。だが、これらの出版物の多くが著作権者の承諾や許可なく利用されていると指摘されている。この状況は著作権侵害と見なされている。
しかし専門家によれば、事態はそれほど単純ではない。著作権法は人工知能技術が登場した1976年以降更新されておらず、裁判官はこの新たな事例への対応に苦慮している。
フェアユース(公平使用)法は、著作権素材を無許可で使用できる場合を規定している。しかし、これらの法規が人工知能モデルにどのように適用されるかは不明である。
