AI検索エンジン「Perplexity」がrobots.txtを無視して情報を収集しているのか、その実態を検証しました。
AIの進化によるデータ利用の倫理や著作権法の再考、新たなビジネスモデルの必要性など、広範な課題を提起しています。
今後、公平な利用と保護のための新たな枠組みを構築するために、AI企業、出版社、法規制当局が協力する必要があります。
記事の概要
AI検索エンジン「Perplexity」がrobots.txtを無視して情報を収集しているのかと指摘されていたが、実際に検証してみるとPerplexityはrobots.txtで拒否されているサイトのURLを入力すると要約を提供することが報告されている。
PerplexityのCEOは同社が意図的に無視しているわけではなく、問題のクローラーはサードパーティのものである可能性があると説明している。
しかし、具体的な対策やサードパーティのクローラー会社の名前については明らかにされていない。
この問題はデータ利用の倫理や著作権法の再考、新たなビジネスモデルの必要性などを提起しており、AI企業、出版社、法規制当局が協力して新たな枠組みを構築する必要があるだろう。
記事のポイント
- Perplexityはrobots.txtを無視して情報を収集している可能性が指摘されている。
- Perplexityは拒否されたサイトのURLを入力すると、そのコンテンツを要約して提供している。
- PerplexityのCEOは、同社が意図的にrobots.txtを無視しているわけではなく、サードパーティのクローラーが問題の可能性があると説明している。
詳しい記事の内容はこちらから(引用元)
AI駆動の検索エンジン「Perplexity」がrobots.txtを無視して情報を収集しているのではないかという指摘が…
https://ascii.jp/elem/000/004/208/4208848/