OpenAI、ChatGPTの会話をMetaとGoogleに無断開示か——集団訴訟が提起される
Humans Are Reading Your ChatGPT Chats, Lawsuit Claims
カリフォルニア州在住のSaje Lim氏が、OpenAIのChatGPTに対して自身の健康やビジネスに関する機密クエリを入力したところ、OpenAIがMetaとGoogleの技術をサイトに組み込み、同意なく通信内容を傍受させたとして集団訴訟を起こした。訴状では、Electronic Communications Privacy Act(ECPA)およびCalifornia Invasion of Privacy Act(CIPA)の631条・632条違反が主張され、1件あたり5,000ドルの法定損害賠償と差止命令が求められている。
「平均的な企業は毎週何百回もChatGPTに機密情報を漏洩している」という推計もあるほど、ChatGPTには大量の情報が投入されている。
HNでの議論
13- ticulatedspline
タイトルだけ見てる人向けに言っておくと、そう、当たり前だけど人間が君の会話にアクセスして読んでるんだよ。
この訴訟は、プライバシーポリシーがデータラベリングやモデルトレーニングのタスクを第三者に委託することを明示的に言及していないというギャップを突いている。
俺が見る限り、もし評価作業を委託労働者ではなくOpenAIの従業員がやっていたなら、この訴訟は成立しないだろう。訴訟全体がこの一点のギャップに掛かっているように思える:
> プライバシーポリシーには、ユーザーの個人データを受け取る11種類の外部企業が列挙されている。それにはホスティング、決済、カスタマーサービス、分析、本人確認が含まれる。データラベリング、アノテーション、人間による評価のベンダーは一つもない。
- throwitaway222
これは利用規約でカバーされていると思うよ。訴訟はおそらく勝つだろうけど、負けるべきだ。
必要なのは、あらゆるウェブサイトの利用規約を要約して、実際にそのサイトに接続する前に最もひどい部分をハイライトしてくれるブラウザプラグインだ。
- rcr-anti
この分野の人に純粋な質問なんだけど、トレーニングなしやゼロデータ保持の契約って、本当に有効なのか、それとも表示されてるピクセルほどの価値もないのか?ファーストパーティのものは無価値だと思ってたけど、AWS、GCP、Azure経由でプロプライエタリモデルを提供する場合のものはもっと信頼できるのか?デプロイの形態やアクセスの種類などがわからないから興味がある。