ChatGPTの会話、実は人間が読んでるって知ってた?開発者が知るべきプライバシー設定とモデル改善の裏側

ChatGPTの会話、人間が読んでいるってホント?
Web制作やAI開発に携わる皆さん、ChatGPTの利用はもはや日常の一部になっているのではないでしょうか。しかし、その裏側であなたの会話がどのように扱われているか、深く考えたことはありますか?最近の調査で、OpenAIが数百人もの契約社員を雇い、ユーザーのChatGPT会話を読んでモデル改善に役立てていることが明らかになりました。
この事実を知って、「え、マジで!?」と思った方もいるかもしれません。特に、機密性の高い情報や個人的な内容をChatGPTとやり取りしている場合、不安を感じるかもしれませんね。
モデル改善のための人間レビューの実態
404 Mediaの調査によると、OpenAIは数百人の契約社員を雇い、実際のChatGPTユーザーとの会話を読み込み、チャットボットの応答を改善しています。これらのレビュー担当者は、ChatGPTの応答を1から7のスケールで評価し、モデルの過度な賞賛や人間らしい振る舞いを減らすよう指示されています。
驚くべきは、一部のユーザーがChatGPTに「内容を秘密にしてほしい」と明示的に要求している会話も、レビュー対象となっていたことです。レビューされるプロンプトは匿名化されているものの、機密性の高い個人データが含まれる可能性があるとのこと。OpenAIはプライバシーフィルターを使用していますが、間違いが起こる可能性も認めています。
レビュー担当者は、Crossing Hurdlesを通じて募集され、AIトレーニング企業Mercorを通じて報酬を受け取っています。北米を拠点とするあるレビュー担当者は、時給50ドル以上を稼いでいると語っています。
開発者が知るべきプライバシー設定:どう使う?
では、私たち開発者はこの状況にどう対応すれば良いのでしょうか?OpenAIは、ユーザーが自分のチャットがモデルトレーニングに使用され、潜在的に人間に読まれることを停止するための設定を提供しています。
- 「Improve the model for everyone」設定をオフにする:これはデフォルトで有効になっていますが、オフにすることで、新しい会話がモデルトレーニングに使用されなくなります。
- 一時チャットモードを利用する:OpenAIによると、このモードでは入力データがモデルトレーニングに使用されません。
これらの設定は、特に開発中のプロジェクトに関する機密情報や、クライアントの個人情報などを扱う際に重要です。WebサービスにChatGPTを組み込む場合など、ユーザーのプライバシー保護を考慮する上で、これらの設定の存在は必須知識と言えるでしょう。
OpenAIの開示は十分か?他社の状況は?
OpenAIは、人間によるレビューについて、FAQページで「承認された担当者およびサービスプロバイダーがモデルのパフォーマンスを改善するためにユーザーデータを閲覧する可能性がある」と説明し、機密情報の入力は避けるようアドバイスしています。しかし、404 Mediaは、この開示が「隠されすぎていて曖昧」だと指摘しています。
「Improve the model for everyone」という表現も、ユーザーにとっては「友好的なコミュニティへの貢献」のように聞こえ、人間が会話を読むことへの同意とは受け取られにくいかもしれません。しかし、AIラボにとって、このような人間によるフィードバックはモデル改善の重要な要素であり、この慣行は広く行われています。
例えば、Anthropicも404 Mediaに対し、Claudeの応答をチェックし、将来のモデルを改善するために人間レビューアを使用していることを確認しています。これは、「Help improve our AI models」がプライバシー設定でオンになっているユーザーに適用されます。Anthropicも、人間によるレビューの前に、メールアドレスなどのアカウント詳細を削除して会話を匿名化しています。
まとめ:プライバシーとAI進化のバランス
AIの進化には、人間によるフィードバックが不可欠である一方で、ユーザーのプライバシー保護とのバランスが常に問われます。私たち開発者は、これらの事実を理解し、適切なプライバシー設定を活用することで、より安全かつ効果的にAIツールを使いこなすことができます。
特に、WebサービスやアプリケーションにAI機能を組み込む際には、ユーザーへの情報開示やプライバシー設定の選択肢を明確にすることが、信頼構築において非常に重要となるでしょう。今回の情報が、皆さんのAI開発やWeb制作の一助となれば幸いです。

