404Mediaの調査によると、OpenAIは数百人の契約労働者を雇って、本物のChatGPTユーザーとの会話を審査し、モデルの返答品質を向上させています。リークされた内部文書や情報提供者の発言によると、審査担当者はChatGPTが生成する返答を1〜7点で評価しており、特にモデルが過度に気遣いすぎたり、過度に人間のように振る舞う問題を減らすことに重点を置いています。

一部の専門家は、ユーザーが自分のチャット履歴が実際には人間によって読まれていることを知らないと指摘しています。匿名化処理された会話にも敏感な個人情報が含まれる可能性があり、OpenAIはプライバシーフィルタを導入していますが、その誤判定の可能性も認めています。

OpenAI,ChatGPT,人工知能,AI

報道によると、これらの契約労働者はCrossing Hurdlesによって採用され、AIトレーニング会社であるMercorが給与を支払っています。北米地域のコメントでは、この作業の時給が50ドル以上だとされています。現在、OpenAIは「すべての人にとってモデルを改善する」設定をデフォルトで有効にしており、ユーザーはこのオプションを無効にすることで、新しいチャット記録がモデル訓練や関連する人間による審査に使用されないようにできます。一時的なチャットモードでは、入力データを使用してモデルをトレーニングしません。

注目すべきは、OpenAIが最近になって初めて人間による審査メカニズムを明らかにしたわけではないということです。少なくとも2023年から、FAQには権限を持つ従業員やサービス提供者がユーザーのデータを見ることができる旨が記載されており、ユーザーに機密情報の入力を避けるよう推奨しています。404Mediaは、この説明がやや控えめであり、ユーザーが人間による審査の実際の範囲を直感的に理解するのが難しいと指摘しています。

人間からのフィードバックは、大規模なモデルの最適化において重要な役割を果たしています。Anthropicも、関連するプライバシー設定が有効になっているClaudeの会話に対して人間による審査を行っており、審査前に匿名化処理を行っています。グーグルも一部のGeminiのチャット記録を人間の審査員が確認することを許可しています。今回の出来事は、AIモデルのトレーニング効率とユーザーの個人情報のプライバシーのバランスの重要性を再び浮き彫りにしています。