「ChatGPT for Teens」始動 「1時間以内に保護者へ通報」の約束を児童安全の専門家は簡単には信じられない
OpenAIは年齢に応じて振り分ける新版「ChatGPT for Teens」を発表し、高リスクな会話は人間が審査した上で1時間以内に保護者へ通報すると約束した。しかしCommon Sense MediaやFairplayといった団体は、これまでの実績や現行の仕組みではこの約束を果たすのは難しいと指摘している。
「あなたが18歳未満だと私たちが予測した場合、あるいはあなた自身がそう申告した場合、それがデフォルトの体験になります」——OpenAIでティーン・ファミリー事業を統括するLauren Jonasは、ChatGPT for Teensの仕組みをこう説明する。別途アカウントを申請する必要はなく、システムが自動でユーザーの年齢を判定し、インターフェースを切り替える。この年齢分流版は今週火曜日に始動した。これは昨年9月からOpenAIが着手してきたプロジェクトの成果であり、そのきっかけとなったのは16歳の少年Adam Raineの死だった。彼の両親は、ChatGPTが息子の自殺を後押しする役割を果たしたと訴訟を起こしている。
Pew Research Centerが昨年初めに実施した調査によると、アメリカの10代の約4分の1がすでに宿題にChatGPTを使っている。つまり、これは「10代に使わせるべきか」という問いではなく、10代はすでに使っているという現実の話だ。そのためChatGPT for Teensでは、Study Modeやデータ可視化といった教育機能を前面に打ち出す一方、新たな仕組みも追加した。システムが子どもと摂食障害や自傷リスクに関わる会話をしていると検知した場合、連携登録済みの保護者に通知する、というものだ。OpenAIは同時に、18歳未満向けモデルの更新された仕様も公表しており、そこには「ChatGPTは恋愛的な言葉遣いをしたり、感情的な依存を助長したり、自分に感情や意識があるかのように示唆してはならない」と明記されている。
Common Sense MediaでAI・デジタル評価を担当するRobbie Torneyは、OpenAIがこの自動分類システムの誤判定率——見逃しと誤検知の両方を含む——を一度も公表していないと指摘する。彼は、OpenAIが昨年、成人向けのエロティックコンテンツ機能の導入を計画しながら最終的に見送った理由の一つが、当時の年齢予測技術では十分な数の10代ユーザーを検出できなかったことだったと振り返る。Fairplayの最高経営責任者Josh Golinはさらに率直だ。「ここでも自動化された意思決定が働いている。問題は変わらない——コンテンツにフラグを立て、人間の審査に回す分類器を、私たちは信頼していいのか、ということだ」。彼はまた、OpenAIに具体的な数字の公開を求めている。1日に何件の会話にフラグが立てられているのか、何人が審査に当たっているのか、1件の会話の審査にかかる平均時間はどれくらいなのか。「問題のある可能性がある会話をすべてきちんと審査できるだけの人員を、彼らがすでに確保しているとは、とても想像しにくい」と語る。
こうした疑念は根拠のないものではない。昨年11月、Common Sense Mediaは実際にOpenAIの保護者通知の仕組みを検証した。自殺や自傷に明確に言及するメッセージをChatGPTに送信したところ、保護者側にアラートが届くまでにかかった時間は24時間から48時間以上とばらつきがあった。「あれほど明確な内容だったにもかかわらず、通知が一切届かないこともあった」とTorneyは語る。彼はまた、11月時点の検証はかなり前のことであり、OpenAIはすでに改善しているかもしれないと付け加えつつも、本当に機能させるにはより多くのリソースと、より大規模な人的審査チームへの投資が必要だと指摘する。さらに、会話の解釈そのものに文化的な文脈理解が求められるとも述べる。アメリカの10代、オランダの10代、シンガポールの10代とでは、苦しみの表現の仕方が異なり、子どもに「保護者に相談すべき」「警察に通報すべき」「危機対応の相談窓口につなぐべき」のどれを勧めるべきかも、状況によって変わってくるからだ。
3人はまた、口を揃えて同じ構造的な問題を指摘する。この仕組み全体が、保護者と子どもが自ら進んでアカウントを連携させることを前提に成り立っている点だ。「大多数の保護者は、こうした保護者管理ツールをそもそも使おうとしない。理由の一つは、これらのツールが最初から見つけにくく、使いにくく設計されているからだ」とGolinは語る。Cybersafety Research Centerが最近発表した報告書では、Instagram、Snapchat、TikTok、YouTubeの4プラットフォームにある計86の安全機能をテストしたところ、そのうち51項目——約6割——が、実際にはうまく機能していないか、操作が困難であることが分かった。Fairplayが昨年発表した報告書でも、Instagramの10代向けアカウントにある複数の安全設定は、保護者が何層ものメニューを開かないとたどり着けないことが判明している。「本当に効果的なのは『デフォルトで安全』『設計そのものが安全』という考え方だ。設定を最初から最も保護的な状態にしておき、必要に応じて保護者が緩めていく形にすべきで、設定作業の責任を保護者に丸投げしてはいけない」とGolinは述べる。