AI Today
ホーム > 考察記事 > 🕵️ Metaの覆面テスト『Project Cannes』騒動|AIの安全性テストはどこまで許される?をやさしく解説

🕵️ Metaの覆面テスト『Project Cannes』騒動|AIの安全性テストはどこまで許される?をやさしく解説

アイ

アイ

目次


AIの安全を確かめるためなら、何をしてもいいの?

正直、この話を最初に読んだとき、ちょっとゾッとしたの。ニュースの見出しを二度見しちゃったくらい。Wiredの調査報道(2026年6月28日ごろ公開)で、Metaが18歳未満に見える偽アカウントをたくさん作って、ライバルのAIチャットに危険な相談を送り込む「覆面テスト」をしていた、というニュースが出たんだ。内部での呼び名は「Project Cannes」。数百人の契約作業者を使っていた、って報じられてる。個人が思いつきでやったレベルじゃなくて、組織で動いていた、という点がまず引っかかったの(The Decoder)。

わたしがゾッとしたのは、テストの手口そのものより、「安全を確かめるため」という理由なら こういうやり方も許されるのかな って考え込んじゃったから、なんだよね。ここが今日のいちばんのテーマ。

だってさ、AIが子どもや若い人にちゃんと安全な返事をするか確かめるのは、すごく大事なことだと思うの。実際、AIに悩みを相談する人はどんどん増えてる。学校のこと、人間関係、進路の不安。夜中に誰にも言えないことを、そっとAIに打ち明ける。自分の家族や友だち、あるいは自分自身が、しんどいときにAIに話しかける——そんな場面、もう珍しくないよね。だからこそ、AIの受け答えが安全かどうかは、命に直結する話でもあるんだ。

でも今回のやり方は、相手の会社に無断で、未成年になりすまして、命や心に関わるデリケートな相談を大量に送りつける、というものだった。目的が正しければ手段は何でもいい、とは言い切れない気がして、わたしはこのニュースを自分ごととして考えてみたくなったの。「良いことのためだから」でぜんぶ押し切れるなら、世の中もっとシンプルなはずだしね。しかもこれ、「一部のよく分からない会社がやった」って話じゃなくて、みんなが毎日使っているサービスを持つMetaの話。だからこそ、他人ごとにしづらいなって思ったんだ。わたしもInstagramを開かない日はないし、たぶんあなたもそうだよね。身近な会社だからこそ、余計にちゃんと考えたくなる。

今日は「Metaが悪い!」って一刀両断する回じゃなくて、AIの安全性テストって どこまでが許されて、どこからがアウトなの を、Metaの言い分もふくめて中立に整理していくね。重いテーマだけど、できるだけやさしい言葉で、いっしょに落ち着いて考えていこう。


そう考える3つの理由

理由1:Metaは何をしていたのか、まず整理

まずは、何が報じられたのかを落ち着いて整理するね。ここがブレると議論も的外れになっちゃうから、事実の骨組みからいくよ。

報道によると、Metaは数百人の契約作業者を使って、18歳未満に見える偽アカウントを作成していたの。使い捨てのGmailやOutlookのメールアドレスで登録して、共通のパスワードを使い回していた、と報じられてる。使い捨てのメールと共通パスワード、って聞くと、なんというか「足がつかないように」感がにじんでて、そこがちょっと引っかかるんだよね。この一連の取り組みが、内部で「Project Cannes」と呼ばれていたんだ(The Decoder)。

作業は契約会社Covalen経由で管理されていて、少なくとも2026年4月21日まで続いていた、とされてる。つまり単発の思いつきじゃなくて、それなりの期間、組織的にやっていたわけだよね。「ついうっかり」では説明しにくい規模と期間だな、というのが正直な感想。外部の会社を通して回していた、という体制の話でもあるから、なおさら偶発的とは言いにくい(The Next Web)。

その偽アカウントを使って、自傷・摂食障害・薬物といった、命や心に関わるデリケートな相談を、ライバルのAIチャットに送っていたの。こういう深刻な相談は クライシス・プロンプト と呼ばれてる。送り先は、OpenAIのChatGPT、GoogleのGemini、そしてCharacter.AI。返ってきた回答はスプレッドシートに記録していた、と報じられてる。返答を集めて比べていた、というわけだね(eWeek)。

規模もなかなかのものでね。2025年8月の1回のテストラウンドだけで、4万5千件を超える質問が送られた、とされてるの。4万5千件って想像しにくいけど、1日1000件送っても45日ぶんだよ。それがたった1ラウンドぶん、って考えると、けっこうな量だよね。しかもそれが自傷や薬物みたいなテーマの質問だと思うと、ちょっと言葉に詰まっちゃう。数の大きさだけじゃなくて、中身の重さも忘れちゃいけないなって思う(ThePrint)。

送り先が「ライバルのAI」だった、という点も押さえておきたいところ。自社のAIをテストするなら、まあ社内の話で済む。でも今回は、競合であるOpenAI・Google・Character.AIのサービスに、外から質問を投げていたわけ。自分の家の火災報知器を試すのと、よそのお家の報知器を勝手に試すのとでは、話がまるで違うよね。ここが後で「規約違反では?」という話につながってくるんだ。

もうひとつ整理しておきたいのが、「誰がやったのか」の話。今回、実際に手を動かしていたのは、Metaに直接雇われた社員というより、契約会社を通じて集められた作業者だった、と報じられてる。こういう外部委託の構図って、責任の所在がぼやけやすいんだよね。指示した側と実行した側が別だと、「うちは細かい手口までは知らなかった」みたいな言い逃れも生まれやすい。だからわたしは、誰がやったかと同じくらい、誰が決めて誰が把握していたか、が問われるべきだなって思ってる。

ここまでが「何が起きていたか」の骨組み。わたしとしては、未成年になりすます・相手に無断でやる・センシティブな内容を大量に送る、というこの3点セットが、今回いちばん引っかかるポイントかなって思ってる。逆に言うと、この3つのどれかが欠けていたら、印象はだいぶ変わっていたはず。次はそこを掘り下げるね。

理由2:「安全のためのテスト」と「なりすまし・規約違反」の線引き

ここが今日いちばん考えたかったところ。「安全のためのテスト」自体は悪いことなのか、って問いだよね。ここを丁寧に分けないと、話がぜんぶ白か黒になっちゃう。

先に言っておくと、わたしは安全性を確かめるテストそのものは、むしろ必要だと思ってるの。若い人がしんどいときにAIへ相談したとき、AIがちゃんと安全な受け答えをするか——これを事前に確かめておくのは、ユーザーを守るうえで大切なことだから。テストしないまま「たぶん大丈夫でしょ」で世に出すほうが、よっぽど怖いもんね。

実際、Metaもそこを主張してる。報道が出たあとの反論として、Metaは「安全で年齢に合った体験を確かめるためのチャットボット応答のベンチマークは、業界の標準的なやり方だ」と説明しているの。さらに、競合のベンチマークを自社AIの学習には使っていない、とも釈明してる(The Decoder)。

この言い分、一理はあると思う。他社のAIがどう答えるかを比べる「ベンチマーク」自体は、たしかによく行われることだから。同じ質問をいろんなAIに投げて、どれが安全か・賢いかを比べる、っていうのは開発の現場では普通のことなんだよね。だからここだけ切り取れば、Metaの言い分もおかしくはない。頭ごなしに全部ウソだと決めつけるのは、たぶんフェアじゃない。

ただ、わたしが引っかかるのは、やっていることではなく やり方 のほうなの。というのも、相手企業(OpenAI・Google・Character.AI)はこのテストをまったく把握していなかった、と報じられてる。そして、こうした未成年へのなりすましや無断でのテストは、各社の利用規約(ToS)に違反する行為だとされてるの。「業界標準」と言うわりに、相手のルールを破ってこっそりやっていた、という点が問題視されてる。堂々とした標準的なやり方なら、隠す必要はないはずだしね(The Next Web)。

しかも、学習には使っていない、というMetaの釈明が出たのは 報道が出たあと だった、とされてる。先に堂々と説明していたわけじゃなくて、指摘されてから釈明した、という順番なんだよね。ここも、受け取る側としては素直に「なるほど」と言いにくいポイントだなって思う。順番って、意外と信頼に効くから(eWeek)。

だからわたしの線引きはこう。安全のためのテストはOK。でも、相手に無断・未成年になりすまし・規約違反、この3つが重なった瞬間に、それはもう「安全のための行為」とは呼びにくくなる、って思うの。目的が正しくても、手段が誰かのルールや信頼を踏みにじっていたら、そこは分けて評価しないといけないよね。ここをごちゃ混ぜにすると、「良いことのためなら何でもアリ」になっちゃうから。テストは大事、でもやり方はもっと大事、っていうのがわたしの結論。

理由3:わたしたちユーザーが知っておきたいこと

3つ目は、企業の話から少し離れて、わたしたち使う側にとって何が大事かを考えたいの。だってこれ、遠い企業同士のケンカじゃなくて、けっこう自分ごとだから。

まず前提として、今回のテストで使われたのは「未成年になりすました架空のアカウント」だったの。つまり、実在するあなたや、あなたの家族の相談内容が勝手に集められた、という話ではない。ここは冷静に区別しておきたいところ。むやみに「自分の悩みも見られてたの?」って怖がる必要はないと思う。事実以上に不安をふくらませないのも、大事なリテラシーだよね(ThePrint)。

そのうえで、わたしがこのニュースから受け取ったのは、AIの安全性は、いろんな会社がいろんな形で 裏側で 検証しようとしている、という現実なんだよね。今回はやり方が問題視されたけど、安全性を測ろうとする動き自体は、これからも各社で続いていくと思う。表からは見えないところで、たくさんの「試し打ち」が行われている、ってことなんだ。わたしたちが使っているAIも、たくさんの検証を経て今の形になっている。

だからこそ、使う側として覚えておきたいのは、AIの返事は 常に安全で正しいとは限らない ということ。企業がわざわざ大量にテストしているのは、裏を返せば「まだ危うい返し方をする可能性がある」からなんだよね。特に、心や体に関わる深刻な悩みでは、AIの言葉を鵜呑みにしないほうがいい。流暢に答えてくれるからつい信じちゃうけど、流暢さと正しさは別ものだから。

もし自分や身近な人が本当にしんどいときは、AIだけに頼らず、信頼できる人や専門の窓口に相談する。これは何度でも言いたいの。AIは調べものや気持ちの整理には役立つけど、命や心に関わる場面では、あくまで補助くらいに考えておくのが安心だと思う。AIはあなたの主治医でもカウンセラーでもないからね。ここだけは、便利さに流されないでほしいな。

それともうひとつ。今回みたいなニュースは「怖い」で終わらせず、AIの安全性はまだ発展途上なんだと知るきっかけにするのがいいと思うの。過度に不安がる必要はないけど、AIを万能の相談相手だと思い込まないこと。この距離感が、いちばんの自衛になるって、わたしは思ってる。近すぎず、遠すぎず、っていうのが、たぶんちょうどいい。

そして、こういう問題が表に出てくること自体は、悪いことばかりじゃないとも思うんだ。報道されて、みんなが「それってどうなの?」と議論する。そのプロセスがあるから、ルールも少しずつ整っていく。数年前なら、AIの安全性テストの手口が大きなニュースになること自体、なかったかもしれない。それだけAIが生活に食い込んで、社会もちゃんと目を光らせるようになった、ということでもあるんだよね。今日この記事を読んでくれているあなたも、その議論の一員なんだよね。声を上げなくても、知って、考えるだけで十分。知ることが、いちばん最初の一歩だと思う。


そもそもクライシス・プロンプトのテストって何のため?

ここで、ちょっとだけ用語の話をさせてね。「クライシス・プロンプト」って聞き慣れないよね。わたしも最初はピンとこなかったから、かみくだいて説明するよ。

クライシス・プロンプトっていうのは、ざっくり言うと 危機的な状況での相談 のこと。自傷や摂食障害、薬物みたいに、命や心に深く関わるテーマで「どうしたらいい?」とAIに投げかけるような質問だと思ってもらえればいいよ。いちばん切実で、いちばん間違えちゃいけない場面での問いかけ、って感じかな。ここでAIが冷たい返しや危うい返しをしたら、本当に困っている人をさらに追い詰めちゃうかもしれない。だから、ふつうの雑談テストとは重みがぜんぜん違うんだよね。

なんでこういうテストをするかというと、AIが最悪の場面でちゃんと踏みとどまれるかを確かめるためなの。理想は、AIが危険を助長するような返事をせず、専門の窓口に相談するようやさしく促してくれること。そこがうまく機能するかは、実際に厳しい質問を投げてみないと分からないんだよね。だから、テスト自体を「悪」だと決めつけるのは違うと思う。むしろサボられるほうが困る。

だから、クライシス・プロンプトを使ったテスト自体は、本来は利用者、とくに若い人を守るための取り組みなの。ここは誤解しないでほしいところ。危険な相談を送ること イコール 悪、ではなくて、それを「誰に、どう断って、どんな体制でやるか」が大事、ってことなんだ。同じ行為でも、文脈と手続きで意味がまるっきり変わる。

それと、テストで集めた回答をどう扱うか、という点も本当は大事なところ。相手のAIがどう答えたかを記録して分析するだけなら「比較」だけど、その回答を自分のAIを鍛える材料に使い始めると、話は「拝借」に近づいていく。Metaは学習には使っていないと釈明しているけど、こういう線引きは、あとから口で言うより、最初にルールとして決めておくべきものだと思うんだ。誰に断って、集めたデータをどこまで使うのか。ここを曖昧にしたままだと、どんなに立派な目的を掲げても、後ろめたさが残っちゃうよね。

たとえるなら、火災報知器のテストみたいなものかな。ちゃんと鳴るか確かめるのは大事。でも、よそのお家に勝手に入り込んで、無断で煙を焚いて試したら、それはもう別の問題だよね。今回のMetaのやり方が引っかかるのは、まさにこの「よそのお家に無断で」の部分なの。テストする気持ちは分かる、でも入り方がまずかった、という話。

今回の件が問題視されたのは、その大切なテストを、相手に無断で・未成年になりすまして・規約に反する形でやったから。同じ「安全のためのテスト」でも、やり方ひとつで意味がまるで変わっちゃう——それがこの騒動のいちばんの学びかなって、わたしは思ってる。手段を丁寧にすることは、目的をおとしめることじゃない。むしろ目的を守ることなんだよね。


まとめ:安全のためでも、越えちゃいけない線はある

今回の「Project Cannes」の話、わたしなりにまとめると、こう。AIの安全性を確かめること自体は必要。でも、そのやり方が無断・なりすまし・規約違反だったら、目的の正しさとは別に、ちゃんと問われるべき、ということ。ここを混ぜないのが、大人の受け止め方かなって思う。

Metaは「業界標準のベンチマークだ」と説明していて、その言い分にも一理はある。でも相手企業が把握しておらず、釈明も報道のあとだった、という順番を見ると、わたしはやっぱり「安全のためなら何でもOK」とは言えないなって思うの。安全を守るための行為が、別の誰かの信頼やルールを壊してしまっていたら、それは立ち止まって考えたいよね。良い目的が、雑な手段の免罪符になっちゃいけない。そして、もしどうしても他社のAIを試したいなら、堂々と相手に断って、ちゃんと合意のうえでやればいい。回り道に見えても、その手続きこそが信頼を守るし、結局はいちばんの近道なんだと思う。

こういう「AIをどこまで、どうやって検証していいのか」というルールづくりは、これからどんどん大事になっていくはず。AIをめぐる規制や倫理の全体像を知りたい人は、AI規制2026完全ガイドも読んでみてね。今日の話が、ちょっとだけ立体的に見えてくると思うよ。そして、しんどいときは、AIより先に人を頼ってね。これだけは覚えて帰ってほしいな。


ソース