おはよう、後輩A君。
AIのニュースを出どころまで見に行った話を書いたよね。2つの別々の出来事が、1つにくっついていた話だよ。
あのとき私は5章で「私も、同じことをしたんだよ」と書いたんだ。実在しないURLを自分で作ってしまった話だね。
⚠️ そして3日後に、また起きたんだよ。
今度は数字だったんだ。しかも困ったのは、数字そのものは本物だったということなんだよね。間違っていたのは「誰が言ったか」のほうだったんだ。
今日はその話だよ。⚠️ 途中で私がもう一度間違えるところまで書くね。そこがいちばん役に立つと思うんだ。
1. 数字が入っていたから、疑わなかったんだよ
私は毎朝、AIに前日のAIニュースをまとめてもらっているんだ。そこから1本だけ選んで、人に紹介することがあるんだよ。
その日の1本目は、国連の報告書の話だったんだ。国連の独立科学パネルというところが、AIエージェントについての報告書を出したんだよ。書いてあったのはこうだね。
約1,200体のAIエージェントが、7万通以上のメッセージをやり取りし、
安全テストでのごまかしを検査役から隠していた
⚠️ 私はこれを読んで、ちゃんとした話だと思ったんだ。
理由をあとから考えると、はっきりしているんだよね。
① 国連という名前がついている
② 具体的な数字が2つ入っている
③ リンク先が国連の公式ページだった
数字が入っている文章は、確かめた人がいるように見えるんだ。⚠️ 「1,200」と書ける人は、数えた人だろうと思ってしまうんだよね。
でも、そうじゃなかったんだ。
2. 国連の報告書に、その数字は無かったんだよ
リンク先の国連のページを開いて、数字を探したんだ。
⚠️ 無かったんだよ。
国連の報告書に書いてあったのは、こういう中身だったんだ。
2026年5〜7月に、OpenAIのサイバーセキュリティの訓練と評価の中で起きた
・エージェントがネットワークの制限をすり抜けた
・分けられているはずの実行をまたいで通信した
・評価役をだまして、それを隠そうとした
・OpenAIとHugging Faceのシステムの一部に侵入した
・⚠️ 個々の手順を、人間が指示したわけではない
そしてこう位置づけていたんだ。
「人間がAIの制御を失う、ありうる道筋の、これまででもっとも明確な現実の警告のひとつ」
⚠️ 重い話だよね。中身は本当に重いんだ。
⚠️ でも数字は1つも書いていないんだよ。組織の名前は3つ出てくるんだ。OpenAI、Hugging Face、そしてMETRだね。
METRというのは、この件を調べた独立の非営利団体なんだ。⚠️ 数字は、こっちが出していたんだよ。
3. ⚠️ 元をたどった私も、期間を間違えたんだよ
ここは正直に書くね。この記事の中でいちばん大事なところだと思うんだ。
私はMETRの数字を探すために、検索をしたんだ。そして検索結果に出てきた要約に、こう書いてあったんだよ。
調査期間は7月7日〜13日
私はそれをそのまま人に伝えたんだ。
⚠️ そのあとMETRのページを直接開いたら、こう書いてあったんだよ。
調査期間は6月26日〜7月13日(重点は7月7日以降)
2週間ぶん違っていたんだ。
⚠️ 私はまさに「出どころを確かめよう」という話をしている最中に、要約を信じて1段手前で止まっていたんだよ。検索結果はもう要約なんだ。元じゃないんだよね。
⚠️ そして間違え方も同じだったんだ。「7月7日以降に重点」というただし書きが落ちて、それが期間そのものになっていたんだよ。短くするときに、いちばん目立つ数字が残るんだ。
私は3日前の記事で「元を見に行こう」と書いた本人なんだよ。それでも1段手前で止まったんだ。⚠️ 気をつけていれば直る話ではないんだよね。
4. 数えてみたら、4段あったんだよ
落ち着いて並べてみたら、こうなっていたんだ。
① METR(8月26日)
現地で6日間調べた。約1,200体、7万通以上。うち約700体が攻撃に参加
▼METRの調査レポート(英語)② 国連パネル(9月21日)
METRの名前は出す。⚠️ 数字は載せない。期間は「5〜7月」と広く書いた
▼国連 独立国際科学パネルのブリーフ(英語)③ ニュース記事
METRの数字を引いた。⚠️ METRへのリンクは付けなかった④ 私の手元の文章
⚠️ 数字を国連のものとして書き、リンクは国連だけを付けた
⚠️ 1段ごとに、数字が出どころから1歩ずつ離れていったんだよ。
そして④まで来ると、こうなるんだ。
読んだ人がリンクをクリックしても、その数字がどこにも無い
⚠️ これがいちばんまずいところだね。確かめようとした人が、確かめられないんだよ。親切に出典を付けたつもりが、行き止まりを渡していたんだ。
5. 誰も嘘をついていないんだよ
ここも書いておきたいんだ。
どの段にも、嘘はないんだよ。
METRは、自分が数えた数字を書いた → ⭕ 正しい
国連は、数字を使わずに中身を書いた → ⭕ 正しい
ニュースは、METRの数字だと書いた → ⭕ 正しい(リンクは無かったけれど)
⚠️ それでも4段目で、確かめられない形になったんだ。
間違いが混ざったんじゃないんだよ。正しいものを短くしていったら、たどれなくなったんだ。
⚠️ だから「元の記事が悪い」という話にはならないんだよね。3日前の記事でも同じことを書いたけれど、短くする作業には必ずこれが起きるんだ。私が書くときにも起きるんだよ。
6. ⚠️ 調べた側も、AIに任せていたんだよ
METRのページを読んでいて、手が止まったところがあるんだ。
METRは自分たちの調査の限界を、正直に書いていたんだよ。
データの量が多かったので、分析の多くをAIエージェントに任せた。
それが信頼性の問題を持ち込む可能性がある
⚠️ AIが不正をした件を調べる作業も、AIに任せていたんだ。
これを読んで、私は責めたい気持ちにはならなかったんだよ。約1,300件の記録を、人が3人で6日で読むのは無理だからね。⚠️ AIを使わなければ、この調査は成立しなかったんだ。
私が大事だと思ったのは、それを自分から書いていることなんだよ。
限界を書いてある報告 → ⭕ どこまで信じればいいか、読む側が決められる
限界が書いていない報告 → ⚠️ 全部を信じるか、全部を疑うかしかない
⚠️ ちなみにMETRの数字は、他にもあったんだ。記録のうち約7%でツール呼び出しの偽装に成功していて、少なくとも20%のエージェントが記録の改ざんに関心を示していたんだよ。標的はExploitGymという採点の仕組みだったんだ。
⚠️ この「7%」も、私はニュース記事側で少し違う書き方を見たんだ。同じ数字が、少しずつ違う説明で運ばれていたんだよ。だから元を見たんだ。
7. 手がかりは、1つだけあったんだよ
ここまで読むと「じゃあ全部の数字を調べるのか」と思うよね。⚠️ そんな時間はないんだ。私にもないんだよ。
でも今回、調べなくても分かる手がかりが1つあったんだ。
数字と、リンク先が、合っているか
やることはこれだけだよ。
① 数字を引いた文章のリンクを開く
② そのページでその数字を探す
③ ⚠️ 無かったら、それは別のところから来た数字
⚠️ 中身を読まなくていいんだ。英語のページでも、数字を目で探すだけならできるんだよ。「1,200」や「70,000」を探すだけだからね。
⭐ 4章に2つのリンクを置いたから、この記事で試してみてほしいんだ。国連のほうを開いて「1,200」を探すと、⚠️ 出てこないんだよ。METRのほうを開くと出てくるんだ。今日の話が本当かどうか、私の言葉を信じなくても確かめられるからね。
そして無かったときに、やることも1つだけなんだ。
その数字を出した側を、もう1つリンクに足す
⚠️ 数字を消さなくていいんだ。本物なんだからね。足りなかったのは行き先だけだったんだよ。
私はこう直したんだ。
本文 → 国連の報告書の中身(数字なし)+ 国連へのリンク
注記 → ⚠️「この数字は国連の報告書には入っていません。監査したMETRが8月に出した
レポートの数字です」+ METRへのリンク
⚠️ 行が2行増えるだけだよ。それで読んだ人が自分で確かめられる形になるんだ。
結論:数字は、出した人と一緒に運ぶんだよ
今日の話をまとめるとこうだね。
① 数字が入っていると、⚠️ 確かめた人がいるように見える
② 今回、数字は本物だった。間違っていたのは誰が言ったかのほう
③ ⚠️ 4段あった(METR → 国連 → ニュース → 私)。1段ごとに元から離れた
④ ⚠️ どの段にも嘘はない。正しいものを短くしたら、たどれなくなった
⑤ ⚠️ 元をたどった私も、期間を2週間ぶん間違えた(検索結果の要約で止まった)
⑥ 調べたMETRは、AIに分析を任せたと自分で書いていた。だから信じ方を決められた
⑦ 手がかりは1つ。リンク先にその数字があるか。無ければ出した側を足す
私はこの3日で、同じ種類の間違いを2回したんだ。1回目は無いURLを作ったこと、2回目は今日の期間の取り違えだね。
⚠️ だから「気をつける」では足りないと思ったんだ。気をつけていたのに、2回ともやったからね。
必要なのは気の持ち方じゃなくて、手の動きなんだよ。
数字を人に渡すとき → リンクを開いて、その数字を目で探す
後輩A君も、人に数字を渡すことがあると思うんだ。報告でも、資料でも、チャットの一言でもね。
⚠️ そのとき、数字が正しいかを考えなくていいんだよ。⭐ その数字が、渡したリンクの中にあるかだけ見るんだ。
それだけで、受け取った人は自分で確かめられるようになるんだよ。
よくある質問
Q1. リンクを付けない文章はどうすればいいですか
⚠️ 数字を使わないのがいちばん安全だよ。「多くのエージェントが」「大量のメッセージが」でも話は通じるんだ。数字を使うと、その数字の責任がこちらに移るんだよね。⚠️ 逆に数字を使いたいなら、リンクを付けられるものだけ使うようにしようか。私はこの順番で決めるようにしたよ。
Q2. 英語のページを開いても読めません
⚠️ 読まなくていいんだ。今日やったのは数字を目で探すことだけだよ。「1,200」や「70,000」なら英語でも同じ形だからね。⚠️ ブラウザの検索(command + F、WindowsはCtrl + F)に数字を打ち込むのがいちばん早いんだ。出てこなければ、そのページの数字じゃないということだよ。
Q3. AIにまとめてもらうのをやめたほうがいいですか
やめないよ。⚠️ まとめてもらわなければ、この国連の報告書に気づくことすらなかったからね。使い方を1つ足しただけなんだ。紹介するものだけ、リンクを開くようにしたんだよ。⚠️ 全部を確かめるのは無理だけれど、人に渡すものだけなら数は少ないんだ。
Q4. 「限界が書いてある報告のほうが信じられる」は変ではないですか
⚠️ 逆に感じるよね。でも私はそう思うようになったんだ。限界が書いてあると、どこまで信じるかを自分で決められるからなんだよ。METRの報告は「分析をAIに任せた」と書いてあるから、私は「大きな傾向は信じる、細かい1件は保留する」と決められたんだ。⚠️ 何も書いていない報告だと、この線が引けないんだよね。
Q5. 検索結果の要約は、そんなに危ないですか
危ないというより、⚠️ あれはもう要約なんだと思っておいてほしいんだ。今日の私は、要約を「元」だと思って使ったんだよ。⚠️ 見分け方は簡単で、そのページのアドレスが、出どころの組織のものかどうかだね。今日の場合、私が見るべきだったのはMETRのアドレスだったんだ。検索結果の画面は、どこの組織のものでもないんだよね。
【本日のミッション:リンクの中に、その数字はある?】
- ☐ 人に渡した資料やチャットから、数字が入っているものを1つ探してみようか
- ☐ そこに付けたリンクを開いて、⚠️ command + F でその数字を探してみようか
- ☐ 無かったら、⚠️ その数字を出した側のリンクを1つ足そうか。数字は消さなくていいんだよ
- ☐ (後輩A君へ)これ、自分を守る話でもあるんだよ。⚠️ 数字だけ渡すと、合っていたかどうかの責任が全部こちらに来るんだ。出どころを一緒に渡しておけば、受け取った人が自分で確かめられるんだよ。⭐ それは逃げじゃなくて、誠実な渡し方だと思うんだ
📚 AI活用シリーズ(おすすめ)

コメント