広 告

AIトレンド速報

The Trend Tribune

広 告
2026年8月26日水曜日 朝刊 定価 無料
◆ 本日の主要記事

「36本中34本が盗用」——OpenAIが暴いた、AIで作られた偽シンクタンクの中身

▶ OpenAIが8月25日、ロシア発の秘密工作活動に関連するChatGPTアカウント群を停止したと発表。実在しない専門家シンクタンク「International Burke Institute」の掲載記事36本中34本が盗用だった実態、VPN経由のアクセスとロシア語プロンプトから言語的痕跡を消す指示という隠蔽手口、ロシアを好意的に描く「主権指数」という独自指標、Brookings Breakout Scaleでのカテゴリー3分類、2月のRybar摘発など過去事例との連続性までを解説する。

「36本中34本が盗用」——OpenAIが暴いた、AIで作られた偽シンクタンクの中身
(写真はイメージ)

「36本中34本が盗用」——OpenAIが暴いた、AIで作られた偽シンクタンクの中身

8月25日、OpenAIがロシア発の秘密工作活動を摘発し、関連するChatGPTアカウント群を停止したと発表した。実在しないシンクタンクを装った組織を作り上げ、AIを使って大量のコンテンツを生成し、親ロシア的な言説を拡散していたという内容だ。エンジニアとして興味深いのは、この工作活動が使っていた具体的な手口と、それをOpenAIがどう見破ったのかという調査プロセスだ。

「AI生成コンテンツの調査」から始まった、思わぬ発見

今回の摘発のきっかけは、OpenAI自身がAI生成のソーシャルメディア投稿を調査していたことだった。その過程で、当初想定していたよりもはるかに大規模な、組織的な工作活動の存在が明らかになったという。

工作の中心にあったのは、「International Burke Institute(IBI)」という、イスラエルを拠点とすると自称する「専門家コミュニティ」だった。2025年2月に登録されたこのウェブサイトは、フランシス・フクヤマ氏やノーム・チョムスキー氏といった、実在する著名な学者を含む、幅広い専門家を擁していると謳っていた。

「36本中34本」という、盗用の実態

OpenAIが、IBIのウェブサイトに掲載された専門家関連の記事36本を抽出して検証したところ、そのうち34本が、インターネット上の他の場所からそのままコピーされたものだったことが判明した。時には、誤った著者名を付けて掲載されているケースもあったという。

つまりこの「シンクタンク」は、実質的には存在しない専門知識を、盗用したコンテンツによって、あたかも実在するかのように偽装していたことになる。この組織はさらに、「主権指数(sovereignty index)」という、独自の評価指標を掲げていた。これは、ロシアを好意的に描き、西側諸国を批判するように設計された、恣意的な採点基準だった。フランス、ドイツ、米国、EUに関するレポートは、OpenAIの表現によれば「論争的な域にまで踏み込んでいた」という。

VPNと「痕跡消し」という、二重の隠蔽工作

技術的な観点から見て興味深いのが、この工作を行っていた人物たちが用いていた、身元を隠すための手口だ。OpenAIはロシアからのモデルへのアクセスを許可していないため、運営者たちはVPN(仮想プライベートネットワーク、実際の接続元を偽装する技術)を経由して、サービスにアクセスしていた。

さらに彼らは、ロシア語でプロンプトを入力し、その内容をもとに英語のソーシャルメディアコンテンツを生成させるという手順を踏んでいた。その際、ChatGPTに対して、文章の中にロシア語話者であることを示唆するような、言語的な特徴を意図的に取り除くよう、明示的に指示していたという。生成されたコンテンツは、Substack、Telegram、X、Facebook、LinkedInといった、複数のプラットフォームに投稿されていた。

「訴求力」より「インフラ」に価値がある、という評価

OpenAIの分析で特に示唆に富むのが、この工作活動そのものの実際の影響力についての評価だ。同社は、この工作が実際に到達した読者数という観点では、その影響は限定的だったとしている。

しかし、OpenAIはその重要性を、「到達した読者の規模」ではなく、「構築されたインフラそのもの」にあると位置づけている。偽の専門家、転載された学術研究、独自の(装った)リスク指数を備えた、一見信頼できそうな組織を作り上げるという手法は、今後より大規模な工作活動の土台として再利用される可能性がある。OpenAIは今回の工作を、自社が定める「Brookings Breakout Scale」という分類基準において、カテゴリー3に位置づけている。

過去にも繰り返されてきた、同種の摘発

今回の一件は、OpenAIにとって初めての事例ではない。同社は2月にも、英国政府が「ロシア大統領府と部分的に連携している」と説明する、親ロシア系メディア企業Rybarに関連するChatGPTアカウントを停止したと発表している。2025年6月には、TikTok、Facebook、Reddit、Xといったプラットフォームを横断して活動していた、4件の中国発の秘密工作活動も摘発している。

この種の摘発が繰り返し行われているという事実は、AI生成コンテンツを使った情報工作が、単発の事件ではなく、継続的に発生し続けている脅威であることを物語っている。

エンジニアとして見ておきたいこと

今回の一件が示しているのは、生成AIが、情報工作における「コンテンツ制作のボトルネック」を、劇的に解消してしまうという現実だ。かつては人間のライターやコピーライターを多数動員する必要があった、大量のもっともらしいコンテンツの生成が、今や少人数のオペレーターと、AIモデルへのアクセスだけで可能になっている。

一方で、今回のケースがOpenAI自身によって発見・摘発されたという事実は、プラットフォーム側の監視・検知能力もまた、進化し続けていることを示している。AI生成コンテンツを扱うプラットフォームを運営するエンジニアにとって、この種の「組織的な悪用パターン」を検知する仕組みづくりは、今後ますます重要な設計要件になっていきそうだ。

OpenAIChatGPT情報工作AI安全性サイバーセキュリティ

「21%が全文AI生成」——AI研究最大の学会が直面した、査読システム崩壊の実態

▶ AI検出企業Pangram LabsがICLR 2026の全76,139件の査読レポートを分析し21%(約15,899件)が完全AI生成と判定。2024年から3年で投稿数が2.7倍に膨張した背景、AI生成レビューが低品質論文により高いスコアを与える相関、21分野すべてでp<0.05の統計的有意性を示す「Hivemind効果」、著者苦情58件中50件(86.2%)がPangram判定と一致した独立検証、Sem-Detectとの検出率の乖離(21%対5%)までを研究方法論として整理する。

「21%が全文AI生成」——AI研究最大の学会が直面した、査読システム崩壊の実態

AI検出企業Pangram Labsが、AI分野最大級の国際会議「ICLR 2026」に提出された、全76,139件の査読レポートを分析した結果を公表した。このうち21%、およそ15,899件が、完全にAI生成されたものだったと判定されたという。AI研究者出身のジャーナリストとして、この「AIがAI研究をレビューする」という、皮肉な状況の実態と、その背景を丁寧に見ていきたい。

「7,304件」から「19,814件」へ——3年で3倍近くに膨らんだ投稿数

この問題の背景には、ICLR自体の投稿数の爆発的な増加がある。2024年に7,304本だった投稿論文数は、2025年には11,672本、そして2026年には19,814本へと、わずか3年でおよそ2.7倍に膨れ上がった。

この急増する投稿数を捌くため、ICLRは投稿者自身のプールから、査読者を追加で確保するという運営体制を取ってきた。結果として、学部生が教授と並んで査読を担当するような状況も生まれ、各査読者は厳しい締め切りの中で、複数の論文を割り当てられることになった。この「量をこなすために設計されたシステム」が、皮肉にも、AIによる代行という形での「量産型の対応」を誘発してしまった構図が見えてくる。

AI生成レビューに共通する、いくつかの「特徴」

Pangram Labsの分析によれば、AI生成と判定された査読レポートには、いくつかの共通した特徴があったという。文章が長く、太字の見出しを多用する傾向があり、情報密度が低いというのが、その典型例だ。ある査読レポートは、3,000語にも及ぶ分量で、40個の弱点と40個の質問をリストアップしていたと報告されている。研究者はこれを「網羅的だが、内容の重みを欠く」と表現している。

さらに注目すべきは、AI生成された査読が、論文の実際の質とは無関係に、より高いスコアと相関していたという発見だ。これは、査読者が単にAIを判断の補助として使っていたのではなく、判断そのものを丸ごとAIに委ねてしまっていたことを示唆している。

統計的に検証された「Hivemind効果」

この問題をさらに深く分析した別の研究「Stop Automating Peer Review Without Rigorous Evaluation」は、興味深い統計的な発見を報告している。AI生成された査読同士は、人間が書いた査読同士と比較して、内容が互いに類似する傾向が、統計的に有意に高いという「Hivemind効果(群れ効果)」が確認されたのだ。

この効果は、ICLRの21の主要分野すべてにおいて、統計的に有意(p<0.05)であることが示されている。特に「弱点」と「質問」のセクションに絞ると、効果量(異なるグループ間の差の大きさを示す統計指標)はさらに大きくなるという。つまり、AIが生成する査読コメントは、人間が生み出す多様な視点とは異なり、互いに似通った、画一的な指摘に収束しやすいという傾向が、データによって裏付けられたことになる。

「著者からの苦情」による、独立した検証

この分析結果の信頼性を評価する上で参考になるのが、別の角度からの検証だ。研究チームは、ICLR 2026の全159,775件の著者コメントの中から、査読がAI生成されたものだと著者が訴えているケースを検索し、58件を特定した。

このうち、Pangram Labsが「完全にAI生成」と判定していたものは50件(86.2%)に上り、逆に「完全に人間が執筆」と判定されていたものは、わずか2件(3.4%)にとどまった。これは、著者による主観的な疑念と、AI検出ツールによる客観的な判定が、高い一致率を示したことを意味する、独立した裏付けになっている。

ICLR側の対応と、残された課題

この問題を受けてICLRは、Pangram Labsの発表に先立つ2週間前、開示されていないLLM使用を伴う論文に対する却下措置と、「幻覚を含む査読」を提出した査読者への処分を、既に発表していた。ハルシネーション(AIが事実に基づかない、もっともらしい情報を生成してしまう現象)を含む参照文献についても、GPTZeroという別の検出ツールが、わずか300件のサンプルの中から、50件以上を検出したと報告されている。

もっとも、この種の検出結果の解釈には、慎重さも必要だ。別の検出手法「Sem-Detect」を用いた比較分析では、同じICLR 2026のデータに対して、Pangram Labsの手法とは異なる分布(AI生成21%に対し、Sem-Detectでは5%)が示されており、検出手法自体の精度や前提には、依然として議論の余地が残っている。

研究者として見ておきたいこと

この一連の出来事が浮き彫りにしているのは、AI研究のコミュニティ自身が、自らが生み出した技術によって、その根幹をなす査読システムの信頼性を脅かされているという、構造的な皮肉だ。論文の投稿数が指数関数的に増加する一方で、それを検証する人間の査読者の数は、同じペースでは増やせない。この需給のギャップを埋める形で、AIによる「代行」が、望ましくない形で忍び込んでしまっている。

今後、AI検出技術の精度向上と並行して、査読プロセス自体の設計を、AIの存在を前提とした形に作り替えていく必要があるだろう。人間とAIの役割分担を、どこにどう線引きするのか。この問いへの答えは、ICLRという一つの学会にとどまらず、学術出版のエコシステム全体にとって、避けて通れない課題になっている。

査読AI検出学術研究ICLRAI/ML

「ウサイン・ボルトを超えた」、そして転倒し発火した——北京の記録更新が教えてくれる、本当の意味

▶ 8月25日、北京の第2回世界ヒューマノイドロボット競技会で中国製ロボットが100m走8.86秒という人類記録を上回るタイムを樹立するも、ゴール直後に転倒し発火。3日前の9.39秒からの急速な記録更新、人民日報自身が「家政婦・介護士ロボットはまだパイロット段階」と認めた率直な発言、Digitimesが指摘する競技会と量産化の間にある本質的なギャップまでを懐疑的に検証する。

「ウサイン・ボルトを超えた」、そして転倒し発火した——北京の記録更新が教えてくれる、本当の意味

8月25日、北京で開催された「第2回世界ヒューマノイドロボット競技会」で、中国製のヒューマノイドロボットが100メートル走で8.86秒という、新記録を樹立した。この記録は、ウサイン・ボルト選手が2009年に打ち立てた、人類の男子100メートル世界記録9.58秒を上回るものだ。しかし、この記録を樹立したロボットは、ゴールした直後に転倒し、腰の部分から火花を散らしながら、パッドの付いたバリアに衝突した。ソフト屋として、この光景が象徴する、業界の現在地を見ていきたい。

「3日間で0.53秒」という、急速な記録更新

今回の記録の前には、わずか3日前の8月22日に、9.39秒という記録が既に樹立されていたという。つまり、この競技会が開催されているわずかな期間の中だけでも、記録は急速に更新され続けていることになる。

この「速さ」自体は、確かに驚異的な進歩だ。しかし、ここで冷静に見ておくべきは、100メートル走という単一の、しかも直線的な運動能力の指標が、ヒューマノイドロボット全体の実用性を測る、適切な物差しにはなり得ないという点だ。ロボット工学において、「速く走る」ことと、「複雑で予測不能な環境の中で、安全かつ安定的にバランスを保ちながら動く」ことは、全く異なる技術的課題だ。今回の「転倒して発火した」という結末は、まさにこの2つの課題の間に、依然として大きな溝が存在することを、皮肉にも証明する結果になった。

「五輪スタイルの競技会」という、中国の国家戦略

この世界ヒューマノイドロボット競技会は、2025年に第1回が開催されて以来、2年目を迎えるイベントだ。北京の国家速滑館(2022年の北京冬季五輪のために建設された施設)を舞台に、五輪さながらの形式で運営されている。

このイベントは、単なる技術デモンストレーションの場ではなく、米国との技術覇権競争が激化する中で、中国のロボティクス分野における急速な進歩を、国内外に向けて誇示するための、明確な国家戦略の一環として位置づけられている。中国政府がこの分野に、これまで繰り返し取り上げてきたような、巨額の資金と政策的な後押しを投じてきたことの、集大成的なショーケースと言える。

中国国営メディア自身による、率直な認識

今回の一連の報道で、個人的に最も注目したいのが、中国共産党の機関紙である人民日報自身が示した、率直な評価だ。競技会に先立ち、同紙は「『家政婦』や『介護士』としてのロボットは、まだパイロット段階、検証段階にある」と明記した上で、「(しかし)課題こそが、まさに開発の焦点そのものだ……中国のロボティクス産業は、より高い品質とイノベーションに向けて進化しつつある」と述べている。

これは、派手な競技会での記録更新という「見せ場」の裏で、実用化に向けた本質的な課題が、依然として山積していることを、当の中国側自身が認めている、貴重な発言だ。国家的な威信をかけたイベントの主催国が、あえてこうした慎重な表現を公にすること自体、この分野の実態を評価する上で、重要な参考情報になる。

「量産化」という、次のハードル

現地取材を行ったDigitimesの分析記事は、今回の競技会が投げかけた、より本質的な問いを的確に言い表している。記録破りの短距離走や、人間とロボットのスポーツデモンストレーションといった華やかな側面の裏で、この業界が本当に問われているのは、「ヒューマノイドロボットが、ショーケースの舞台を超えて、実際の生産ラインでの実用段階に到達できるかどうか」だという。

これまで取り上げてきたUnitreeやXPengのような企業が、量産体制の確立に苦心している現状を踏まえると、この指摘は的を射ている。競技会での華々しいパフォーマンスと、工場や家庭で実際に信頼性高く稼働できる実用性との間には、依然として大きな技術的・製造上のギャップが存在する。

ソフト屋として見ておきたいこと

今回の100メートル走の記録更新と、その直後の転倒・発火という一連の出来事は、この業界の現状を、これ以上ないほど象徴的に物語っている。特定の狭いタスク(この場合は直線を走ること)においては、既に人間の能力を上回る性能を発揮できる一方で、その後の安定した停止・減速という、実用上欠かせない基本動作においては、まだ確実性を欠いている。

「ヒューマノイドロボットの能力」を評価する際は、こうした華々しい記録の数字だけでなく、その記録が「どのような条件下で」「どれだけの再現性を持って」達成されたのかを、常にセットで見る必要がある。人民日報自身が認めるように、この業界の本当の試練は、競技場の外側、つまり実際の家庭や介護施設、工場の現場で、これから始まろうとしている。

ヒューマノイド中国北京競技会フィジカルAI
広 告300 × 250