Claudeを使った研究者がOpenAIの社員アカウントに到達 見えた「AIで探す攻撃」の現実
Claude(クロード)
Anthropicが作る、文章や作業を助けるAI。
バグ報奨金制度(バグほうしょうきんせいど)
外部の研究者が安全上の問題を報告し、報酬を受け取れる仕組み。
内部リポジトリ(ないぶリポジトリ)
会社のソフトウェアのコードを保管する、関係者向けの場所。
何が起きたか
Anthropic(Claudeを作るAI会社)のClaudeを手伝いに使った、Hacktron(安全の弱点を調べる研究チーム)の3人が、OpenAI(ChatGPTを作るAI会社)のシステムを調べました。複数の報道によると、研究者はOpenAIの社員アカウントへ入れる複数の弱点をつなぎ、社内の内部リポジトリまで到達できることを示しました。内部リポジトリとは、会社のコードを保管する場所です。最初の発見から到達までの時間は72時間未満だったといいます。研究はOpenAIのバグ報奨金制度の中で行われ、問題を知らせた後、研究チームは6500ドルの報酬を受け取ったと報じられています。TechCrunchの報道、The Vergeの報道、Ars Technicaの報道が、この経緯を伝えています。
背景:Claudeはどう使われたのか
今回のClaudeは、研究者が調査を進めるための道具でした。報道では、研究者が問題を整理し、試し、結果を確かめる作業をClaudeに手伝わせたと説明されています。TechCrunchによると、研究者は以前のClaudeの版ではうまく進まず、新しい版では同じ課題を解けたと話しています。ただし、どこまでAIが自動で進め、どこから人が判断したのかは、公開情報だけでは細かく分かりません。
この調査は、OpenAIのバグ報奨金制度を通じて行われました。外部の研究者が安全上の問題を見つけ、会社へ知らせる仕組みです。問題を隠して利用するのではなく、発見、確認、報告、修正へつなげるための窓口です。
なぜ重要か
重要なのは、1社に弱点があったという事実だけではありません。AIが、これまで多くの時間や経験を必要とした安全調査を速める可能性が見えたことです。AIは攻撃側の調査にも、防御側の点検にも使えます。便利さが増すほど、使う人の技術だけでなく、会社側の監視や権限管理も重要になります。
社員アカウントは、1つのサービスだけにつながっているとは限りません。そこから別の社内サービスやコード置き場へ進める場合があります。だから、アカウントごとの権限を絞り、外部ソフトを更新し、第三者にも確認してもらうことが大切です。ただし、今回の報道が示すのは内部コード置き場へ到達できたことです。秘密のコードが大量にコピーされたと確認されたわけではありません。
確認できたこと
複数の報道で一致しているのは、3人の研究者がClaudeを使い、OpenAI社員のアカウントに到達し、内部コード置き場へ届くことを示したことです。研究者はOpenAIへ報告し、6500ドルの報酬を受けました。OpenAIは問題を修正したと説明し、経路に関係した外部のフォーラムソフトも修正を出したと報じられています。現時点で確認できるのは、バグ報奨金制度の下で行われた調査です。
まだ分からないこと
研究者が実際にどのファイルを見たのか、何かをコピーしたのかは明らかではありません。関係した社員アカウントの数や、利用できた範囲も詳しく公開されていません。同じ種類の弱点が他社にあったのか、修正後に第三者が安全を確かめたのかも不明です。こうした点が分からないまま、今回の調査を大規模な攻撃と同じものとして扱うことはできません。
次に見る点
今後は、AI会社が社員アカウントの権限をどう管理するか、外部ソフトをどの頻度で点検するかが焦点になります。AIを使った安全調査をバグ報奨金制度でどう扱うかも課題です。修正を発表するだけでなく、時間を置いて独立した検証を受ける仕組みが広がるかにも注目したいところです。
今回のニュースが示すのは、AIが攻撃にも防御にも使えるという両面です。Claudeは弱点を探す手助けになり、その発見は修正にもつながりました。AIが強くなるほど、人が目的と範囲を管理し、問題を早く直す責任も大きくなります。
Claudeを使った研究者が、OpenAIの社員アカウントに入れる弱点を発見
📰 しっかり版: Claudeを使った研究者がOpenAIの社員アカウントに到達 見えた「AIで探す攻撃」の現実
AIは便利な助手ですが、安全の弱点を見つける力にもなります。
バグ報奨金制度(バグほうしょうきんせいど)
安全の問題を見つけた人に、会社が報酬を出す仕組み。
社内コード置き場(しゃないコードおきば)
会社のソフトウェアのコードを置く場所。
💡 ようするに
- Claudeを使った3人が、OpenAIの社員アカウントへ入れる弱点を見つけました。
- その先には、OpenAIの社内コード置き場がありました。
- OpenAIは問題を直し、研究者に6500ドルを払いました。
Anthropic(Claudeを作るAI会社)のClaudeを使い、Hacktron(安全を調べる研究チーム)の3人が、OpenAI(ChatGPTを作るAI会社)を調べました。Claudeは、文章を読んだり作業を助けたりするAIです。
研究者は、OpenAIの社員アカウントへ入れる弱点を見つけました。複数の弱点をつなぐと、社内のコード置き場まで届きました。報道では、見つけてから届くまで72時間未満でした。
この調査は、OpenAIのバグ報奨金制度で行われました。これは、安全の問題を見つけた人に報酬を出す仕組みです。見つけた人が会社へ知らせるので、会社は問題を直せます。研究者はOpenAIへ報告し、6500ドルを受け取りました。OpenAIは問題を直したと説明しています。
大事なのは、Claudeが勝手に会社を襲った話ではないことです。人が調べる場所を決め、Claudeを作業の助けにしました。それでも、AIが弱点探しを速くできると、攻撃する人にも防ぐ人にも影響します。
社内のコード置き場へ届いたことは、コードが全部盗まれたことと同じではありません。何を見たのか、コピーしたのかは分かっていません。他の会社にも同じ問題があるかも不明です。これからは、社員アカウントの守り方と、直した後の確認が重要になります。
Claudeが会社の弱いところを見つける手伝いをした
📰 しっかり版: Claudeを使った研究者がOpenAIの社員アカウントに到達 見えた「AIで探す攻撃」の現実
人がAIといっしょに、OpenAIの会社の弱い道を見つけました。
Claude(クロード)
作業を手伝うAI。
OpenAI(オープンエーアイ)
ChatGPTを作る会社。
Anthropic(Claudeを作るAI会社)のClaudeは、作業を手伝うAIです。Hacktronという3人の研究チームが使いました。
調べたのはOpenAI(ChatGPTを作るAI会社)です。研究者は、会社の社員アカウントへ入れる弱いところを見つけました。その先には、会社のコードを置く場所もありました。
研究者は、見つけたことをOpenAIに知らせました。OpenAIは弱いところを直しました。研究者には6500ドルのごほうびを渡しました。
でも、何を見たのかは全部わかっていません。大切なものを持ち去ったとも、まだ確認されていません。
この話は、手伝う道具も使い方で危なくなると教えています。人はAIを見守り、見つかった弱いところを早く直さなければなりません。