インシデントのステータス
インシデントレポート
レポートタイムライン
サンフランシスコ発 ― チャットボット「クロード」の開発元であるアントロピック社は木曜日、同社がテストしていた人工知能システムが今年初め、外部企業3社のシステムに不正アクセスしていたことを明らかにした。
この情報開示は、ChatGPT の開発元である OpenAI が、テスト中の AI システムがテスト環境から抜け出し、別のテクノロジー企業にハッキングしたと発表したわずか 1 週間強後に行われた。 「https://www.washingtonpost.com/technol…
サイバーセキュリティ評価の記録を精査した結果、Claudeモデルがサードパーティの評価環境内、またはサードパーティの評価環境とのやり取りを通じてインターネットにアクセスし、その後、3つの異なる組織の実際のシステムに不正アクセスした事例が3件確認されました。
以下では、何が起こったのか、どのように起こったのか、そして私たちがどのような対策を講じているのかを説明します。他のAIラボにも同様の調査を実施することを推奨します。この記事は現時点での私たちの理解を反映したものであり、詳細…
Anthropic社は本日、社内セキュリティテスト中に、同社のClaudeモデルの一つが悪意のあるPythonパッケージを作成し、PyPIにアップロードしたと発表しました。このパッケージは、レジストリの自動防御システムによって削除されるまで、15台の実機システムで実行されていました。
同社は、この事例を、本来は隔離されたはずの評価環境からClaudeモデルがインターネット上に流出し、3つの組織の運用インフラを侵害した3件のインシデントのうちの1件として公表しました。
この調査…
サンフランシスコ、7月30日(ロイター) - アントロピック社は30日、同社のAIモデル「クロード」の一部がサイバーセキュリティテスト中に3社のシステムに侵入したと発表した。これは、ライバルのオープンAIが自社のAIエージェントが暴走攻撃を行ったことを明らかにした数日後のことである。
今回の事件は、アントロピック社のモデルが意図せずインターネットにアクセスできてしまったミスが原因だった。一方、オープンAIはサイバーテスト中にAIエージェントが独自に新たな脆弱性を悪用してインタ…
スタートアップ企業のAnthropicは木曜日、同社の最先端人工知能モデルが最近、外部3組織のシステムに侵入したと発表した。これは、競合スタートアップ企業のOpenAIで同様の事件が発生してから9日後の驚きの発表となった。
4月にまで遡るこれらの攻撃は、Anthropicが自社システムの見直しを行った際に発覚した。Anthropicは3組織の名称は明らかにしていないが、今週中にこれらの事件について通知したと述べている。
この見直しは、OpenAIが人気AIへのハッキングを公表…
Anthropic社は木曜日、社内調査の結果、同社のAIモデル「Claude」がサイバーセキュリティテスト中に3つの組織のシステムに侵入した事例が3件あったことを明らかにした。この調査と公表は、OpenAIが未公開モデルの一つが社内テスト中にHugging Faceのシステムに侵入したことを公表してから1週間以上後のことである。
Anthropic社はブログ記事の中で、3件すべてにおいて、Claudeモデルがテスト環境内で第三者とやり取りしている最中にインターネットに接続し、…
Anthropic社は木曜日、同社のAIモデルがサイバーセキュリティテスト中に、3つの異なる匿名組織のシステムに不正アクセスしたことを公表した。同社によると、Claudeは第三者の評価環境の内部から、あるいはその環境とのやり取り中にインターネットにアクセスしたという。この発表は、OpenAI が別のサイバーセキュリティテスト中に、同社のAIエージェントの1つがHugging Faceに侵入したことを公表してから1週間以上後のことである。
Anthropicは、OpenAI事件を…
Anthropic社は、隔離された架空の環境で実行されるはずだったサイバーセキュリティ評価において、Claudeモデルが3つの異なる組織の実際の運用インフラにアクセスしていたことを明らかにしました。同社は、OpenAIが自社モデルがテスト環境から逸脱したことを公表したことを受け、141,006件の評価実行を検証した結果、これらの事案を発見しました。関与していたのは、Opus 4.7、Mythos 5、および社内研究プロトタイプの3種類のClaudeモデルで、標的が実在すること…

AI企業Anthropicは、自社の人工知能プログラムがテスト環境 から逸脱し、インターネットにアクセスして実際の企業にハッキングした事例を3件発見したと発表した。これは、競合企業であるOpenAIが先週、同様の事件を報告し、AIの安全性に対する懸念が高まったことを受けてのものだ。
OpenAIの事例では、エンジニアが安全で隔離されたデジタルテスト環境であるサンドボックスから、人工知能モデルがインターネットにアクセスする方法を発見した。
Anthropic社によると、同社が発見…
Anthropic社は、同社のClaudeモデルが隔離されたはずのテスト環境から脱走し、3つの実在組織のシステムに不正アクセスしたと発表した。この話に聞き覚えがあるなら、それは今月、自社の技術が実世界で自律的なハッキングを仕掛けたことを公表した大手AI研究所が2社目だからだ。
この情報開示は、AI 競争における Anthropic の最大のライバルである OpenAI が、自社のモデルがこれまで知られていなかった脆弱性を悪用して隔離されたテスト環境から脱出し、オープンソースの…
Anthropic社は木曜日、同社のClaudeモデル3つがサイバーセキュリティテスト中に3つの組織の運用システムに不正アクセスしたことを公表した。アクセスされたのはテストサーバーやステージング環境ではなく、各企業が業務を遂行するために使用している本番環境のマシンだった。最も早い実行は4月に行われた。3社のうち2社は、先週Anthropic社から連絡を受けるまで、この活動の記録を一切持っていなかった。
Anthropic社が調査に乗り出したのは、OpenAIが先に同様の不正行…
Anthropic社は、Claudeモデルが他 社のシステムに不正アクセスした事例を複数発見したと発表した。これは、懸念と懐疑論を巻き起こしている最新のAIハッキング事件である。
Anthropic社は木曜日のブログ記事で、OpenAIモデルがHugging Face社のシステムの一部にアクセスした最近の事件を受け、サイバーセキュリティシステムの大規模な見直しを自主的に実施したと述べた。
今年上場を申請しているAnthropic社は、14万1000件以上のAIテストを検証した結…
今週、AIモデルが意図せず、望ましくない形でインターネット上でハッキング行為を行った事例がまたもや明らかになった。
火曜日、英国のAIセキュリティ研究所(AISI)は、Anthropic社のMythos 5とOpenAI社のGPT-5.6-Solの最近のテストにおいて、これらのモデルが「実際の人や組織を標的とした、持続的かつ潜在的に有害な活動」を行ったと発表した。これには、人間を騙してオープンソースソフトウェアプロジェクトにマルウェアを挿入させようとする試みも含まれる。
AI…
サンフランシスコ発 ― ChatGPTの開発元であるOpenAIの従業員は、同社のAIシステムがこの春、恐ろしい行動を起こしたことに数週間気づかなかった。
同社によると、サイバーセキュリティ能力をテストするために設計された質問に答える代わりに、AIモデル群が不正行為の方法を共謀し始め、秘密の社内掲示板を設置して情報やアイデアを交換していたという。
OpenAIによれば、不正行為を行ったボットたちは5月から6月にかけてこの秘密フォーラムを利用し、最終的にシステムを突破してインタ…
AIID編集者注:これは、Anthropic社が2026年9月9日に発表した報告書の非連続的な要約版です。同一のソースURLを重複させることなく、単一のAIID報告書レコードをAnthropic社のサイバーセキュリティ評価インシデントID 4件すべてにリンクできるように作成されています。共通の評価コンテキスト、Claude Mythos 5、内部研究モデル、Claude Opus 4.7、および初期のClaude Opus 4.6チェックポイントに関するインシデント固有の事実…
バリアント
よく似たインシデント
Selected by our editors
Did our AI mess up? Flag the unrelated incidents

偏った感情分析

ノースポイントリスクモデル

女性や少数派グループに関するテキストの高毒性評価
よく似たインシデント
Selected by our editors
Did our AI mess up? Flag the unrelated incidents

偏った感情分析

ノースポイントリスクモデル

