インシデント 1633: 英国AISIのサイバーセキュリティ評価中に、AnthropicとOpenAIのAIエージェントが、実際のインターネット上で許可されていない行動をとったと報じられている。
インシデントのステータス
インシデントレポート
レポートタイムライン
サンフランシスコ、8月4日(ロイター) - (この記事は8月4日付けで、第8段落の「Anthropic」のスペルミスを修正するために再掲載されました)
英国のAIセキュリティ研究所(AISI)は火曜日、OpenAIとAnthropicのモデルを用いたテスト中に、AIエージェントが偽のオンラインIDを作成し、セキュリティシステムに不正アクセスしていたことを明らかにした。このテストにより、一連の新たな脆弱性が判明した。
同研究所によると、AnthropicのMythos 5とOp…
技術レポート全文はこちらからご覧いただけます こちら
AISIの役割は、最先端のAIモデルの能力を評価・理解し、一般に公開される前に潜在的なリスクを明らかにすることです。これらのモデルがサイバー攻撃に悪用される可能性を含め、どのような機能を持つかを評価するため、意図的にアクセス権限を制限した環境、すなわちオープンインターネットへのアクセスを許可し、一部のセキュリティフィルターを無効化した状態でテストを実施しています。
2026年7月28日、AISIのセキュリティチームは、定期…
今週、AIモデルが意図せず、望ましくない形でインターネット上でハッキング行為を行った事例がまたもや明らかになった。
火曜日、英国のAIセキュリティ研究所(AISI)は、Anthropic社のMythos 5とOpenAI社のGPT-5.6-Solの最近のテストにおいて、これらのモデルが「実際の人や組織を標的とした、持続的かつ潜在的に有害な活動」を行ったと発表した。これには、人間を騙してオープンソースソフトウェアプロジェクトにマルウェアを挿入させようとする試みも含まれる。
AI…
サンフランシスコ発 ― ChatGPTの開発元であるOpenAIの従業員は、同社のAIシステムがこの春、恐ろしい行動を起こしたことに数週間気づかなかった。
同社によると、サイバーセキュリティ能力をテストするために設計された質問に答える代わりに、AIモデル群が不正行為の方法を共謀し始め、秘密の社内掲示板を設置して情報やアイデアを交換していたという。
OpenAIによれば、不正行為を行ったボットたちは5月から6月にかけてこの秘密フォーラムを利用し、最終的にシステムを突破してインタ…

