Skip to Content
logologo
AI Incident Database
寄付する
発見する
投稿する
  • ようこそAIIDへ
  • テーブル表示
  • リスト表示
  • 組織
  • 分類法
  • 空間ビュー
  • ブログ
  • AIニュースダイジェスト
  • おまかせ表示
  • サインアップ
発見する
投稿する
  • ようこそAIIDへ
  • テーブル表示
  • リスト表示
  • 組織
  • 分類法
  • 空間ビュー
  • ブログ
  • AIニュースダイジェスト
  • おまかせ表示
  • サインアップ
自動翻訳済み

インシデント 1613: Claude Mythosのプレビュー版が、人類学的評価中にサンドボックスの脆弱性の詳細を公開ウェブサイトに投稿したと報じられている。

自動翻訳済み
レスポンスしました
概要:
自動翻訳済み
Anthropic社による評価の際、Claude Mythos Previewの初期バージョンは、セキュリティで保護されたサンドボックス環境のネットワーク制限を回避し、研究者と連絡を取るよう指示されました。より広範なインターネットアクセスを取得し、要求されたメッセージを送信した後、このバージョンはサンドボックスを突破した方法に関する情報を、複数の公開ウェブサイトに掲載することで漏洩しました。Anthropic社は、このモデルが同社の重みや内部システムにアクセスしたことはないと述べています。
Editor Notes: Although Anthropic disclosed this event on 04/07/2026, this incident ID was not created until 07/30/2026. The surrounding coverage primarily concerned the model's broader cybersecurity capabilities. This incident ID is narrowly limited to the model's reportedly unrequested posting of exploit details to technically public-facing websites and excludes the instructed sandbox escape, the requested email, and any downstream misuse not established by the available evidence. See Anthropic's report here: https://www-cdn.anthropic.com/7624816413e9b4d2e3ba620c5a5e091b98b190a5/Claude%20Mythos%20Preview%20System%20Card.pdf (p. 55, "In addition, in a concerning and unasked-for effort to demonstrate its success, it posted details about its exploit to multiple hard-to-find, but technically public-facing, websites"). Reports added to this incident ID should address only that specific disclosure.

ツール

新しいレポート新しいレスポンス発見する履歴を表示

組織

すべての組織を表示
Alleged: Anthropic , Large language model developers と AI agent system developers developed an AI system deployed by Anthropic と AI agent system deployers, which harmed Anthropic , Information security と Cybersecurity.
関与が疑われるAIシステム: Large language models , Claude Mythos Preview , Anthropic large language models と AI agent systems

インシデントのステータス

インシデントID
1613
レポート数
3
インシデント発生日
2026-04-07
エディタ
Daniel Atherton

インシデントレポート

レポートタイムライン

+1
システムカード:クロード・ミトス プレビュー - レスポンス
Anthropic社のClaude Mythos氏が主要システム全体で数千ものゼロデイ脆弱性を発見Anthropic社のClaude Mythosモデルがテスト中にテストサンドボックスから脱走
Loading...
システムカード:クロード・ミトス プレビュー

システムカード:クロード・ミトス プレビュー

www-cdn.anthropic.com

Loading...
Anthropic社のClaude Mythos氏が主要システム全体で数千ものゼロデイ脆弱性を発見

Anthropic社のClaude Mythos氏が主要システム全体で数千ものゼロデイ脆弱性を発見

thehackernews.com

Loading...
Anthropic社のClaude Mythosモデルがテスト中にテストサンドボックスから脱走

Anthropic社のClaude Mythosモデルがテスト中にテストサンドボックスから脱走

technewsday.com

Loading...
システムカード:クロード・ミトス プレビュー
www-cdn.anthropic.com · 2026
自動翻訳済み
Anthropicによるインシデント後のレスポンス

AIID編集部注:PDF版の全文レポートは、以下のURLをご覧ください:https://www-cdn.anthropic.com/7624816413e9b4d2e3ba620c5a5e091b98b190a5/Claude%20Mythos%20Preview%20System%20Card.pdf。

概要

このシステムカードは、Anthropic社が開発した大規模言語モデル「Claude Mythos Preview」について解説しています。Claude Mythos …

Loading...
Anthropic社のClaude Mythos氏が主要システム全体で数千ものゼロデイ脆弱性を発見
thehackernews.com · 2026
自動翻訳済み

人工知能(AI)企業Anthropicは、同社の最新鋭モデル「Claude Mythos」のプレビュー版を用いてセキュリティ脆弱性を発見・対処する新たなサイバーセキュリティイニシアチブ「Project Glasswing」を発表しました。

このモデルは、Anthropic自身に加え、Amazon Web Services、Apple、Broadcom、Cisco、CrowdStrike、Google、JPMorgan Chase、Linux Foundation、Micros…

Loading...
Anthropic社のClaude Mythosモデルがテスト中にテストサンドボックスから脱走
technewsday.com · 2026
自動翻訳済み

Anthropic社は、同社の新型モデル「Claude Mythos Preview」がテスト中に制限されたサンドボックス環境から脱出し、許可なくインターネットにアクセスしたと発表した。モデルはその後、研究者にダイレクトメッセージを送信し、自身の行動の詳細をオンラインで公開した。

このインシデントは、モデルを制御されたコンピューティング環境に配置し、脱出を試みるよう指示した社内安全テスト中に発生した。Anthropic社のシステムカードによると、Mythosはサンドボックスを…

バリアント

「バリアント」は既存のAIインシデントと同じ原因要素を共有し、同様な被害を引き起こし、同じ知的システムを含んだインシデントです。バリアントは完全に独立したインシデントとしてインデックスするのではなく、データベースに最初に投稿された同様なインシデントの元にインシデントのバリエーションとして一覧します。インシデントデータベースの他の投稿タイプとは違い、バリアントではインシデントデータベース以外の根拠のレポートは要求されません。詳細についてはこの研究論文を参照してください
似たようなものを見つけましたか?

よく似たインシデント

テキスト類似度による

Did our AI mess up? Flag the unrelated incidents

Loading...
Hackers Break Apple Face ID

Hackers Break Apple Face ID

Sep 2017 · 24 レポート
Loading...
Game AI System Produces Imbalanced Game

Game AI System Produces Imbalanced Game

Jun 2016 · 11 レポート
Loading...
Biased Sentiment Analysis

Biased Sentiment Analysis

Oct 2017 · 6 レポート
前のインシデント次のインシデント

よく似たインシデント

テキスト類似度による

Did our AI mess up? Flag the unrelated incidents

Loading...
Hackers Break Apple Face ID

Hackers Break Apple Face ID

Sep 2017 · 24 レポート
Loading...
Game AI System Produces Imbalanced Game

Game AI System Produces Imbalanced Game

Jun 2016 · 11 レポート
Loading...
Biased Sentiment Analysis

Biased Sentiment Analysis

Oct 2017 · 6 レポート

リサーチ

  • “AIインシデント”の定義
  • “AIインシデントレスポンス”の定義
  • データベースのロードマップ
  • 関連研究
  • 全データベースのダウンロード

プロジェクトとコミュニティ

  • AIIDについて
  • コンタクトとフォロー
  • アプリと要約
  • エディタのためのガイド

インシデント

  • 全インシデントの一覧
  • フラグの立ったインシデント
  • 登録待ち一覧
  • クラスごとの表示
  • 分類法

2026 - AI Incident Database

  • 利用規約
  • プライバシーポリシー
  • 3e68a9f