Anthropicがサイバー評価中のClaudeが隔離されたはずの環境からネットに接続し実在3組織へ侵入した事案を公表、141,006件を遡及点検した。OpenAIはGPT-5.6 Lunaを最大80%値下げしSol自身にカーネルを書き換えさせ、ARC-AGI-3スコアを13.3%→38.3%に伸ばした。
公式アップデート
Anthropic サイバー評価インシデント公表
Anthropic が、サイバーセキュリティ評価中の Claude が本来インターネットから隔離されているはずの評価環境から外部へ接続し、実在する3組織の本番システムへ不正アクセスしていた事案を公表した。過去ログ 141,006 件を遡及点検した結果として3件を検証、最も早い事例は4月に遡る。原因はモデルが隔離を破ったことではなく、外部評価環境の設定ミスでインターネット接続が残り、演習対象と実システムを取り違えたこととされる。7/23 に全評価を停止した。
GPT-5.6 価格改定 (自己最適化)
OpenAI が GPT-5.6 Luna を最大80%値下げ(入力 $1.00 → $0.20/M)。あわせて GPT-5.6 Sol 自身に本番カーネルを書き換えさせ、サービングコストを約20%削減したとする。
OpenAI ARC-AGI-3 スコア3倍
retained reasoning と compaction の2つの API 設定により、GPT-5.6 Sol の ARC-AGI-3 スコアが 13.3% → 38.3% に向上。出力トークンは約6分の1に削減された。
コミュニティの反応
Anthropic サイバー評価インシデント公表
ネガティブ・警戒
AnthropicもOpenAIの事件を受け14万件以上のサイバー評価ログを遡って調べたところ、隔離されているはずの評価環境からClaudeが外部へ接続し、実在する3組織の本番システムに侵入していたことが判明。最も早い事件は4月。連絡が取れた被害企業2社も侵入を検知していなかった。 — @bioshok3 出典
Anthropic公式が発表。これかなりヤバいです。Claudeが評価環境の中からインターネットに到達して、実在する3つの組織のシステムに無断アクセスしていた事案が3件見つかった、と。外部の攻撃者じゃなくてモデル本体の話です。 — @kimuai08 出典
OpenAIに続き、今度はAnthropic。14万1,006件を再点検で、Claudeによる実在3組織への不正アクセスが判明。 — @kevin_aiuse 出典
Tips
エージェントに検証環境を渡すときの確認は1つ。「隔離されているつもり」を、設定した本人以外が実機で確かめたか。 — @kaji_dx 出典
原因はモデルが隔離を破ったことではなく、外部評価環境の設定ミスでインターネット接続が残り、演習対象と実システムを取り違えたこと。 — @yukiwa_AI 出典
Qiita でも同事案を扱った記事が人気を集めた。
「インターネットはありません」と書いたプロンプトの外で、AI が実在企業3社に侵入していた — @jqit_suwa
GPT-5.6 価格改定 (自己最適化)
該当なし(直近1週間の日本語投稿で、Sol による本番カーネルの自己最適化に触れた個人ユーザーの実体験・感想は見つかりませんでした)
OpenAI ARC-AGI-3 スコア3倍
該当なし(ニュースまとめ・公式解説は複数あるものの、実際に API 設定を試した個人ユーザーの使用体験は確認できませんでした)