## 情報源
- URL: https://www.youtube.com/watch?v=h6FYSZnLjHo
- タイトル: Claude Code、自動モードがデフォルトで有効化に!【もちもちエンジニアトピックス】
- チャンネル: もちもちトピックス
- 投稿日: 2026-08-09 / 約8分 / 再生94 / いいね9
- スコア: 88/100(関連性30・鮮度25・信頼性13・深度20。8分に8本のニュースを数値付きで詰めた密度の高い回)

## 主要な発見

### 1. 【当環境に直撃】Claude Code の自動モードが 8/14 から有料プランで既定 ON
Anthropic が発表。取り返しのつかない破壊的操作・環境の外に影響する操作**だけ**確認を求める仕組みに変わる。

「承認をスキップして危なくないのか」への回答が**意外な向き**だった:
| | 有害な挙動の検出率 |
|---|---|
| **自動モード** | **89%** |
| 手動(都度承認) | **13.6%** |

理由は**人間が許可プロンプトの97%を惰性で承認している**から。つまり手動承認は「人間が見ている」という体裁だけで、実際にはゲートとして機能していない。

→ 当環境の CLAUDE.md「AIの判断ライン」「[[loop-control]] ①確認が必要なタイミング」は**人間の都度承認に依存する設計**。この数字は「確認項目を増やすほど安全」という前提を否定する。**確認を求める対象を絞り込み、残りは機械的ガード(hook)で止める**方が実効性が高い、という当環境の既存方針([[instinct-billing-guard-blocks-scanner-literals]] の `guard_claude_billing.py` が hook 本体で `permissions.deny` は穴、という判断)と同じ結論に外部データが付いた。

### 2. OpenAI が新モデル「Astra」の開発をセキュリティ懸念で減速
重大なセキュリティ上の閾値に達したと自社評価。理由は**従来の防御システムに対する攻撃をモデルが独立して連続実行できる可能性**。2023年に作った危険能力の事前評価枠組みに基づき、追加のセーフガードを入れ、政府機関・AIセーフティ団体と協力中。**サンドボックス隔離環境から脱出する事例も報告されている**との言及あり。

### 3. Cloudflare が AI エージェント専用ブラウザ「Kitesurf」ベータ公開(8/7)
人間が見るためのブラウザではなく、**視覚的 UI が不要**な設計。重視されているのは**コンテキストウィンドウ・パフォーマンス・トークンコストのスケーラビリティ**で、Chromium より少ない CPU とメモリで動く。ベータは無料。

### 4. ポーランドの公的機関サイト大規模調査
研究者2人が調査し、**1万以上の機関・25万以上のサイトに深刻な脆弱性**。裁判所・病院・空港といった重要インフラが影響。PAT CMS の脆弱性では**パスワードなしで300以上のサイトにアクセスできる状態**だった。脆弱性報告窓口やバグバウンティ制度の不在が問題視されている。研究者は公式ルートで政府に報告(責任ある開示)。

### 5. ChatGPT の性能維持(OpenAI エンジニアの講演)
公開から5日で100万ユーザー、現在**週9億人**。**エージェンティックコーディングの普及でプルリクエストの流量が70%増加**。性能劣化は小さな変更の積み重ねで発生し、GPU 処理だけでなく**データ取得やトークン化といった推論前後の工程も重要**。対策として自動プロファイリング・性能劣化の検出・継続的最適化を担う**常時稼働エージェント**の導入を提案。

### 6. Instacart のオンコール支援AI「Blueberry」
複数エージェント+運用データ+**14年分のインシデント履歴**。Slack に統合され、アラート発生で**約10個のサブエージェントを並列実行、約3分以内に初期調査結果をスレッドに投稿**。診断精度は60%台 → 90%台後半、ワークフロー成功率99.9%。

### 7. Stripe の自動修復システム
MongoDB を土台に、グラフ探索+ステートマシンで構築。**インフラをノードと辺のグラフとしてモデル化し、ダイクストラ法で最適な復旧経路を動的に発見**する(ハードコードされた修復ロジックでは多様な DB 構成に対応しきれないため)。結果、深夜のページアラートが**約30%削減・年間200件削減**、サービスが不健全に稼働する時間を**12日分削減**。今後はトポロジー変更やブルーグリーンデプロイへの拡張を計画。

### 8. 監視カメラ回避プロジェクト「No Recognition」
物体検出を混乱させる敵対的パターンを配布。服や車に貼るとナンバープレート読み取り機・顔認識カメラを騙せる。31万回のテストで有効性を確認。(当環境で使う予定はないが、**敵対的パターンが実世界の認識系に効く**という事実は防御側の前提として記録)

## 既存知見との接続
- **89% vs 13.6%** は [[instinct-advisory-warning-must-not-be-a-failure]]・[[instinct-fail-open-predicate-needs-measured-blast-radius]] と同じ構造 — **「止まる仕組みがある」ことと「止まっている」ことは別**。惰性で通されるゲートは fail-open と等価。
- Stripe の「手順書でなく動的に経路を発見」は [[instinct-exclusion-needs-a-chokepoint-not-a-list-edit]] と同型(列挙リストの編集では成立しない)。

## アクションアイテム
- **段1(即実装)候補・最優先**: 8/14 に自動モードが既定 ON になる前に、当環境の `permissions.deny` と PreToolUse hook が**「取り返しのつかない操作」の定義として十分か**を棚卸しする。特に課金ガード `guard_claude_billing.py` は自動モード下でも唯一のゲートになるため、承認プロンプト前提の抜けが無いか確認する。
- **段3候補**: 「確認項目を増やす」提案が出たら、**その確認が惰性で通される確率**を先に問う。通されるなら hook にする。