# instinct: データセンターIPの匿名アクセスがbot-blockされても、ログイン中の実ブラウザ/cookieを使うと突破できる(X・YouTube。Redditは例外で不可)

shadow(データセンターIP)からの**匿名**スクレイピングは各社がbot-block。だが**ログイン中の実ブラウザ/cookie**を使うと人間の閲覧と区別がつかず突破できる(2026-06-09 実証)。

| サイト | 匿名アクセス | ログインcookie/プロファイル使用 | 突破手段 |
|--------|------------|---------------------------|---------|
| **X タイムライン/検索** | ❌ login_required | ✅ 取得可 | `playwright launch_persistent_context` でChromeプロファイル直駆動(cookie抜き出し方式はNG・bot検知される) |
| **YouTube 検索/ショート/サブスク** | ❌ "Sign in to confirm you're not a bot" | ✅ 取得可 | `yt-dlp --cookies-from-browser chrome` |
| **Reddit** | ❌ ネットワーク封鎖 | ❌ cookieでも不可 | OAuth APIのみ([[instinct-scraper-zero-items-site-block]]) |

**重要な区別:**
- **cookie抜き出し→headless/requestsで再生(replay)** = X/vvv-botsで過去に試して**bot検知され失敗**(x_novnc/scraper.pyに「Cookie/Playwright方式がbot検知で動作しないためYahoo検索を使用」と明記)
- **実ブラウザプロファイルを直接駆動 or yt-dlpにcookie渡す** = 人間の閲覧と同じ経路なので**突破できる**。これが成否の分かれ目

**実装(jhd横断エンジンで使用):**
- X: `~/.claude/tools/x-timeline/x_timeline.py`(軽量プロファイル=Cookies+Local State+Preferencesだけコピーしlaunch_persistent_context・1.2GBフルコピー不要)
- YouTube: `~/.claude/tools/yt-fetch/yt_fetch.py`(`yt-dlp --cookies-from-browser chrome`・search/shorts/subscriptions 3モード)
- 前提: VNC Chrome で対象サイトにログイン済みであること(auth_token cookie生存)。login_required が返ったら再ログインが必要

**Gotcha:**
- vvv-bots venv に yt_dlp 無し → システムの `~/.local/bin/yt-dlp`(v2026.03.17)を使う
- shorts検索は `results?search_query=&sp=EgIYAQ%3D%3D`(sp=Type:Short フィルタ)
- 起動中Chromeとのプロファイルロック競合に注意(コピー方式で回避・SingletonLock削除)

関連: [[project-jhd-research-engine]] [[instinct-scraper-zero-items-site-block]]

---
(migrated from local memory/instinct_browser_cookie_bypasses_botblock.md)