## 情報源
- URL: https://www.youtube.com/watch?v=UnNjzAn6KHQ
- タイトル: 結局どのAIを使えばいい?ChatGPT・Claude・Geminiと中国勢を比べた【ゆっくり解説】
- チャンネル: サルでもわかるAIにゅーす速報
- 投稿日: 2026-08-10 / 約12分
- スコア: 85/100(**自社発表と第三者計測を明示的に分けて話す**方針を冒頭に置いており、情報源の扱いが誠実)

## 主要な発見
1. **OpenAI GPT-5.6 は3段階** — 上から **Sol / Terra / Luna**(太陽・地球・月=強さの順)。有料 Plus/Pro の標準が Sol に、無料と Go の標準が Luna に入れ替わった。**無制限になるのは文字のやり取りだけ**でファイルアップロード・画像生成の上限は残る。同日 Sol は金融・医療・法律で誤りを含む回答が約68%減と発表(**自社発表値**)。
2. **Claude は4モデル** — 上から **Fable 5 / Opus 5 / Sonnet 5 / Haiku 4.5**。Fable 5 は一度公開停止後、**6月9日から誰でも使える形**に。ただし**無料プランで使えるのは Haiku 4.5 と Sonnet 5 のみ**で、Opus 5 と Fable 5 は有料側(Pro $20 / Max $100・$200 = 使用量5倍・20倍)。「無料で最上位に触らせる OpenAI」とは方針が異なる。
3. **Claude の医療系緩和** — Fable 5 で生物・健康の質問に対する制限が緩和され、体調・検査結果の質問が下位モデルに回される「誤った引き渡し」が約85%減(自社発表)。ウイルス・毒物に関わる話題は引き続き別モデルへ回される。
4. **Gemini は本命が未提供** — Gemini 3.5 Pro は 5/19 の Google I/O で発表済みだが提供が遅延。Bloomberg は「コード生成性能が社内目標に未達」と報道(Google 自身の説明ではない)。安定版の主力は **3.6 Flash**、Pro は 3.1 がお試し版。**順位表で Gemini が低いのは本気の1枚を出していないため**。料金は AI+ 1,200円 / AI Pro 2,900円 / AI Ultra 14,500円・32,000円。Gemini Spark(依頼を後ろで進める仕組み)は 7/29 日本提供開始、有料のみ。
5. **中国勢は開発者側で圧倒** — OpenRouter 集計(7/27からの1週間)で処理量は**中国製 約28兆トークン vs 米国製 約4兆**。この逆転は**14週継続**。理由は価格で、DeepSeek V4 Flash は 100万トークン **$0.14**(約20円)。ただし **8/6 に DeepSeek が大幅値上げを予告**(安価すぎて注文集中・機材不足と見られる)ため、安さは今だけの可能性。
6. **順位は測り方で激変(本動画の核心)** — Artificial Analysis(ベンチ合計点)では **Opus 5 が1位・Fable 5 が3位**。LM Arena(人間投票)では **Fable 5 が1位**、4位に Meta の新モデル、6位に Qwen 3.8 Max、そして **GPT-5.6 Sol は18位付近**(ベンチでは5位)。**試験に強いことと人が読んで気持ちよいことは別物**。「最強」という単語は1つの表に依存している時点で疑う。

## 既存知見との接続
- [[instinct-official-reversal-needs-a-splitting-criterion]] と同じ構図: 単一指標の順位で全面判断しない。**軸を2本用意して食い違いを見る**のが切り分け基準になる。
- 自社発表値(68%減・85%減)と第三者計測(LM Arena・OpenRouter)を混ぜない、は当環境の「検証なし完了宣言は禁止」と同型。

## アクションアイテム
- 当環境は Claude Max 契約(Opus 5 / Fable 5 利用可)で方針変更不要。
- **中国系モデル(DeepSeek/Qwen/GLM)は当環境のポリシーで採用しない** — 価格優位は認識するが判断は変えない。