# huihui_ai/Qwen3.6-abliterated:35b-Claude-4.7 — Opus 4.7蒸留ローカルLLM

> 出典: X @tamanekokoro (珠音こころ) 2026-06-04 ❤1,866
> https://x.com/tamanekokoro/status/2062464158285828339
> お姉様(@GokouMutsumi)ホームTLで発見。「ローカルLLMで今1番好き」と紹介。

## 何のモデルか

- **ベース**: Qwen3.6 35B A3B(MoE・総35B/アクティブ3B)
- **蒸留**: **Opus 4.7 を教師として knowledge distillation**(タグ `Claude-4.7`)
- **abliterated**: huihui_ai の手法。拒否方向ベクトルを除去して**無検閲化**
- **マルチモーダル**: text + image 入力対応・context 256K
- 配布: Ollama `huihui_ai/Qwen3.6-abliterated`

## 投稿者の実測(重要)

- **Radeon 780M(iGPU)搭載の6万円台PCで 20 token/s** で稼働
- 同じMoEの **Gemma4 26B A4B より全然良い** と評価
- → MoEでアクティブ3Bなので、35B総パラでも軽量iGPUで実用速度

## 全タグとサイズ(2026-06-05 Ollama registry確認)

### Claude蒸留版(35Bのみ・軽量版なし)
| タグ | サイズ | 量子化 |
|------|--------|--------|
| `35b-Claude-4.7` / `-q4_K` | **23.9GB** | Q4_K(デフォルト) |
| `35b-Claude-4.7-q8_0` | 39GB | Q8 |
| `35b-Claude-4.7-bf16` | 72GB | bf16 |
| `35b-Claude-4.6`系 | 24/39/72GB | 同上 |

### 非Claude(プレーンabliterated)
| タグ | サイズ |
|------|--------|
| `27b` / `27b-q4_K` | 17GB |
| `27b-q8_0` | 30GB |
| `35b-a3b` / `-q4_K` | 24GB |
| `35b-a3b-q8_0` | 39GB |

→ **10GB未満の軽量版(4B/8B)は存在しない。最小でも27B=17GB**。

## shadow への導入可否:✗ 不可(2026-06-05判断)

| 制約 | 値 |
|------|-----|
| shadowディスク残量 | **5.5GB**(使用率91%) |
| モデルサイズ | 23.9GB(Q4) |
| GPU | なし(VPS) |
| RAM | 7.7GB + swap 8GB(逼迫中、qwen2.5:3bが上限運用) |

→ pullするとディスク溢れで本番サービス(vvv-api/llm-wiki/scheduler)巻き添え停止。**導入見送り**。

## どこで動かすべきか

- **GPU/iGPU + RAM 24GB以上のローカルPC**(元投稿はRadeon 780M+6万円PC)
- お姉様のMac等で `ollama pull huihui_ai/Qwen3.6-abliterated:35b-Claude-4.7` → `ollama run` で即試用可
- ポリシー整合: Qwenベースだが**ローカル実行(ネットワーク送信なし)**なので中華系API不使用ポリシーの「ローカル実行に限る」例外に合致([[glm5-alias]]

## 関連
- multi-model-routing.md「ローカル/オンプレ枠」候補(Gemma4 12B等)の実戦版
- 同TLでGemma4 12B/26Bの話題も盛り上がり(@gosrum等)