2026 年 6 月、Anthropic は Mythos 級の Claude Fable 5 を Cursor 等の IDE ユーザー向けに再 GA しました。結論:跨ファイル・長時間 Agent タスクでは Fable 5 が優位ですが、料金は GPT-5.5 の約 2 倍で、安全分類器によるサイレントフォールバックにも注意が必要です。本文では判断表・六手順・購入導線を整理します。
Cursor / Claude Code で数時間の Agent ワークフローを回すチーム向けに、ベンチマーク数値と料金をもとに「全面切替」か「タスク別ルーティング」かを判断できるよう構成しました。
80.3%
Fable 5 · SWE-Bench Pro
58.6%
GPT-5.5 · SWE-Bench Pro
$10/$50
Fable 5 入出力(100万 Token あたり)
Fable 5 再 GA — Mythos 級能力が一般開発者へ
- ① 初の Mythos 級 GA。 Fable 5 は Anthropic 初の対外公開 Mythos 級モデルです。安全分類器発動時、Cursor はOpus 4.8 へサイレントルーティングし、タスクは止まりませんが能力が低下する可能性があります。
- ② 長程 Agent 向け設計。 非ブロッキング Harness により数百万 Token 規模でも意図を維持。跨 repo リファクタや大規模テスト修正に適しています。
- ③ GPT-5.5 の強みは別領域。 Terminal-Bench(Codex CLI)や多モーダル音声、Zapier 等のエコシステム連携が成熟。料金は $5/$30(100万 Token あたり)と日常タスク向けです。
三大選定課題 — 最強モデル=最適解ではない理由
- 1. 料金と用量プール。 Cursor では Fable 5 は API 用量プール経由で Opus 4.8 の約 2 倍。8 時間の跨ファイル作業で出力 50 万 Token なら、月額 M4 レンタル超の請求もあり得ます。
- 2. サイレントフォールバック。 エラー表示なく Opus 4.8 へ切替わるため、監査・コンプライアンスコードではベンチマークスコアと実出力が乖離する恐れがあります。
- 3. 開発環境の安定性。 モデル性能以前に、Xcode・Docker・MCP の並列実行環境がボトルネックになりやすいです。スリープやメモリ不足は長程 Agent を中断させます。
能力対照表 — Fable 5 vs GPT-5.5(2026 年 6 月)
| 項目 | Claude Fable 5 | GPT-5.5 | 向いている用途 |
|---|---|---|---|
| SWE-Bench Pro | 80.3% | 58.6% | 跨ファイル工程 → Fable 5 |
| Terminal-Bench 2.1 | 88.0%* | 83.4%(Codex CLI) | 端末自動化 → Harness 次第 |
| 長コンテキスト | 数百万 Token 意図維持 | 512K–1M MRCR 74% | 超長文 → 両方可、Fable 5 やや優位 |
| API 料金(入/出) | $10 / $50 | $5 / $30 | 高頻度日常 → GPT-5.5 |
| エコシステム | Cursor / Claude Code / MCP | ChatGPT + Codex + SaaS | 非 IDE ワークフロー → GPT-5.5 |
* 一部最高スコアは制限なし Mythos 5 由来。公開 GA 版はやや低い場合があります。
ルーティング判断マトリクス — どちらをいつ使うか
| タスク種別 | 推奨モデル | 理由 | 環境 |
|---|---|---|---|
| 跨 repo リファクタ / 大規模テスト修正 | Fable 5 | SWE-Bench 20pt 以上リード | 24GB+ Mac + 安定 SSH |
| 日常パッチ / スクリプト / CR | GPT-5.5 または Opus 4.8 | コスト約半分 | 16GB Mac で可 |
| 多モーダル / 音声 Agent | GPT-5.5 | 音声・視覚パイプラインが充実 | クラウド Mac + シミュレータ |
| 監査・コンプライアンスコード | 要実測 | Fable 5 はサイレントフォールバック | 隔離サンドボックス + ログ監査 |
六手順評価リスト — Fable 5 を安全に導入する
- タスク分級。 Tier A(日常)と Tier S(跨モジュール)に分け、Tier S のみ Fable 5 を既定にします。
- Token 予算上限。 週次上限を先に $50 で試走。超過時は自動ダウングレードを設定します。
- フォールバック検知。 モデル ID と応答品質を記録し、能力急降下時は Opus または GPT-5.5 で再試行します。
- 24GB 環境準備。 Xcode + Docker + MCP 並列には M4_24 を推奨します。
- 72 時間 A/B テスト。 同一 ticket を両モデルで完了し、時間・介入回数・diff 品質・API 費用を比較します。
- クラウド Mac 評価。 LeanVPS M4_24 月 $96.5〜で SSH 当日接続。Cursor Remote と MCP を本番キーから分離します。
引用可能な三つの数値
- 工程ベンチ: SWE-Bench Pro で Fable 5 80.3%、GPT-5.5 58.6% — 跨ファイル repo 理解タスクで差が最大です。
- 料金: Fable 5 $10/$50、GPT-5.5 $5/$30(100万 Token あたり) — 高頻度利用で最大 2 倍差。
- 環境 TCO: LeanVPS M4_24 月 $96.5〜。Fable 5 の週次 API が $200 超なら、先にルーティング最適化を検討してください。
実務ヒント: 主力 MacBook ではなく LeanVPS M4_24 を SSH サンドボックスに使うと、API キー混在リスクを下げつつ長程 Agent を安定稼働できます。
よくある質問
- Fable 5 と Mythos 5 の違いは? 基盤は同じですが、Fable 5 は安全分類器付きで Opus 4.8 へフォールバックします。
- GPT-5.5 は捨てるべき? いいえ。Tier S は Fable 5、日常は GPT-5.5 というタスクルーティングが最適です。
- 必要ハードウェアは? 推論はクラウドですが、IDE + MCP はローカル実行。M4 + 24GB 推奨、不足時は LeanVPS レンタルが有効です。
まとめ — 購入導線
Fable 5 再 GA 後、跨ファイル・長程 Agent プログラミングでは現時点最強の公開モデルです。ただし2 倍料金・サイレントフォールバック・安定開発環境への依存があるため、唯一のモデルにすべきではありません。
購入導線:LeanVPSで M4_24 Agent 開発機を SSH 接続。72 時間 A/B テスト後にチームルーティングを決定 — ハードは月額固定、モデルはタスク課金。料金もご確認ください。
ベンチマーク・料金は 2026 年 6 月公開情報に基づく整理です。調達助言ではありません。 · 六大 AI コーディングツール比較 · GPT-5.6 Agent 準備ガイド · LeanVPS 料金
Fable 5 Agent 実測 · 主力機リスクゼロ
Mac mini M4 クラウド Agent 開発機をレンタル
月 $96.5 〜、24GB で MCP と長程 Agent を安定稼働。SSH 当日接続、いつでも解約可。