Claude Fable 5の実力検証:ベンチマーク・仕様・価格を徹底調査
Hiroba による自動要約
2026年6月9日にリリースされた Claude Fable 5 は Anthropic 初の「Mythos級」一般提供モデル。SWE-bench Pro で 80.3% を達成し Opus 4.8 を 10 ポイント以上上回るが、GPQA Diamond では Gemini 3.1 Pro に劣る。価格は Opus 4.8 の 2 倍(入力 $10/出力 $50)で、thinking は常時 ON、safety classifiers 搭載、30 日間データ保持が必須。6月12日に輸出規制で停止、6月28日に復活した異例の事件があった。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 5165 件あります。
関連する記事
同じタグの記事

Claude Code v2.1.293 アップデート - Claude Haiku 5.5 が既定モデルに
DevIOClaude Code v2.1.293 がリリースされ、Claude Haiku 5.5 が Anthropic API の既定 Haiku モデルになりました。56 件の変更のうち修正が約 7 割を占め、コンパクション後の作業やり直しや HTTP MCP 接続のメモリリーク、Bash でのルール読み込み不具合など実務的な問題が多数解消されています。

Claude Code の Explore が Haiku から本体と同じモデルに変更――費用は21〜35%増加
QiitaClaude Code の Explore サブエージェントは、かつて Haiku で動いていたが、最新版では本体と同じモデル(Opus が上限)で実行されるようになった。Opus 環境での検証で、Explore を Haiku に戻すと重い調べものは35%、軽い調べものは21%の費用削減が実現し、重い調べものは処理時間も変わらないことが確認された。戻すには `.claude/agents/Explore.md` にモデル指定を追加するか環境変数で制御できる。

Claude Code の WebFetch は10万字以上のページを黙って切り詰めていた—2.1.290で修正
QiitaClaude Code 2.1.289 の WebFetch は 100,000 文字を超えるページテキストを黙って破棄し、存在する内容も「書いていない」と回答していた。2.1.290 で修正され、切り詰めた旨を通知して offset パラメータで続きを読む仕様に変更。正確な回答には費用が約6倍、実行時間が約3.8倍必要になった。

仕様駆動開発で E2E テストを高速自動生成する
Zenn既存コードから仕様書を逆起こしし、Claude Sonnet 5 で仕様・シナリオを構造化してから GPT-6 Luna でPlaywright テストコードを生成するパイプラインを紹介。モデルの役割分担により品質を維持しながらコストを大幅削減できる手法。