Claude Code トークン消費を削減するスマートルーティング Brick
Hiroba による自動要約
複数のモデルを効率的に活用するルーティングツール Brick が、Claude Code でのトークン消費を最適化。クエリの複雑性と必要な能力を自動判定し、Haiku / Sonnet / Opus を使い分けることで、高度なタスクのみ高コストモデルを利用し、簡単なタスクは安価なモデルで処理。CLI や Docker で簡単に導入でき、OpenAI 互換エンドポイントとして複数モデル(DeepSeek、Qwen など)を統一管理できる。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 5151 件あります。
関連する記事
同じタグの記事

Claude Code v2.1.293 アップデート - Claude Haiku 5.5 が既定モデルに
DevIOClaude Code v2.1.293 がリリースされ、Claude Haiku 5.5 が Anthropic API の既定 Haiku モデルになりました。56 件の変更のうち修正が約 7 割を占め、コンパクション後の作業やり直しや HTTP MCP 接続のメモリリーク、Bash でのルール読み込み不具合など実務的な問題が多数解消されています。

Claude Code の Explore が Haiku から本体と同じモデルに変更――費用は21〜35%増加
QiitaClaude Code の Explore サブエージェントは、かつて Haiku で動いていたが、最新版では本体と同じモデル(Opus が上限)で実行されるようになった。Opus 環境での検証で、Explore を Haiku に戻すと重い調べものは35%、軽い調べものは21%の費用削減が実現し、重い調べものは処理時間も変わらないことが確認された。戻すには `.claude/agents/Explore.md` にモデル指定を追加するか環境変数で制御できる。

Claude Code の WebFetch は10万字以上のページを黙って切り詰めていた—2.1.290で修正
QiitaClaude Code 2.1.289 の WebFetch は 100,000 文字を超えるページテキストを黙って破棄し、存在する内容も「書いていない」と回答していた。2.1.290 で修正され、切り詰めた旨を通知して offset パラメータで続きを読む仕様に変更。正確な回答には費用が約6倍、実行時間が約3.8倍必要になった。

仕様駆動開発で E2E テストを高速自動生成する
Zenn既存コードから仕様書を逆起こしし、Claude Sonnet 5 で仕様・シナリオを構造化してから GPT-6 Luna でPlaywright テストコードを生成するパイプラインを紹介。モデルの役割分担により品質を維持しながらコストを大幅削減できる手法。