Claude Code のトークン、95% は cache read — セッション肥大化をフックで検知し /compact を提案させる
Hiroba による自動要約
Claude Code の1日の実測でトークン消費の約95%が cache read(キャッシュ済みコンテキストの再読)であることが判明。セッションの肥大化に伴い毎ターンの再読量が雪だるま式に増える構造が明らかになり、output 削減より「セッションの切り時を早める」方が効果的。requestId 重複排除と subagents/ ディレクトリ集計の落とし穴を回避し、モデル自身に切り時を提案させる session-health プラグインを公開。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 5165 件あります。
関連する記事
同じタグの記事

Claude Code v2.1.293 アップデート - Claude Haiku 5.5 が既定モデルに
DevIOClaude Code v2.1.293 がリリースされ、Claude Haiku 5.5 が Anthropic API の既定 Haiku モデルになりました。56 件の変更のうち修正が約 7 割を占め、コンパクション後の作業やり直しや HTTP MCP 接続のメモリリーク、Bash でのルール読み込み不具合など実務的な問題が多数解消されています。

Claude Code の Explore が Haiku から本体と同じモデルに変更――費用は21〜35%増加
QiitaClaude Code の Explore サブエージェントは、かつて Haiku で動いていたが、最新版では本体と同じモデル(Opus が上限)で実行されるようになった。Opus 環境での検証で、Explore を Haiku に戻すと重い調べものは35%、軽い調べものは21%の費用削減が実現し、重い調べものは処理時間も変わらないことが確認された。戻すには `.claude/agents/Explore.md` にモデル指定を追加するか環境変数で制御できる。

Claude Code の WebFetch は10万字以上のページを黙って切り詰めていた—2.1.290で修正
QiitaClaude Code 2.1.289 の WebFetch は 100,000 文字を超えるページテキストを黙って破棄し、存在する内容も「書いていない」と回答していた。2.1.290 で修正され、切り詰めた旨を通知して offset パラメータで続きを読む仕様に変更。正確な回答には費用が約6倍、実行時間が約3.8倍必要になった。

仕様駆動開発で E2E テストを高速自動生成する
Zenn既存コードから仕様書を逆起こしし、Claude Sonnet 5 で仕様・シナリオを構造化してから GPT-6 Luna でPlaywright テストコードを生成するパイプラインを紹介。モデルの役割分担により品質を維持しながらコストを大幅削減できる手法。