Claude Code で 1 週間に 1B トークン使用も、97% がキャッシュ読み込みだった
Hiroba による自動要約
Claude Code の 1 週間の利用ログを分析したところ、総 1.36B トークン中 97.4% が cache_read(既存コンテキストのキャッシュ再利用)で、実際の新規処理は約 36M トークンに留まった。1 週間 13,972 ターンの運用で、入出力比は約 230:1 だが、その大半は巨大なコンテキストを何度も参照する構造になっている。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 4582 件あります。
関連する記事
同じタグの記事

Claude Code v2.1.293 アップデート - Claude Haiku 5.5 が既定モデルに
DevIOClaude Code v2.1.293 がリリースされ、Claude Haiku 5.5 が Anthropic API の既定 Haiku モデルになりました。56 件の変更のうち修正が約 7 割を占め、コンパクション後の作業やり直しや HTTP MCP 接続のメモリリーク、Bash でのルール読み込み不具合など実務的な問題が多数解消されています。

Claude Code の Explore が Haiku から本体と同じモデルに変更――費用は21〜35%増加
QiitaClaude Code の Explore サブエージェントは、かつて Haiku で動いていたが、最新版では本体と同じモデル(Opus が上限)で実行されるようになった。Opus 環境での検証で、Explore を Haiku に戻すと重い調べものは35%、軽い調べものは21%の費用削減が実現し、重い調べものは処理時間も変わらないことが確認された。戻すには `.claude/agents/Explore.md` にモデル指定を追加するか環境変数で制御できる。

Claude Code の WebFetch は10万字以上のページを黙って切り詰めていた—2.1.290で修正
QiitaClaude Code 2.1.289 の WebFetch は 100,000 文字を超えるページテキストを黙って破棄し、存在する内容も「書いていない」と回答していた。2.1.290 で修正され、切り詰めた旨を通知して offset パラメータで続きを読む仕様に変更。正確な回答には費用が約6倍、実行時間が約3.8倍必要になった。

仕様駆動開発で E2E テストを高速自動生成する
Zenn既存コードから仕様書を逆起こしし、Claude Sonnet 5 で仕様・シナリオを構造化してから GPT-6 Luna でPlaywright テストコードを生成するパイプラインを紹介。モデルの役割分担により品質を維持しながらコストを大幅削減できる手法。