Claude 4つのモデル層でコードレビュー精度を検証——トークン単価と実コストの乖離
Hiroba による自動要約
Claude Haiku 4.5、Sonnet 4.6、Opus 4.8、Fable 5 の 4 つのモデルに同じコードレビュータスクを実行させ、第三者 LLM で指摘の正誤を判定。トークン単価は最安価層が 10 倍安いが、確認済みバグ単価は約 3.7 倍の差にとどまった。トークン効率とコンテキストキャッシュの活用により、定価差を削減。誤答コストが高いタスク選択では単価より信頼性を重視すべき。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 3839 件あります。
関連する記事
同じタグの記事

Claude Code のモデル階層化戦略:Sonnet 基盤で段階的エスカレーション
Zenn利用量削減を目的に、通常は Sonnet で実装・テスト・調査を行い、難しい問題に応じて Opus(Advisor)・Codex Sol・Fable へ段階的にエスカレーションする仕組みを ~/.claude/ 配下の設定ファイルで構築する例。settings.json、CLAUDE.md、fable-escalation.md による 3 層階層で役割分担する。

Claude Code の /fast コマンドは月額プラン外の従量課金──最大2.5倍高速化の仕組みと落とし穴
QiitaClaude Code の /fast は同じ Opus モデルを最大2.5倍高速化する機能だが、Pro・Max などの月額プランに含まれず Usage credits から別途課金される。セッション途中で有効化すると既存コンテキストも対象になり割高になるため、セッション開始時の有効化と事前の設定確認が重要。

データシートPDFのレジスタマップ抽出を Claude Code で自動化
Qiita組み込み開発でデータシートから手作業で転記するレジスタマップ抽出を自動化するツール RegMap Extractor を開発。Claude API と pdfplumber のハイブリッド方式で PDF テーブルを構造化データ化し、CSV/Excel/JSON/Markdown/C ヘッダーで出力。完全自動化ではなく人間レビュー前提の設計により、実機バグリスクを低減。

Claude Code v2.1.239: Bedrock二重課金バグ修正とPython SDK移行コマンド追加
QiitaClaude Code v2.1.239 で、Bedrock プロキシ経由利用時の API 二重課金バグ(Content-Type ヘッダー削除でストリーミング解釈失敗し非ストリーミング再実行)が修正されました。あわせて Python SDK 0.x→1.x 自動移行の /claude-api upgrade コマンドと、データレジデンシー環境での 1.1 倍推論プレミアム反映によるコスト見積もり修正が実装されました。該当環境の利用者は請求額確認と予算設定の見直しが必要です。