複数 LLM プロバイダの抽象化で得られたのは乗り換えの自由ではなく、可用性とコスト管理だった
Hiroba による自動要約
複数の LLM プロバイダを統一インタフェースで束ねる薄い層の設計を紹介。当初はベンダーロックイン回避を目指したが、実際に得られたメリットはプロバイダが落ちたときの自動フェイルオーバーと、機能ごとのモデル選択による コスト最適化。抽象化を厚くせず必要最小限の 5 項目のみ正規化し、プロバイダ固有パラメータは extra で素通しする設計パターンを採用。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 4893 件あります。
関連する記事
同じタグの記事

Claude Code v2.1.293 アップデート - Claude Haiku 5.5 が既定モデルに
DevIOClaude Code v2.1.293 がリリースされ、Claude Haiku 5.5 が Anthropic API の既定 Haiku モデルになりました。56 件の変更のうち修正が約 7 割を占め、コンパクション後の作業やり直しや HTTP MCP 接続のメモリリーク、Bash でのルール読み込み不具合など実務的な問題が多数解消されています。

Claude Code の Explore が Haiku から本体と同じモデルに変更――費用は21〜35%増加
QiitaClaude Code の Explore サブエージェントは、かつて Haiku で動いていたが、最新版では本体と同じモデル(Opus が上限)で実行されるようになった。Opus 環境での検証で、Explore を Haiku に戻すと重い調べものは35%、軽い調べものは21%の費用削減が実現し、重い調べものは処理時間も変わらないことが確認された。戻すには `.claude/agents/Explore.md` にモデル指定を追加するか環境変数で制御できる。


Claude Code の WebFetch は10万字以上のページを黙って切り詰めていた—2.1.290で修正
QiitaClaude Code 2.1.289 の WebFetch は 100,000 文字を超えるページテキストを黙って破棄し、存在する内容も「書いていない」と回答していた。2.1.290 で修正され、切り詰めた旨を通知して offset パラメータで続きを読む仕様に変更。正確な回答には費用が約6倍、実行時間が約3.8倍必要になった。