本番でAIが「たまに落ちる」を許す設計 — LLM呼び出しの信頼性エンジニアリング(リトライ・タイムアウト・フォールバック)実践ガイド
出典: Qiita (Claude tag)
Hiroba による自動要約
LLM API呼び出しは1~5%の失敗率を持つため、本番環境では必ず落ちることを前提とした設計が必須。リトライ・タイムアウト・冪等性・フォールバック・サーキットブレーカーの5つの防御パターンを、HTTPステータスコード別の判定と実装可能なコード例を交えて解説。
出典・元記事
Qiita (Claude tag) の記事を Hiroba が自動要約しました。元記事を読む
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 2679 件あります。
関連する記事
同じタグの記事

Claude Fable 5 の実運用コスト — 2週間のログ実測から見るコスト構造と削減策
ZennAnthropic の最上位モデル Claude Fable 5 は定価で入力 $10 / 出力 $50(100万トークン当たり)だが、実際のコスト決定要因はプロンプトキャッシュの効率にあり、96.6% が低単価のキャッシュ読込で構成される。2週間の Claude Code 実運用ログ(79 セッション)を分析した結果、稼働日平均 $84.13 、月換算で約 $1,700 に達し、エンタープライズ平均の 6 倍強だが、キャッシュ戦略の工夫でコスト削減の余地がある。



Claude Code CLI から Databricks の Claude モデルを利用する方法
QiitaVS Code の WSL 環境で Claude Code CLI を実行し、Azure Databricks の Unity AI Gateway を経由して Claude モデルを利用するための構築手順。Node.js・Claude Code CLI・Databricks CLI のインストール、認証設定、証明書登録、設定ファイルの作成を段階的に解説する。