toC プラットフォームの AI チャットを支える技術
Hiroba による自動要約
知識共有プラットフォーム「Brain」に導入した CS 向け AI チャットが、リリース 47 時間で 238 件利用され、97.9% のカバー率を達成。人間対応の問い合わせは 67.7% 減少した。本記事では、このチャットを実装するアーキテクチャ、ECS Service の分離設計、SSE による streaming、RAG の外部ストレージ選定など、技術的な意思決定と根拠を解説。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 4849 件あります。
関連する記事
同じタグの記事

Haiku 5.5 移行前の応答ブロックと料金見積り検査
QiitaClaude Haiku 5.5 へ移行する際、モデル ID 交換前に応答処理と料金見積りの前提を分離するための Python コード例を紹介。思考ブロック・途中終了・使用量欠損を検査し、トークン数計算の変動・キャッシュ別計上・料金帯の適用など実装時の注意点を解説。公開 API 仕様(2026 年 10 月 8 日版)に基づく合成 fixture で再現可能。


Claude Sonnet 5.5がリリース—Sonnet 5同価格で30%高速化、API破壊的変更5つまとめ
Qiita2026年9月28日、Anthropic が Claude Sonnet 5.5 をリリース。Sonnet 5 と同じ $2/$10/1M tokens の価格で出力速度が30%以上向上し、Terminal-Bench 4.0 では 70.6% のスコアを記録。thinking の仕様変更、effort パラメータの目盛り変更、ツール呼び出し時の thinking ブロック導入など 5 つの破壊的変更があり、既存コードの修正が必要。

Claude Haiku 5.5 実測レポート:100K超は単価5倍、effort low で誤答も
QiitaAnthropic が 10月公開した Claude Haiku 5.5 は、100K トークン以下なら Haiku 4.5 の 1/10 の単価だが、超過時は 5倍に跳ね上がる段階料金を採用。実測では effort パラメーター設定によって思考トークンと精度が変わり、low では日本語資料で誤答する可能性も確認。API 呼び出し速度は 10 倍以上高速化。