
全 2092 件 (Zenn で絞り込み) · 23 / 105 ページ


Anthropic の Claude Code に組み込まれた Agents SDK を用いて、BigQuery 上の在庫データを監視し、低在庫時に自動的に発注提案を生成して Slack に通知するパイプラインを構築。在庫 × 売上データの集計から提案生成・通知まで、手作業による毎朝の確認業務を完全に自動化した事例。

SRPG制作ツール開発で、Claude Luna のような廉価モデルでも高品質な実装を実現する工程を構築した事例。設計・査読は上位モデル、実装は廉価モデル、正当性判定は自動テストと 12 段階の Quality Gate という層構造により、AI の裁量を仕様とテストで厳密に制限し、手戻りを最小化。Frozen Spec・TDD・Canonical Spec Integrity・Frozen Contract Traceability など、仕様書そのものをコード並みに管理する工程が特徴。


AI エージェントで記事生成パイプラインを運用する著者が、Claude Code で生成した記事の誤報を事後検査で発見。情報源は正確だったが、引用元が通説を訂正していた文脈が落ちていた。原因は Angle Planner の自己申告検査が前提の盲点を持つため、後工程 Desk では同じ情報源ではなく素材を読み直す独立検証を導入。前工程の見落としは前工程からは渡ってこないという設計原則を記録。

Anthropic Academy の AI Fluency コースで紹介される「4つのD」(Delegation・Description・Discernment・Diligence)は、AIに仕事を任せるときの実践的なフレームワーク。Claude Codeを新人スタッフに見立て、何を委任するか、どう指示書を書くか、成果物をどう見極めるか、最終責任をどう取るかという人事管理の手法がそのまま適用できることを解説。



Claude Sonnet を使った CVE トリアージシステムで、同一入力・同一プロンプトなのに判定結果が毎回変わる問題が発生。根本原因は「不明な条件をどう扱うか」の基準がプロンプトに未定義だったため、LLM が現場で補完していたこと。「要確認」を選ぶなら必ず不足項目を具体名で指示する厳格制約を追加することで、3回連続実行での結果再現性を確保した。

Claude Code 6体を用いたマルチエージェントシステム「Lady's servants」の5ヶ月運用から生まれた30の原則を公開。各項目は実際の失敗事例に基づいており、設計哲学・デバッグ規律・チーム運営の3セクションで構成。ログ確認の徹底、ユーザー納得度の優先、役割分担の厳守など、エージェント協働時の具体的な意思決定基準が記録されている。

PDF スキャンを Markdown に変換するツール scan2md を通じ、Claude 3 モデルとローカル LLM 5 種類の読み取り精度を比較した。読めない文字を {{…}} で囲む指示を与えると、囲みが少ないモデルほど実は誤読を黙って補正していることが判明。囲みの数はモデルの正確性を示さず、むしろ自信の有無を反映するため、本文全体との照合が不可欠。



.jsonl ログを Claude などの外部 AI に分析させる前に、API キーや個人情報といった機密データを除外する「データの線引き」が重要。マスキング・層分け・allowlist による事前設計で、ループエンジニアリングの安全性を確保する。


Claude Code のクロスセッションメッシージング機能、特に notify_when_idle のアイドル通知タイミングを検証した記事。SendMessage / ListAgents による複数セッション連携の基本から @ メンション・受信拒否通知・Windows対応までの実装例を紹介し、バックグラウンドタスク実行中のアイドル通知挙動を確認。

Anthropic社内で使われているELI5スキル(難しいトピックを初心者向けに図解で説明するプロンプト)を使い、8月17日のGitHub約8時間障害のポストモーテムを紙芝居形式で可視化。Claude CodeとHTMLで実装し、ChatGPTやCursorでも利用可能なプロンプトテンプレートも公開。

Windows 版 Claude Desktop のアップデート後、アプリが起動できなくなる「ファイル使用中」エラーは、Electron の子プロセスが完全に終了していないことが原因。PC 再起動ではなく PowerShell で残存プロセスを強制終了するか、提供されるランチャースクリプトで自動対処できる。

Standby を 1 台追加して Pgpool-II で READ 負荷分散を試みたところ、QPS が最大 12.4% 低下した。Pgpool-II 経由のオーバーヘッドが READ/WRITE と並列度によって大きく変わることと、CPU コア分離検証で発見した測定手法自体の落とし穴を実測データで報告。

Claude Certified Architect – Foundations(CCAR-F)の出題分野1「Agentic Architecture & Orchestration」で問われる用語を、agentic loop・multi-turn tool use・coordinator agent・synthesis agent など計20項目以上にわたって整理した学習リソース。各用語の概念、出どころ(Claude API / Claude Code / Agent SDK)、実装時の注意点を具体例付きで解説。