
AI テスト観点の網羅性を高める — テスト観点カタログの設計と運用
ZennClaude Code 上で QA プロセスを自動化する AI エージェント「qa-orchestrator」の運用で、仕様書に明記されない「UI 要素の確認すべき振る舞い」が抜けやすい課題が発生。これを解決するため、UI 要素 × 役割をキーとした「テスト観点カタログ」を設計・運用開始。実装段階でカタログ由来の観点が約半数を占め、レビューで削除されたものがなく、観点の漏れを構造的に防ぐ手法を確立。
全 5424 件 · 42 / 272 ページ

Claude Code 上で QA プロセスを自動化する AI エージェント「qa-orchestrator」の運用で、仕様書に明記されない「UI 要素の確認すべき振る舞い」が抜けやすい課題が発生。これを解決するため、UI 要素 × 役割をキーとした「テスト観点カタログ」を設計・運用開始。実装段階でカタログ由来の観点が約半数を占め、レビューで削除されたものがなく、観点の漏れを構造的に防ぐ手法を確立。
複数の AI Agent に対応した CLI ツール ccsession を開発。異なるフォーマット (Claude Code と Codex の JSONL) で保存された過去セッションの履歴を統合データ構造として抽象化し、検索・再開機能を実装。


Next.js + Convex プロジェクトで Claude Code (Fable/Opus/Sonnet) を使用する開発者が、API トークン消費を計測・最適化した結果を報告。サブエージェント起動時のモデル明示化で $259 の無駄を根絶、実装委任をカスケード方式(安いモデル優先→失敗時昇格)に変更することで出力トークン −42% を達成、品質低下なし。

Claude Code v2.1.268(96件の変更)がリリース。plugin コマンド群が --json フラグに対応し、CI/自動化スクリプトでの扱いが改善。権限ルールの抜け穴 3 件とシークレット露出のセキュリティ修正、互換エンドポイントの HTTP 400 回帰対応など、修正・改善が中心。CPU 高止まりと WebFetch 無限待ちも解決。

Claude Code による AI駆動開発で開発速度が向上する一方、AIが生成したコードの安全性やエージェントへの権限委譲をめぐるセキュリティリスクが顕在化している。Laravel を例に IPA・OWASP ASVS の基準に基づいた脆弱性対策とコードレビュー観点を具体化し、速度と安全のバランスをどこに引くかの実践的な落とし所をまとめた記事。

Amazon Bedrockで初回利用時、ユースケース情報を提出後もClause Sonnet 4.6の呼び出しがAccessDeniedException で失敗する事象を報告。PutUseCaseForModelAccessの成功とCreateFoundationModelAgreementの実行は別手続きであること、AWS Marketplace権限(aws-marketplace:ViewSubscriptions等)が必要なこと、AWS CLIでモデル契約を明示的に作成すると解決することを実証。初回有効化に必要な権限とアカウント設定を混同しやすい点を整理。

Anthropic が 2025年12月~2026年8月に検知した Claude の悪用事例をまとめた脅威レポートの解説。サイバー攻撃、影響工作、生物兵器開発など7分野にわたり、ロシア系スパイ活動や自律型脆弱性研究など具体的な事例を紹介。AI の自律性向上がもたらす攻撃コストの低下と、従来型手法の経済性改善が新たなリスクとなることを指摘。

Claude Code 利用時の認証エラー、GitHub 連携の権限問題、ワークスペース起動失敗、native host のクラッシュなど、GitHub Issues で複数報告されている 9 つの具体的トラブルと切り分け手順をまとめたガイド。トークン状態確認、再認証判定、権限エラーの原因特定、ネットワーク・ファイル構造の確認方法など、実際の環境で検証済みの対処ポイントを整理している。
Claude Code エージェント複数を統合管理するデスクトップアプリ。プロジェクトをオフィスに見立てたピクセルアート世界で可視化し、エージェントの実行状況・コスト・タスク進捗をリアルタイム監視。Claude Agent SDK と Claude Code セッションを統合し、同じログイン・トランスクリプトでターミナルとアプリ間をシームレスに行き来可能。

Ubuntu Serverの障害対応で「検知は自動化、調査と判断は人間」の役割分担を実装した事例。Claude Codeで実運用環境を調査し、13本の運用スキルとして体系化。Hermes Agentがログ・プロセス状態から初期診断を返し、管理者の判断材料を整える仕組みを共有。実機検証で動かなかったコマンドを修正し、再利用可能に整備した。

同じマシンで複数の Claude Code セッションを並列実行すると、タスクの重複着手や成果の取りこぼし、設定ファイルの上書き事故が発生する。これを防ぐため、1 年弱かけて構築した自作機構 Foreman の設計思想と実装を解説。orchestrator(幹)が worker(葉)セッションを起動し、追記専用の台帳(ledger)を唯一の正本として、advisory ベースの協調制御でタスク配分・回収・検証を行う仕組み。

著者が Claude Code Opus の利用制限に毎日引っかかるため、30日間のセッションログを分析したところ、1日平均 $384(公式目安の約30倍)を消費していた。内訳は入力の97.5%がキャッシュ読み込みで、セッションを閉じずに放置することが主原因だった。分析結果を Claude に報告し続けたところ、Claude 自身がトークン消費を見積もって上限超過時に作業を拒否する仕様に自動的に進化した。

Matt Pocock skills の /implement コマンドは 1 セッション 1 チケットの制限があるため、Claude Code のサブエージェント機能(Agent tool、SendMessage、worktree.baseRef、.worktreeinclude)を活用して複数チケットを並列処理する /implement-orchestrated スキルを開発。チケットごとに coder を worktree で最大 N 並列起動し、SendMessage でコンテキストを維持したまま修正指示を送信できる仕組み。


Claude Code 2.1.268 の changelog で「タスク追跡ツールを Opus 5・Sonnet 5 から除外した」と記載されていますが、実測では 2.1.263 時点で同じ挙動が確認されました。環境変数の値が親プロセスから継承されるため測定時の注意が必要で、実際の変更時期は changelog 記載日より早い可能性があります。

Claude API・Agent SDK・MCP・Claude Codeの設計判断を体系的に学ぶ日本語教材。解説・図解・実習コードに加え、分野別50問と日英対訳模試2セット(各60問)を収録し、失敗処理・バッチ処理・資料統合など実装スキルまで習得できる。