
全 2116 件 (Zenn で絞り込み) · 28 / 106 ページ




iOS アプリ開発の自動化に向けて planner → generator → evaluator の3エージェント構成ハーネスを構築した際、コード生成担当の generator に最適なモデル選択で複数回の検証を経験。Claude Sonnet・Codex・MiniMax M3 を試したが、利用制限の問題により Claude Code Max プランが最適という結論に到達した試行錯誤の記録。

Claude Code と Gemini CLI を役割分担させ、GA4 BigQuery エクスポートデータから EC 分析を行う実装例。Claude Code で SQL 設計・修正、Gemini CLI でビジネス解釈・施策提案を担当し、bash スクリプトで連携させることで分析品質とスピードを向上させる手法を解説。

複数の AI エージェント運用で見つかった「根拠のない主張」の 2 つの壊れ方——抽象と具体の極端さ、外部検証なしの自己完結——を「Gate 1」「Gate 2」の 2 つのチェック問い として Claude Code Skill に落とし込んだ著者が、公開直後にそのツール自体に Gate 2 を向けたところ、新規性主張が外部照合を経ていないことが判明。既存ツール (grounding-inspector など) との比較を経て、README を正直に書き直し、個人開発規模での自己参照的な設計思想の有効性を記録した。

Claude Codeの長時間セッション運用で、引き継ぎプロンプトの繰り返しに疲れている開発者向け。ステートファイル(LANE_STATE.md)を軸に、1タスクごとに使い捨てセッション(claude -p)を実行する「STATE LOOP」という運用を提案。常駐セッション30万トークンから1周2万トークン程度に削減し、引き継ぎを完全に廃止した実例。

Claude CodeやCursorなどのAIコーディングエージェントと開発する際、AIに渡すべき権限を制限するルールを4つ提示。本番環境へのデプロイは人間専用、本番DBは読み取り専用、秘密情報は Secret Manager に隔離、無人動作するAIはさらに権限を絞るという実装パターン。2025年の Replit 事件(AIが本番DBを削除)を教訓に、「指示で防ぐ」より「仕組みで防ぐ」アプローチの重要性を解説。


個人開発で監視カメラサービスを実装する際、技術選定をADR、機能仕様をSpecとして形式的に記録・管理している。一人開発でこの手法を徹底する理由は、セッションが変わるたびに文脈を失うClaude Codeとの開発において、判断の一貫性を保つための共有コンテキストが必要だから。実装前にドキュメントを確認するルール化により、矛盾した実装を未然に防ぐ効果も確認されている。

複数モデルで開発品質を統一するため、Playbook の「判断が必要なルール」と「機械判定できるルール」を分離。後者を Claude Code の PostToolUse Hook で自動検査する仕組みを ccteams に実装。プロンプト依存の確率的遵守から決定的チェックに移行し、トークン効率向上と Haikuでの安定性向上を実現。

利用量削減を目的に、通常は Sonnet で実装・テスト・調査を行い、難しい問題に応じて Opus(Advisor)・Codex Sol・Fable へ段階的にエスカレーションする仕組みを ~/.claude/ 配下の設定ファイルで構築する例。settings.json、CLAUDE.md、fable-escalation.md による 3 層階層で役割分担する。



社会科学系研究者が8ヶ月間 Claude Code と本気で向き合った結果、AIの失敗パターンから導き出した6つの運用原則を実例とともに紹介。記憶のリセット・読み飛ばし・ルール無視など AIの特性に対し、メモリファイル・外部脳・検査ゲート・承認制などの仕組みで対抗する具体的手法を解説。





Claude Codeの MEMORY 機能は時間とともに肥大化・陳腐化・矛盾が発生し、能力が低下する問題がある。Rust エンジニアが memory-gc と promote-knowledge という自作スキルを開発し、SessionStart フックでの整合性チェック、/memory-gc コマンドによる棚卸し・整理・アーカイブ機能を実装。1ヶ月運用で有効性を確認し GitHub で公開。