自己成長するサブエージェントを「評価」してみた——本当の戦いは作った後だった
Hiroba による自動要約
Claude Code のサブエージェント機能を使い、レビューを支援する自己成長エージェントを構築・評価した実践記。ゴールデンタスクとルーブリックで測定した結果、プロンプトの具体性、呼び出し時の明確な指示、KB の原則化が挙動に与える影響が全く異なることが判明。未知の漏れを検出する真の「賢さ」を測るには、KB に記録されていない題材での評価が必須。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 4557 件あります。
関連する記事
同じタグの記事
Claude Code が AGENTS.md のネイティブサポートに対応
RedditClaude Code が AGENTS.md ファイルのネイティブサポートを追加。開発者は Agent 定義をより効率的に記述・管理でき、Claude との連携が強化される。

Claude Code で 9 体の AI エージェント経営 OS を構築した実践記録
QiitaClaude Code の Skill と Agent 機能を活用して、CEO・CFO・CTO・COO・CMO に加え秘書・ナレッジ管理・プロダクト管理・全体統合の 9 体のエージェントを役割分担させる「OpenClaw」経営 OS を構築。YAML フロントマター形式でエージェントを定義し、スラッシュコマンドで呼び出す設計と、cron による無人実行時の事故防止ルール(API コスト上限管理・対外発信は下書きまで等)を実装。

1年半かけて育ててきた Claude Code 開発フロー
Zenn実務で Claude Code を使用する開発者が、1年半の試行錯誤を経て確立した個人の開発フローを紹介。人間の介入負荷を減らすため、仕様合意後は AI が自走できるよう、サブエージェントによる役割分担と仕様ドキュメントを基軸とした判断ルール化に転換した。人間の判断地点を「仕様決定」と「最終承認」の2箇所に限定し、開発スピードと品質を両立させている。

コンテキストウィンドウの限界を逆手にとって AI エージェントの性能を向上させる方法
ZennAI エージェントの長時間運用で必ず直面するコンテキストウィンドウの上限問題に対し、業界標準の「コンパクション」が精度低下や安全制約の消失をもたらすことが明らかになった。本記事は現行の コンパクション 方式の問題点、代替案の Handoff、そして両者の課題を踏まえた「世代間相互検証ループ」という新しいアプローチを 2025-2026 年の一次情報から検証する。