Claude Skills の評価駆動開発を skill-creator から読む
Hiroba による自動要約
Anthropic の Agent Skills 開発では、Skill 作成前に評価を設計する評価駆動開発が推奨されている。skill-creator の実装例から、ベースライン測定、自動・AI・人間による多層的な評価方法、そして evidence に基づく客観的判定の具体的な仕組みが見える。Skill は評価とセットで改善するソフトウェア資産として扱う必要がある。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 4004 件あります。
関連する記事
同じタグの記事

Claude Code のスキルが重い? `/skill-doctor` で「コンテキスト税」を可視化して安全に削る
QiitaClaude Code でスキルを増やしすぎるとコンテキストを消費する問題と、v2.1.261 で追加された `/skill-doctor` コマンドで未使用スキルとコスト内訳を把握し、disable-model-invocation や分割などで削減する手法を解説。スキルの name + description 一覧が常時コンテキストに載る仕様と、listing 予算の 1% 制限により説明が削られると Claude が拾ってくれなくなる現象の原因を具体的に紹介。
Claude Code の高度なコンテキストエンジニアリング技法とパターン
HNNeoLabHQ が開発した Claude Code 向けのコンテキストエンジニアリングキット。トークン効率と結果品質を最適化した複数の Skills (Spec-Driven Development、DDD、Tech Stack など) を提供し、必要なプラグインのみ個別インストール可能。v3.1.0 では code reviewer エージェントを追加し、コード複雑度の削減と品質向上を実現。

Claude Code に Profile 機能を導入する
ZennClaude Code の設定を用途ごとに切り替える Profile 機能を CLAUDE_CONFIG_DIR 環境変数と skim (Fuzzy Finder) を組み合わせて実装。開発・ドキュメント作成・ミーティング記録など異なる用途のスキルセットを役割ごとに分離でき、不要なコンテキスト消費と誤発動を削減できる。
