自作の AI チェックツールに、自分自身を審査させたら穴が見つかった話
Hiroba による自動要約
複数の AI エージェント運用で見つかった「根拠のない主張」の 2 つの壊れ方——抽象と具体の極端さ、外部検証なしの自己完結——を「Gate 1」「Gate 2」の 2 つのチェック問い として Claude Code Skill に落とし込んだ著者が、公開直後にそのツール自体に Gate 2 を向けたところ、新規性主張が外部照合を経ていないことが判明。既存ツール (grounding-inspector など) との比較を経て、README を正直に書き直し、個人開発規模での自己参照的な設計思想の有効性を記録した。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 5095 件あります。
関連する記事
同じタグの記事

Claude Code のブラウザ操作を使った Web システムの単体テスト自動化
Zennフリーランス SE が Claude Code の Skill 機能を使い、仕様書・画面・DB の 3 つを判断材料として、ソースコード参照やスクリプト作成を禁止した人間に近いテストアプローチを実験。同値分割・境界値分析・状態遷移などの単体テスト技法を適用しながら探索的にテストを実施し、エビデンスを自動保存する仕組みを検証した。

資料から理解度クイズを自動生成する Agent Skill「rikai」—読んだと理解したのギャップを測定
Zennmeiseki プラグインに追加された Agent Skill「rikai」は、日本語資料から選択式クイズを自動生成し、3回挑戦法で理解度を段階的に測定します。誤答した問題は異なる角度から再出題され、解説は絵解きノート (HTML) とテキストブック (PDF) として蓄積され、書き手向けのレポートで誤読が集中した段落を改善に繋げる仕組み。Claude Code で動作確認済み、特定ホストに依存しない設計。
Claude Code ルーチンセッションクリーンアップスキル
HNClaude Code のスケジュール実行(ルーチン)が生成する古いセッションを一括削除する Skill。最新 N 個を保持し、ユーザーが返信したセッションは保護しながら、デスクトップアプリ自体のツールを通じて 25 個ずつ削除する仕組み。ルーチンの実行回数が多い場合、数百のセッションがたまって容量を圧迫する問題を解決する。

/claude-api prompt-audit とは? 古いモデル向けプロンプトの「残骸」を見つけるコマンド
QiitaClaude Code に同梱される `/claude-api prompt-audit` は、プロンプト・スキル・ツール説明から「古いモデル向けに書かれた記述で今では逆効果になっている部分」を検出するコマンド。過剰な強調指示(MUST / NEVER)や実態と食い違った数値・手順を High / Medium / Low の確度で指摘し、根拠付きレポートと修正案の diff を出力する。取り込むかどうかは利用者が判断する。