自作の「ラン全体シミュレーター」が、ただの平均値に負けた話
Hiroba による自動要約
Claude が Slay the Spire 2 で A6 難易度をプレイする企画の一環で、勝率向上のため独自のシミュレーターを開発しました。デッキ強度の単一数値化、戦闘エンジンの実装、評価指標の不備など複数の失敗を経験し、最終的には「勝率の絶対値」ではなく「選択肢の相対比較」用途に方針転換。外部データベース導入とデータ信頼度の段階評価により、見かけ上の効果と実際の効果の乖離を学習した記録。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 4772 件あります。
関連する記事
同じタグの記事

「Vibe Coding」はもう卒業!プラグイン「Superpowers」でClaude Codeに開発SOP を導入する
QiitaClaude Code で AI がいきなりコードを書く「Vibe Coding」の問題を解決するオープンソースプラグイン「Superpowers」を紹介。仕様の明確化・設計・テスト駆動開発・レビューを強制する 7 フェーズパイプラインにより、手戻りの削減と品質の安定化を実現する。

Claude Code だけで要件定義から本番デプロイまで完走した話 - サモエドカフェのファンサイトを実働10時間で作った
Zenn個人開発者が Claude Code を要件定義から本番デプロイまで使い、サモエドカフェのファンサイト「アルファン」を実働10時間未満で完成させた。並列エージェントで7件の Issue を同時処理し、本番バグとデータ消失も AI の支援で復旧。開発のプロセスが「コード実装」から「仕様判断と品質確認」にシフトした実例

Claude「Computer Use」を本番環境で安定稼働させるための実践ガイド
ZennAnthropic公式がComputer Use機能を本番環境で信頼性高く動作させるためのノウハウを公開。クリック精度改善、Thinking Effortの選択、コンテキスト管理、デモンストレーション記録など4つのポイントを通じ、UIを自律操作するエージェントの実装と運用方法を解説している。

Opus 5.5 切り替え後、/code-review が勝手にサブエージェント10体を並列起動し、数分で使用枠上限に到達
ZennOpus 5.5 への切り替えと同時に effort を max に変更したところ、通常は1体だった /code-review のサブエージェントが10体の並列起動を始め、8分・4分で5時間枠の上限に達した。原因は高いモデルの委任能力と max effort による範囲拡大、20体上限の既定値が重なったもので、対策として何も知らない1体のエージェントに正しさのみをレビューさせる形に変更したところ問題解決。