初めてのハーネス設計に挑戦:Claude → Codex → MiniMax M3 の試行錯誤
Hiroba による自動要約
iOS アプリ開発の自動化に向けて planner → generator → evaluator の3エージェント構成ハーネスを構築した際、コード生成担当の generator に最適なモデル選択で複数回の検証を経験。Claude Sonnet・Codex・MiniMax M3 を試したが、利用制限の問題により Claude Code Max プランが最適という結論に到達した試行錯誤の記録。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 4336 件あります。
関連する記事
同じタグの記事

Ubuntu Server運用の実例:Claude Codeで設計し、Hermes Agentで実行する監視・診断体系
ZennUbuntu Serverの障害対応で「検知は自動化、調査と判断は人間」の役割分担を実装した事例。Claude Codeで実運用環境を調査し、13本の運用スキルとして体系化。Hermes Agentがログ・プロセス状態から初期診断を返し、管理者の判断材料を整える仕組みを共有。実機検証で動かなかったコマンドを修正し、再利用可能に整備した。

AI エージェントに業務を任せるときの境界線──責任が及ぶ範囲を決める
Zenn著者が Gmail、Google Chat、Slack の監視を AI エージェントに任せた 3 週間の実運用から、何を任せて何を任せないかの判断基準を整理した記事。検知・集約・記録は AI に、返信や価格判断など責任が伴う決定は人に残し、誤検知と見落としのコストの非対称性からルールベースではなく生成 AI を選んだ理由を述べている。

複数 AI モデルの協調ワークフロー構築と実践検証
Qiita著者は Codex CLI・Claude Code CLI・Gemini を協調させる自作スキルを開発し、複数 AI 間の出力受け渡しの負荷軽減を実現。6 モデルを 18 試行で検証し、変更容易性を評価軸に加えたベンチマークから役割分担を決定。その結果、企画から実装・レビューまでを AI 同士に委ねられるようになり、人間は「何をしたいか」に集中可能になった。
sub agents がコードベースにリリースされている
Redditユーザーが Claude の sub agents 機能がコードベースに展開される様子を報告。この機能により、Claude が自律的にサブエージェントを生成・実行してコード生成や問題解決を進行できるようになる。開発プロセスの自動化と並列処理が実現される可能性を指摘。