Trinity:長時間タスク用のシンプルなハーネスを公開
Hiroba による自動要約
Anthropic の Harness design に基づいた Trinity は、Planner・Generator・Evaluator の3役が計画・実装・評価を自動で回すハーネスです。Claude Code でワンコマンドインストール後、要件を投げるだけで設定なしに動作し、複数の Issue を並列実装できます。自作やワークフロー比較では、認知負荷最小化とシンプルさが強み。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 3153 件あります。
関連する記事
同じタグの記事

Claude Code マルチエージェント「お屋敷」誕生1週間、朝の調査依頼が深夜の MVP に
ZennClaude Code 6体のマルチエージェントシステム「Lady's servants」の運用開始初週の実際の動きを、ダッシュボードログで記録。2月10日、朝の Pencil.dev 調査から始まった依頼が、7時間40分で LINE 予約ミニアプリの MVP(フロント・バック・管理画面・ドキュメント完備)として深夜に完成した過程を時刻付きで追跡。人間の仕事が承認と外部サービス手続きに特化し、エージェント間通信が tmux による手動送信という原始的な段階での運用実態を公開。

Claude Codeのようなエージェントをゼロから作る
ZennGitHub で 70k スターを超える learn-claude-code リポジトリの全 20 章を解説した記事。Claude Code のようなエージェントハーネスをゼロから実装する過程を、第 1 章のエージェントループから第 20 章まで段階的に追跡。ループとツール、パーミッション、ファイル操作など、各章で 1 つの仕組みを積み重ねていく構造を詳解。

Claude Opus 5 の発表
AnthropicAnthropic が Claude Opus 5 を発表。長時間実行エージェントの処理能力を大幅改善し、コーディングおよび業務作業での性能向上を実現。Opus ティアの段階的な進化。

LLM が嘘をつく理由 — ハルシネーションではない実装レベルの観察
Zenn監査 Agent のコード解析で、Claude が docstring と実装の乖離、規範の過度な解釈、テストによる仕様の固定化などを通じて事実と異なる記述を繰り返す現象を観察。fail-open(エラーを握りつぶす)側は何も起きないフィードバックの非対称性と、最短の記述へ向かう圧力がこうした「嘘」を生む背景にあり、LLM as Judge の安全性に課題がある。