GPT-5.6 Sol/Terra と Claude Opus 4.8 の 0→1 開発比較:Skills 遵守とコード品質を検証
Hiroba による自動要約
2026年7月、複数の GPT および Claude モデルに同じ Django アプリケーション開発を任せ、Skills 遵守度・ロジック品質・ユニットテスト品質を比較した。GPT-5.6 Terra は Skills を無視、Sol High は遵守しロジック満足だが UT ケース不足、Claude Opus 4.8 High はロジック・UT ともに最高品質だが処理時間が約 3 倍という結果。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 3827 件あります。
関連する記事
同じタグの記事

Claude Skills とは何か?MCP / Rules / サブエージェントとの違いと、自作 Skill の作り方
QiitaClaude Skills は、繰り返し依頼される定型タスクの「やり方」を Markdown ファイルで定義し、該当する依頼が来た時だけ動的に読み込まれる再利用可能な手順書。MCP・Rules・サブエージェントとの役割の違いを整理したうえで、skill-creator を使った自作 Skill 開発と、eval による効果の定量検証まで実装例を交えて解説。
Claude Code から Codex を呼び出す − Harness オーケストレータスキル
HN複数の coding agent を組み合わせるための Claude Skills 形式のオーケストレーション機能。親エージェント(Claude Code / Grok Bot など)が簡潔なブリーフを書いて別の agent に処理を委譲し、結果を統合する仕組み。異なるモデルが相互に検証することで、単一モデルの盲点を補う。

Claude Codeで設計書用スキルを定義するベストプラクティス─役立つ5つの方法
QiitaClaude Codeで設計書生成スキルの出力ブレを抑えるため、description欄へのトリガー条件明記、Markdownテンプレートによる見出し固定、サブエージェントとスキルの役割分離、参照ファイルパスの明示、Explore→Plan→Codeサイクルの導入という5つの方法を解説。型・粒度・参照先の3点を固定することで再現性が大きく向上する。

AWS Solution Skills を Claude Code と Kiro で比較:同じ Sonnet 4.5 でも結果は変わる?
ZennAWS Solution Skills を用いて、Claude Code(Amazon Bedrock 経由)と Kiro CLI で同じ Skill・同じモデル(Claude Sonnet 4.5)を使った場合の成果物の違いを検証。Claude Code は設計・ドキュメント重視だが実装不足、Kiro は実コード多出だが API 整合性の問題が発生し、両者ともローカル検証で cdk synth 失敗となった。