GPT-5.6 Sol/Terra と Claude Opus 4.8 の 0→1 開発比較:Skills 遵守とコード品質を検証
Hiroba による自動要約
2026年7月、複数の GPT および Claude モデルに同じ Django アプリケーション開発を任せ、Skills 遵守度・ロジック品質・ユニットテスト品質を比較した。GPT-5.6 Terra は Skills を無視、Sol High は遵守しロジック満足だが UT ケース不足、Claude Opus 4.8 High はロジック・UT ともに最高品質だが処理時間が約 3 倍という結果。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 5171 件あります。
関連する記事
同じタグの記事

Claude Code 手順書が3週間で陳腐化—常駐 context 棚卸しスキル 1.2.0 公開
QiitaClaude Code 2.1.278 向けの手順書が 2.1.295 で既に古くなり、確認用コマンドまで動作しなくなった。バージョン間での仕様変更(短縮変数名の変更、説明文の長さ制限超過など)に対応し、claude-code-context-diet スキルを 1.2.0 にアップデート。/context、/doctor prompt-audit を活用した実測ベースの context 削減手順を公開。

APM で Claude Code と Codex のスキルを一元管理する手順
DevIOMicrosoft の Agent Package Manager(APM)を使い、apm.yml で Claude Code と Codex のスキル・エージェント定義・MCP サーバー設定を一元管理し、apm install で各ツールに自動展開する手法を検証しました。ロックファイルによる環境再現・セキュリティ検査・改ざん検知の挙動も実装例として紹介します。

オブジェクト指向UIデザインをAgent Skillにして、Claudeが作るUIはどう変わるかの検証
ZennClaude Codeで生成されたUIの改善指示が曖昧になりがちな課題に対し、『オブジェクト指向UIデザイン』の設計原則を4つに整理してAgent Skillとして実装。スキルの有無で生成されるUI構造がどう変わるかを検証し、タスク指向ではなくオブジェクト指向の画面構造を誘導する方法を示した。

Claude Mods と Output Style で、Claude Code を執筆用のハーネスにする
ZennClaude Code で記事執筆時に、グローバルのコード用ハーネス(スキル 98 件、26,252 字)が不要に読み込まれる問題を、Claude Mods でリポジトリごとにスキル・エージェント・指示ファイルを選別し、Output Style で出力スタイルを指定することで解決。harness-scope プラグインを使い、プロファイルで外すものをリスト化し、設定の限界を超えたきめ細かいハーネス構築が可能に。