
なぜ GPT と Claude はチャットとコード生成で「逆の性格」に見えるのか
ZennClaude と GPT-5.6 Sol はチャットでは対照的に見える(GPT は仮説を膨らませ、Claude は論理の穴を指摘)が、コード生成では役割が逆転したように見える。しかし実際には同じモデル特性が、環境の違い(文章 vs 検証可能なコード)によって別の行動として表面化しているだけ。両者の根本的な違いは「従順か頑固か」ではなく、ユーザー指示への従順性と社会的迎合性のバランスの差にある。
全 2089 件 (Zenn で絞り込み) · 16 / 105 ページ

Claude と GPT-5.6 Sol はチャットでは対照的に見える(GPT は仮説を膨らませ、Claude は論理の穴を指摘)が、コード生成では役割が逆転したように見える。しかし実際には同じモデル特性が、環境の違い(文章 vs 検証可能なコード)によって別の行動として表面化しているだけ。両者の根本的な違いは「従順か頑固か」ではなく、ユーザー指示への従順性と社会的迎合性のバランスの差にある。


Claude Code で同じ指示を毎回繰り返す問題を解決するため、CLAUDE.md・メモリ・Skills・Hooks の 4 つの機能を「情報が Claude の目の前に出るタイミング」で分類。「何ができるか」ではなく「どこに置くか」を判断する逆算的な考え方と、コンテキストウィンドウの有限性・視認性の問題を踏まえた使い分けを解説。

Claude Code の hooks 機能について、設計思想から実装まで学ぶ学習記事(Day 41)。hooks はユーザー定義のハンドラとして Claude Code のライフサイクル内の決められた時点で確実に処理を実行する機構で、シェルコマンドから MCP ツール、HTTP エンドポイント、Agent まで複数の形式で実装可能。プロジェクトルール強制・自動フォーマット・危険コマンドブロック等の用途がある。

settings.json のスキーマ全体を解説する学習記事。スコープ・型・既定値・サンプルの4要素で構成され、Model / Permission / Sandbox など主要グループを紹介。貼り付け前のスコープ確認と既定値の確認が間違い防止の習慣として強調される。

CLAUDE.md に記録した品質チェック習慣(Ruff strict・mypy strict・vulture)を別プロジェクトに移植した実地検証。テストなしのリポジトリへ適用する際にスコープ調整が必要となり、さらに mypy が pydantic の動的コンストラクタを追えず誤検知を起こす問題を発見。ツール警告も独立した手段で検証する必要性を実証。



Claude Code 上で QA プロセスを自動化する AI エージェント「qa-orchestrator」の運用で、仕様書に明記されない「UI 要素の確認すべき振る舞い」が抜けやすい課題が発生。これを解決するため、UI 要素 × 役割をキーとした「テスト観点カタログ」を設計・運用開始。実装段階でカタログ由来の観点が約半数を占め、レビューで削除されたものがなく、観点の漏れを構造的に防ぐ手法を確立。
複数の AI Agent に対応した CLI ツール ccsession を開発。異なるフォーマット (Claude Code と Codex の JSONL) で保存された過去セッションの履歴を統合データ構造として抽象化し、検索・再開機能を実装。


Next.js + Convex プロジェクトで Claude Code (Fable/Opus/Sonnet) を使用する開発者が、API トークン消費を計測・最適化した結果を報告。サブエージェント起動時のモデル明示化で $259 の無駄を根絶、実装委任をカスケード方式(安いモデル優先→失敗時昇格)に変更することで出力トークン −42% を達成、品質低下なし。

Claude Code による AI駆動開発で開発速度が向上する一方、AIが生成したコードの安全性やエージェントへの権限委譲をめぐるセキュリティリスクが顕在化している。Laravel を例に IPA・OWASP ASVS の基準に基づいた脆弱性対策とコードレビュー観点を具体化し、速度と安全のバランスをどこに引くかの実践的な落とし所をまとめた記事。

Amazon Bedrockで初回利用時、ユースケース情報を提出後もClause Sonnet 4.6の呼び出しがAccessDeniedException で失敗する事象を報告。PutUseCaseForModelAccessの成功とCreateFoundationModelAgreementの実行は別手続きであること、AWS Marketplace権限(aws-marketplace:ViewSubscriptions等)が必要なこと、AWS CLIでモデル契約を明示的に作成すると解決することを実証。初回有効化に必要な権限とアカウント設定を混同しやすい点を整理。

Ubuntu Serverの障害対応で「検知は自動化、調査と判断は人間」の役割分担を実装した事例。Claude Codeで実運用環境を調査し、13本の運用スキルとして体系化。Hermes Agentがログ・プロセス状態から初期診断を返し、管理者の判断材料を整える仕組みを共有。実機検証で動かなかったコマンドを修正し、再利用可能に整備した。

同じマシンで複数の Claude Code セッションを並列実行すると、タスクの重複着手や成果の取りこぼし、設定ファイルの上書き事故が発生する。これを防ぐため、1 年弱かけて構築した自作機構 Foreman の設計思想と実装を解説。orchestrator(幹)が worker(葉)セッションを起動し、追記専用の台帳(ledger)を唯一の正本として、advisory ベースの協調制御でタスク配分・回収・検証を行う仕組み。

Matt Pocock skills の /implement コマンドは 1 セッション 1 チケットの制限があるため、Claude Code のサブエージェント機能(Agent tool、SendMessage、worktree.baseRef、.worktreeinclude)を活用して複数チケットを並列処理する /implement-orchestrated スキルを開発。チケットごとに coder を worktree で最大 N 並列起動し、SendMessage でコンテキストを維持したまま修正指示を送信できる仕組み。

Claude API・Agent SDK・MCP・Claude Codeの設計判断を体系的に学ぶ日本語教材。解説・図解・実習コードに加え、分野別50問と日英対訳模試2セット(各60問)を収録し、失敗処理・バッチ処理・資料統合など実装スキルまで習得できる。

