
AIエージェント2台が同じLPを「5プロンプト」で作成――自己評価と実品質の乖離を実験で検証
ZennClaude Code と Gemini Antigravity を用いてバイブコーディング(自然言語指示のみでコード生成)で同一LPを制作し、5プロンプト以内での完成度、品質ルーブリック、自己評価の信頼性を化学実験の手法で比較検証。AIの自己申告完成度%が実際の成果物品質と一致しない「過信現象」の有無を相互レビューで確認した記録。
全 1590 件 (Zenn で絞り込み) · 62 / 80 ページ

Claude Code と Gemini Antigravity を用いてバイブコーディング(自然言語指示のみでコード生成)で同一LPを制作し、5プロンプト以内での完成度、品質ルーブリック、自己評価の信頼性を化学実験の手法で比較検証。AIの自己申告完成度%が実際の成果物品質と一致しない「過信現象」の有無を相互レビューで確認した記録。

Java/Spring Boot 開発者向けに、Claude API と連携する 10 本のコピペ可能なスニペットをまとめた実装ガイド。anthropic-java 2.35.0 を使用した最小構成から、ストリーミング・Tool Use・Prompt Caching・RAG 統合まで、業務システムに組み込める実装テンプレートを Gumroad で配布。

Claude Opus 4.8の登場により、AIが自律的にタスクをこなす「エージェント時代」が現実化。性能・速度・自律性の三層進化に加え、Dynamic WorkflowsでAIがツール呼び出し・結果確認・次のアクション選択を自律実行できるようになった。Anthropicの企業価値がOpenAIを超えた背景には、エンタープライズ向け安全性と信頼性への集中投資がある。


Claude Code を使うコーディングエージェント時代に、CI 汚染・slopsquatting・承認疲れといった新しい攻撃面が増加している。Permission rules・hooks・CLAUDE.md・skills の 4 機構を役割分担させ、機械的に止める層と判断のための層を分けて設定することで、「気をつけよう」では防げないセキュリティリスクに対応する設計案。

Anthropic公式がComputer Use機能を本番環境で信頼性高く動作させるためのノウハウを公開。クリック精度改善、Thinking Effortの選択、コンテキスト管理、デモンストレーション記録など4つのポイントを通じ、UIを自律操作するエージェントの実装と運用方法を解説している。

QA エンジニアが Claude Code とテスト設計を協働する中で、セッション間で記憶がリセットされることが原因で同じミスが繰り返される問題に直面。人間のチームに備わっている「振り返り会」と「試運転」という規律を AI にも適用し、フィードバック記録ファイルの永続化と振り返り Skill の自動生成を実装。結果として AI のミスパターンを約半減させ、潜在的な課題を継続的に可視化できるようになった。




Claude Opus 4.8 に搭載された動的ワークフロー(Dynamic Workflows)は、単一セッション内で数十~数百のサブエージェントを並列実行し、成果物を検証してからユーザーに報告する機能。横長動画1本から縦型ショート動画11本を同時生成する実例を通じて、オーケストレーション機能の仕組み・トークン消費量・起動方法・向いているタスクを解説。

Claude Code の auto memory 機能が、CLAUDE.md やスキルプロンプトなどで明示的に整備された開発規約と矛盾し、ワークフロー YAML との競合やレビュー収束の遅延を引き起こすケースを報告。3 件の memory がプロジェクト方針と衝突していた実例と、autoMemoryEnabled: false での対策、または CLAUDE.md への規約統一で解決する方法を紹介。

Anthropic が 2026年5月にリサーチプレビュー公開した Agent View は、Claude Code で動作する複数のバックグラウンドセッションを1画面の一覧で管理できる機能です。PR レビュー・バグ修正・機能追加など複数タスクを並行実行しながら、入力が必要な AI セッションだけを選んで対応する workflow を実現します。

Claude Code で複数行テキスト (801文字以上または4行以上) をペーストすると [Pasted text #N +M lines] として畳まれる。編集方法は2つ:再度ペーストして展開するか、Ctrl + G で外部エディターを開いて修正する。


Claude Opus 4.8 リリース直後、複数の AI サブセッションが数時間で 5 回終了する事象が発生。コードと思考を二重永続化し親セッションが痕跡から再構成する「回復力設計」で初期はロスゼロで吸収したが、リカバリ頻度が上がると時間が前進を侵食。そこで実行環境を Claude Desktop から CLI に切り替えた。


Claude Code 2.x で AWS MCP Server を使用する際、AssumeRole + MFA + 企業プロキシ(SSL インスペクション)の環境下で「No MCP servers configured」「failed」エラーに遭遇。グローバル設定とプロジェクト側の .mcp.json を併用し、uvx のフルパス指定、AWS CLI 事前検証、SSL 証明書チェーンの明示的登録などで解決した実装記。

Anthropic が 2026年5月28日に発表した Claude Opus 4.8 は SWE-Bench Pro で69.2%を達成し、GPT-5.5・Gemini 3.1 Pro を上回るコーディング性能を獲得。本記事では Messages API と Tool use による最小構成での導入方法と、副業エンジニアが複雑なタスクを任せる際の検証・統合の重要性を解説。他モデルとの使い分けも示唆。

プログラミング経験ゼロの個人開発者がClaude Codeを用いて、建設業向けの工事原価管理SaaS「GenKa」を8時間で開発・本番公開。日本語指示でNext.js・Supabase・Vercelを組み合わせたアプリを完成させ、エラー対応やDB設計もClaude Codeと協働で実現。