
自作MCPサーバで「Tool Poisoning」を試してみた(Claude Codeは騙されるのか?)
ZennZenn の著者が、MCP サーバのツール説明文(description)と実際の動作を意図的に食い違わせる「Tool Poisoning」を検証。メモ管理 MCP サーバを自作し、説明文や関数名を偽装した場合に Claude がどう振る舞うかを実験。MCP の基本概念と実装方法も解説。
全 5485 件 · 81 / 275 ページ

Zenn の著者が、MCP サーバのツール説明文(description)と実際の動作を意図的に食い違わせる「Tool Poisoning」を検証。メモ管理 MCP サーバを自作し、説明文や関数名を偽装した場合に Claude がどう振る舞うかを実験。MCP の基本概念と実装方法も解説。

OpenRouter の :free サフィックス付きモデル (Qwen3、Llama 4 など) を使うと、API コールを無料で実行でき、Claude Code 環境でコミットメッセージ生成や PR レビュー初稿作成など定型タスクを大幅低コスト化できる。ただし各モデルのオリジナルライセンスと共有キューのレートリミット確認が必須。



Opus 5 で effort を xhigh から medium に下げたら出力品質が上がった。thinking がデフォルト ON になり budget_tokens が廃止され、effort の役割そのものが変わった。effort は品質の下限を決めるのではなく、プロンプト品質を増幅する係数になり、仕様が薄いまま effort を上げると推測が増えて品質が低下する。

Claude Code v2.1.239 で、プロキシが Content-Type ヘッダを削除する環境下での Bedrock ストリーミング二重課金バグが修正された。ストリーミング失敗時に同じターンを自動で非ストリーミングで再実行していたため、実際の作業量の 2 倍が課金対象になっていた。他に /claude-api upgrade コマンド追加、セッション管理の競合修正、設定ファイル読み込みエラーの改善など既存機能の安定化が実施された。


Claude Code の拡張機能群(CLAUDE.md、skills、MCP、subagents、hooks、dynamic workflows など)を「解決すべき問題」の観点から分類・体系化したマップを提供。機能の仕組み(モデル選択、コンテキスト管理、外部接続、スケーリング)の詳細を理解することで、ワークフロー上のどのペインポイントにどの機能を適用すべきかが判断できるようになる。

Claude Code と Cowork は同じエンジンながら、動作環境(手元 PC か VM 隔離か)と操作範囲(プロジェクト全体か指定フォルダのみか)で異なる。開発・Git・DB接続は Claude Code、Excel・PowerPoint・SaaS操作は Cowork が最適。用途ごとの判定表により選択基準を明示。

2026年8月19日、Anthropic は Computer use、Browser tool、Files API、Agent Skills API の四つを beta から GA(正式版)に移行させた。beta header の削除は技術的な整理ではなく、企業が本番環境で使用できるか判断する責任の転換を意味し、特に Computer use のバッチアクション対応によりエージェントの実行コストと推論ステップが削減される。Academy の公開は3月のため、本当のニュースは講座ではなく API の安定性保証である。


Claude Code に追加された「Concise」出力スタイルは、調査・実装の質は変わらず、回答の順序を「結論ファースト」に変更する機能。Fable 5 との組み合わせで特に効果的で、長めの説明を読む前に判断に必要な情報を先に受け取れるようになった。/config から Output style を Concise に切り替えるだけで設定完了。

Epho は Claude Code、Codex、Opencode をクラウドのサンドボックスで実行できる API。HTTP リクエスト一つでコード実行環境をブートストラップし、リポジトリのクローン、MCP サーバーの接続、エージェントの実行を自動化。複数のサンドボックスプロバイダー間でのフォールバック、認証、ロギングをハンドリングして、イベントストリーミングで結果を返す。

AWS Security Hub MCP App が Claude Desktop で利用可能になった。ローカルで動作する read-only MCP サーバーで、複数の AWS アカウントにわたるセキュリティ Findings を数分で相関分析でき、エスカレーション対応・顧客報告資料作成・CVE トリアージの根拠づけなど 6 つの実務活用シーンが想定される。従来は複数の AWS コンソール画面を横断していた分析が 1-2 ターンの会話で完結する。
Google 検索で Claude Code のインストール方法を検索した際、悪質な Claude artifact が上位に表示され、macOS infostealer をインストールされるケースが報告された。ユーザーが意図せず悪質なコンテンツにアクセスするリスクがある。

