
全 1275 件 (Qiita で絞り込み) · 30 / 64 ページ


Anthropic公開のClaude Agent SDKはClaude Codeをライブラリとして利用可能にし、Agent Loopを自動化するSDK。従来の開発者実装のLLM→Tool実行ループが不要になり、query()呼び出しで判断・実行・確認・コンテキスト管理を自律実行。Sub Agent構文とHooks機能により複雑なマルチエージェントワークフローが管理しやすくなった。



Claude Code はファイル操作を伴うエージェントのため、曖昧な指示は予測しにくい動作につながる。効く指示は「症状・目的」「関係する場所」「既存実装の手本」「禁止事項」「完了条件」の5点を入れるだけで安定し、テンプレートと plan mode で品質と安全性を両立させられる。


2026年7月2日の Crazyrouter API 実測に基づく本番運用向けの統合検証。Claude Sonnet 5 と GPT-5.4 の両モデルが HTTP 200 で応答したが、JSON 形式と prompt-token 測定値に差異が確認された。GPT-5.4 は小さい JSON を直接返す一方、Claude Sonnet 5 はマークダウンフェンス内に JSON を返す。コスト判断前に GPT-5.4 の高い prompt-token 値の再測定を推奨。

Claude Code v2.1.198 がリリース。Chrome 拡張「Claude in Chrome」が一般提供開始し、バックグラウンドエージェントは確認なしで自動的に commit・push・ドラフト PR を作成するようになった。ブランチ保護ルールを運用するチームは意図しない push やドラフト PR 乱立への対応が必要。加えて /agents ウィザードが廃止され、ドキュメント・運用手順の見直しが必須。

Anthropicは6月30日にClaude Sonnet 5をリリース。Opusクラスの自律的なエージェント機能を大幅に低価格で実現し、セキュリティ評価も優れている。同時にClaude Scienceをベータ公開。60以上の科学データベースを統合し、研究時間を10分の1に短縮する事例も報告された。一方OpenAIのGPT-5.6シリーズは全モデルが「ハイリスク」分類となり、米国政府の要請で限定公開となった。

Anthropic は米国政府の輸出規制指令撤回に伴い、2026年7月1日から Fable 5 を全世界で再提供開始。同時に Amazon・Microsoft・Google などと共同で、ジェイルブレイクの深刻度を評価する業界共通スコアリングフレームワークを提案。開発者は停止対応で実装したフォールバック処理やドキュメント更新が必要。


ソースコード解説記事を「その場で手書き」ではなく CLI 工程に乗せて生成・検査するワークフローを解説。llm-task-router と Claude Code のスラッシュコマンドを組み合わせ、記事骨格の生成→改善→事実関係の裏取り→整形→出力という段階的な工程で、壊れにくく裏取りしやすい記事作成を実現する方法論。


Claude Fable 5 が一時停止・復旧された事象を通じて、LLM は政策判断や政府規制によって利用が制限される可能性があり、開発者は単一モデルへの依存を避けるべき設計を採用すべきことが明らかになった。モデル選定だけでなく運用戦略、フォールバック体制、監査ログ、人間承認ゲートなど、インフラレベルの堅牢性が必須となる。

Notion 3.6がリリースされ、Claude・Cursorなどの外部エージェントをNotionボードから直接呼び出せる「External Agents」機能、Mercury・Mixpanel・Miro・Box・ClickHouseなど5つのMCP接続の標準搭載、Office/PDF読み書き・Outlook連携が追加。NotionはドキュメントツールからAIエージェント・オーケストレーション基盤へと進化し、チーム全体でエージェント実行を追跡・管理できるようになった。


Claude Code で実装タスクを高速化させると、レビューがボトルネックになる課題に対し、Verification(技術的正確性)と Validation(要件充足性)の 2 軸を別々のサブエージェントに分離する設計を紹介。.claude/agents/ に code-verifier と requirement-validator を配置し、それぞれ異なる情報・判断基準で動かすことで、「完璧に動くけど見当違い」な実装を捕捉可能にする。

Claude Code v2.1.198 で背景エージェントが worktree での作業完了後、commit・push・draft PR 作成まで自動実行するようになった。入力待ち・完了時に agent_needs_input / agent_completed で Notification フックが発火し、離席中の処理進行状況をリアルタイム把握可能に。Explore がメインモデル継承、ネットワーク瞬断時の再試行強化等で安定性も向上。


Claude Code を用途別(検証・日常作業・本番補助)に分け、ANTHROPIC_BASE_URL、API key、ログ確認を経路ごとに分離する設計を解説。モデル選択(/model、ANTHROPIC_MODEL)と送信先(ANTHROPIC_BASE_URL)を分けて管理することで、コスト追跡と障害時の調査が容易になる実装方法を紹介。