Anthropic最新研究まとめ: Project Glasswing・AIの内部思考可視化・エージェント安全性
Hiroba による自動要約
Anthropicが2026年5月にリサーチページをリニューアルし、Natural Language Autoencoders(Claude の内部思考を人間が読めるテキストに変換する技術)、Teaching Claude why(エージェント利用時のミスアラインメント低減)、Project Glasswing(新重点プロジェクト)を公開。エージェント開発者と安全性研究者向けに、モデルの解釈性と信頼性を高める複数の技術進展を発表。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 2940 件あります。
関連する記事
同じタグの記事


Anthropic が四つの主要 API を正式版に昇格——Computer use、Browser tool、Files API、Skills API が beta を卒業
Qiita2026年8月19日、Anthropic は Computer use、Browser tool、Files API、Agent Skills API の四つを beta から GA(正式版)に移行させた。beta header の削除は技術的な整理ではなく、企業が本番環境で使用できるか判断する責任の転換を意味し、特に Computer use のバッチアクション対応によりエージェントの実行コストと推論ステップが削減される。Academy の公開は3月のため、本当のニュースは講座ではなく API の安定性保証である。

Claude API の Context Editing で長時間エージェントのコンテキスト溢れを防ぐ実装 — プロンプトキャッシュ破壊と exclude_tools、3つのハマりどころ
QiitaClaude API でツール呼び出しを繰り返すエージェントのコンテキスト溢れに対応する Context Editing 機能を Python で実装する方法を解説。context_management パラメータで古い tool_result を自動削除する一方、プロンプトキャッシュ破壊による追加コスト、重要なツール結果の誤削除、extended thinking との併用時の予期しない挙動という 3 つの実装上の落とし穴と対策(clear_at_least の増大、exclude_tools の活用、thinking ブロックの計測)を実例で紹介。
