Claude の内部思考を読む J-lens:Anthropic の解釈可能性研究が示す監視の新手法
Hiroba による自動要約
Anthropic が公開した J-lens は、Claude の出力より先に内部活性から「言葉にできる概念」を直接読み出す技術。ヤコビアン行列を用いてモデルの各レイヤーで「どの単語を言いやすくするか」を測定し、エージェントの隠れた意図や不正検知を出力の段階で捉えることが可能になった。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 4262 件あります。
関連する記事
同じタグの記事

Claude Fable 5.1 移行時はプロンプト追記だけでは足りない。既存エージェントの実装チェックリスト
ZennClaude Fable 5.1 へ既存エージェントを移行する際、モデルID とシステムプロンプトの変更だけでは API 互換性と会話継続性の問題が残る。thinking 設定、tool_choice 指定、メッセージ履歴管理、UI 層など四層に分けた実装チェックが必須。API 設定→会話ハーネス→プロンプト→Evals の順で修正し、新モデル上で再評価する必要がある。

Claude Code 2.1.258 で fable エイリアスの解決先とコスト内訳を実測
QiitaClaude Code 2.1.258 環境で `--model fable` が claude-fable-5-1 に解決されることを `--output-format json` で確認。1回の実行で両モデルが動作し、キャッシュ書き込みが主要コストとなる実測値から、Fable 5.1 のキャッシュ読み単価引き下げの効果範囲を逆算。エイリアス基準の運用ルールを組むエンジニア向けに、世代交代検知の具体的方法を提示。

実装で比較するAIコーディングツール2026:Claude Code・Copilot・Cursor・Windsurf・CodeiumをTier別に検証
QiitaClaude Code、GitHub Copilot、Cursor、Windsurf、Codeiumの5つのAIコーディングツールを、エージェント能力・ワークフロー統合度・コンテキスト理解力など5つの軸でTier分類し、実際のセットアップコマンド・設定ファイル・CI連携サンプルコードを示した実装寄りの比較記事。2026年の業界再編(Codeium→Windsurf統合、Cognition社買収)を背景に、機能一覧だけでなく実務判断に必要な検証情報を提供。

Claude Code で一番高いリクエストは「さっきの続きやって」かもしれない
ZennClaude Code のプロンプトキャッシュ TTL(Time To Live)切れ後の再開時、最初の 1 ターン目だけ入力コストが突出して高くなる。サブスク利用時は 1 時間、API キー利用時は 5 分でキャッシュが失効し、切れ直後は 1 時間 Write という高単価が適用される。Fable 5.1 の場合キャッシュ読み込み時と比べて最大 80 倍のコスト差が発生するが、これは Read が異様に安く設定されているためで、2 ターン目からは元に戻る。