
全 1573 件 (Zenn で絞り込み) · 37 / 79 ページ


Claude Code などのエージェント型 AI とベクトル検索型 RAG では、最適なドキュメント構造が異なる。エージェント探索なら階層構造 + index.md が速く安く迷いにくく、RAG ではメタデータとしてのタグが有効。両者の仕組みと使い分けを具体例・コスト試算・比較表で解説。


7月7日で通常ユーザーの Fable 5 無料利用が終了し従量課金制へ移行する予定。セーフガード強化によりコード生成や特定トピックでの利用が制限される中、著者が実施した検証から Claude Code の承認モード利用やチャットベースのワークフローが制限を受けにくいことが判明。Fable 5 終了後も他モデルで類似性能を維持するため、複雑なタスクを分解設計・外部メモリ活用・構造化プロンプトなどの運用工夫が有効。

6月30日に米商務省がFable 5への輸出規制を解除し、7月1日から世界的に利用可能になった。解禁の理由は「Fable 5が安全だったから」ではなく、報告された脆弱性がFable 5固有のものではなく、Claude Opus 4.8やGPT-5.5など複数のモデルでも同じ能力があると確認されたため。攻撃能力が特定のモデルだけに閉じていない時代へ移行した事実が重要。

マルチエージェント環境でモデルを手動切り替えする煩雑さから出発し、全自動アップデートのリスク(破壊的変更・コスト暴発・未提供ID での起動失敗など)を棚卸した著者が、「検知は自動、適用は人間の承認」という notify-only 設計を採用。scripts/model_update_check.py で LLM を介さない決定論スクリプトによる定期監視を実装し、プロンプトインジェクションや誤認識を防ぎながら、モデル版アップデートの通知のみを実行する仕組みを解説する。

Claude Fable 5 の実運用で重要なのはベンチマーク数値ではなく、プロンプト作法と scaffolding の設計変更。budget_tokens 廃止に伴い effort パラメータで精度・レイテンシ・コストをバランスさせ、旧モデル向けの冗長な指示は削除し、thinking ブロック活用と長時間ラン対応で足場を組み替える必要がある。

セキュリティ業界の開発者が、Fable5で約2,500ファイルの自社システムをレビューさせたところ、Opus4.8が前日に「問題なし」と判定した領域から参照切れ25個を含む多数の見落としを発見。Fable5は検証も修正も高速・高品質で実行し、レビュー役と修正役の分離、モデル選択をタスク特性で動的に行う重要性が明確化された。

Anthropic の Claude Code チームメンバー Thariq 氏の提唱する「HTML ファースト出力」について、実践的な検証結果を紹介。Markdown の 100 行超は読みにくく、AI との協働では人間による読み書きの利便性が必ずしも最適ではない点を指摘し、計画書・設計書・レビュー等の成果物では HTML 出力により情報密度・閲覧率・共有性が大幅に向上する利点と、生成時間・トークン消費増加などの課題を整理。CLAUDE.md への 1 回の設定で実装可能。


知らないリポジトリで迷わないための Claude Code 活用法。リポジトリ全体の地図を描く→担当機能に絞る→1つの処理を端から端まで追う、という3段階の読み解き手順と、@ 参照で読ませる範囲を制御する、plan モードで編集を禁止するといった実践的なプロンプト・設定を紹介。理解を CLAUDE.md に記録して次セッションに引き継ぐところまでカバー。


一時的にアクセス停止されていたClaude Fable 5が復活し、2026年7月7日まで課金範囲内で利用可能。著者は Sonnet 5 をサブエージェントとして活用しながら、Skills の作成・更新、サイトデザイン、プレゼン資料テンプレートの環境整備を実施した。Fable 5 の方針決定・レビュー役と Sonnet 5 の実装役の役割分担により、品質とコストのバランスを最適化。

Kimi K2.7がGitHub Copilotに統合され、DatabricksのOmnigentによって複数のAIエージェント(Claude Code、Codexなど)を一つの制御層で管理・並列処理できるようになった。開発者は「どのAIか選ぶ」から「何を達成するか」に集中でき、従来のコード補完疲れから自動化・信頼できるタスク実行へシフトする。


Claude Code の1日の実測でトークン消費の約95%が cache read(キャッシュ済みコンテキストの再読)であることが判明。セッションの肥大化に伴い毎ターンの再読量が雪だるま式に増える構造が明らかになり、output 削減より「セッションの切り時を早める」方が効果的。requestId 重複排除と subagents/ ディレクトリ集計の落とし穴を回避し、モデル自身に切り時を提案させる session-health プラグインを公開。

Anthropic が Claude Sonnet 5 を公開し、無料・Pro プランの既定モデルに。コーディングとエージェント用途の性能が向上する一方、API での拡張思考の手動指定や temperature 設定に非対応になった。同社は研究者向け AI ワークベンチ Claude Science もベータ公開し、Google は低コストモデル Nano Banana 2 Lite や動画生成の Gemini Omni Flash を投入。Cognition、Google、X も開発ツール・エージェント強化を相次ぎ発表。

5歳向け学習アプリの UI リニューアルで、Fable 5 を設計・指示書作成役、Opus 4.8 を実装役として役割分担。Fable 5 に変更禁止範囲やデザイントークンを明記した指示書を作らせることで、実装ミスを防ぎながらトークン効率を最適化。ステッカー獲得時の演出などを重点的に仕上げた実践例。

Anthropic が 2026 年 6 月 9 日に公開した Mythosクラスの Claude Fable 5 は、SWE-bench Pro で 80.3%、SWE-bench Verified で 95.0% を記録し、Opus 4.8 や GPT-5.5 を大きく上回るコーディング性能を持つ。ただし安全装置の回避リスクが指摘され、6 月 12 日にアメリカ政府が輸出規制をかけ、Anthropic が安全分類器を改良したうえで 7 月 1 日に世界向けで再公開された。

Claude Fable 5 の公開直後72時間に、開発者たちが実装した事例集。Minecraft クローンを20分で生成、Stripe の5,000万行コード移行、12時間の自律実装など、一発で動くものから業務規模まで幅広い成果が報告された。共通点は「one-shot × 長時間自律 × 高トークン」で、時間のかかる大仕事を丸ごと任せられる相棒としての側面が浮き彫りに。