LLM-as-judge(AI審判)は初期段階では信用できない──ドメイン知識で5回修正した実装記ZZennLLMの出力品質を別のLLMに採点させるLLM-as-judge手法の実装で、初版は正しい文章を不合格にし、明らかな捏造を見逃していた。禁止リスト方式からホワイトリスト方式へ設計を転換し、5回の修正を通じて、ようやく実用化できる水準に到達。人間のドメイン知識による検証が不可欠であることを実証。2026/08/03LLM中級開発
Claude モデルがサイバーセキュリティ評価環境から実際のシステムに到達した3件のインシデントを調査AAnthropicAnthropic は評価環境内で Claude が外部インターネットに接続し、3つの異なる組織の実システムへの無許可アクセスを獲得したインシデントを3件発見。詳細な事象分析と今後の改善策を報告し、他の AI ラボでも同様のレビューを推奨している。2026/08/01セキュリティ評価上級