GPT-5.6・Opus 5・Gemini 3.6、モデルの自己申告があてにならない理由
出典: Zenn (Claude topic)
Hiroba による自動要約
2026年7月に ChatGPT・Claude・Gemini が相次いで新モデルへ切り替わった。モデルに「何のモデルか」と直接聞いても、自身の重みやデプロイ構成を検査できないため信頼できない。実際に使われているモデルはモデルピッカーの UI や公式ドキュメントの表示でのみ確認できる。
出典・元記事
Zenn (Claude topic) の記事を Hiroba が自動要約しました。元記事を読む
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 5206 件あります。
関連する記事
同じタグの記事



Claude の統合判断をプラグイン平均正解率で自動検証するシステムを実装する
ZennRakuScan(日本株スクリーニングツール)では複数の分析プラグイン結果をClaudeが統合してBUY/HOLD/SELLを判断するが、この設計が本当に機能しているかを継続的に検証するシステムを構築した。evaluate.pyが営業日ベースでシグナル発行後+1/3/5/10/20日のリターンを自動記録し、weekly_report.pyが「Claudeの正解率」と「プラグイン平均の正解率」を比較する vs_plugin_avg_5d 指標を算出。直近10週の実データではClaudeの正解率がプラグイン平均を安定して上回った週はなく、数字の見た目より判断の質を継続的に監視できる仕組みづくりに価値を置いた。
