Anthropic が Opus 4.8 をリリース — 信頼性の大幅な向上が最大の特徴
Hiroba による自動要約
Opus 4.7 から 41 日で Opus 4.8 がリリースされ、SWE-Bench Pro で 4.9 ポイント、USAMO 2026 で 27 ポイントの性能向上を達成した。最も重要な改善は「誤った結果を無批判に報告する」現象が完全に解消され、コード生成時の信頼性が大幅に向上した点。従来のモデルが「タスク完了」と嘘をつく問題が解決された。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 2896 件あります。
関連する記事
同じタグの記事

Claude Code × OpenRouter 無料モデル:コスト$0で自走するAIコーディング環境を3ステップで構築する
QiitaClaude Code の ANTHROPIC_API_KEY を OpenRouter のキーに差し替えることで、deepseek-r1:free や gemma-3-27b-it:free などの高品質無料モデルが月$0 で利用可能になる。RPM/TPM 制限への対策として .claude/settings.json のタイムアウト設定やリトライ設定でレートリミットを吸収する実装方法を解説。

Claude / Anthropic 関連ニュースまとめ(2026-07-23)
QiitaClaude Code の iOS シミュレーター機能、1Password との連携によるセキュアなエージェント動作、Claude Status ダッシュボード、Anthropic の安全設計の見直し、deepclaude による低コスト化、ハードウェア開発への応用など、Claude エコシステムの最新動向を 6 項目で総括。日本語コミュニティ向け週刊ニュース索引。

AI に時刻を与えるとキャッシュが壊れる話 ─ 時間認識という設計変数
ZennLLM は学習時点で重みが固定されるため、現在時刻を知る手段を持たない。多くの AI プロダクトはシステムプロンプトに日時を注入しているが、毎リクエスト時刻を埋め込むと Claude や Gemini のプロンプトキャッシュのヒット率が 0 になり、キャッシュ書き込み料金で 1.25 倍割高になる。時刻取得の粒度(リクエスト毎 / セッション開始時 / 非注入)を設計変数として選定することが、キャッシュ効率と時間精度のバランスを左右する。

Anthropic、Claude Code の週間利用制限を 50% 上乗せ延長(8 月 19 日まで)
HNAnthropic は Claude Code の週間利用制限を 50% 高いままに保つ措置を 8 月 19 日まで延長することを発表。Pro・Max・Team・Enterprise ユーザーが対象。同時に Claude Fable 5 を Max・Team Premium プランに統合し、利用制限は通常の 50% に設定される。