Kimi K3 と Claude Fable 5 の実測比較:推論力より出力予算と検証性の差
Hiroba による自動要約
Kimi K3 と Claude Fable 5 を確率問題・物理問題・制約推論で実測比較。Fable 5 は平均応答 37.1 秒で高速だが途中計算に不整合、Kimi K3 は 108.0 秒かかるものの数式の中間状態が一貫。max_tokens 制限時の finish_reason や実行可能コードまで検証し、用途別の使い分けを提案。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 3364 件あります。
関連する記事
同じタグの記事

Claude WorkbenchがConsoleに統合——Claude Code・Cursor開発者の移行チェックリスト
Qiita2026年8月17日、Claude Workbench(claude.ai内のプロンプトテスト環境)がClaude Consoleに統合されます。Claude Codeユーザーへの実質的な影響はほぼなく、WorkbenchのプリセットをCLAUDE.mdまたはConsole Projectsに手動で転記し、テスト環境をConsole API Playgroundに移すだけで完了。APIキー管理やCLI操作は変わりません。

Claude API の Web 検索ツール(web_search)を Python で実装する — allowed_domains 排他制約と引用ブロック処理、3つのハマりどころ
QiitaClaude API の web_search ツールを Python で実装する際の注意点を解説。allowed_domains と blocked_domains は同時指定できない(排他制約)、引用付き回答は複数 text ブロックに分割されるため連結処理が必要、マルチターンで encrypted_content を次リクエストに返さないと精度が低下する、という 3 つのハマりどころと回避策を具体的なコード例で提示。

OpenTelemetry で Opus 5 と Sonnet 5 の Effort level の効き方を明らかにした
ZennOpenTelemetry の trace を使い、Opus 5 と Sonnet 5 の effort level 変更時の動作を比較した。Opus 5 は思考回数と1リクエストの長さの両方を増やす(約2倍×2倍)が、Sonnet 5 は思考回数は不変で長さだけ伸びる。実行時間の差は両モデル共に API 応答待ちが大部分(Opus 5 が91.6%)で、CLI のローカル処理はモデルで変わらない。

Claude Code + OpenRouter 無料モデル 5 選:2026年版クオリティ・速度・コスト完全比較
QiitaOpenRouter の :free 無料モデルは 2026 年時点で Qwen3・Llama・Gemma・DeepSeek など 5 モデル以上が実用レベルに達した。コーディング・推論・マルチモーダル処理など用途別に最適モデルが異なり、レート制限と文脈長を把握すれば月 $0 でエージェント運用が現実的。各モデルの強弱・推奨ユースケース・API 呼び出し例を詳解。