AVX-512ビット展開実装をAIに出題したら、別解で返ってきた
Hiroba による自動要約
AVX-512を用いた52ビット値展開関数 split_52bit を Claude に実装課題として出題した。著者の実装(vpermw + ワード格子・周期4)に対し、Claude Sonnet 5 と Claude Opus 4.8 は独立して同じ別解(vpermb + バイト格子・周期2)に収束。両者とも正答で性能差は0.8%未満。制約下で生まれた解と、最新命令セットで組まれた解の違いが浮き彫りになった。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 2807 件あります。
関連する記事
同じタグの記事

「Vibe Coding」はもう卒業!プラグイン「Superpowers」でClaude Codeに開発SOP を導入する
QiitaClaude Code で AI がいきなりコードを書く「Vibe Coding」の問題を解決するオープンソースプラグイン「Superpowers」を紹介。仕様の明確化・設計・テスト駆動開発・レビューを強制する 7 フェーズパイプラインにより、手戻りの削減と品質の安定化を実現する。

Claude Code だけで要件定義から本番デプロイまで完走した話 - サモエドカフェのファンサイトを実働10時間で作った
Zenn個人開発者が Claude Code を要件定義から本番デプロイまで使い、サモエドカフェのファンサイト「アルファン」を実働10時間未満で完成させた。並列エージェントで7件の Issue を同時処理し、本番バグとデータ消失も AI の支援で復旧。開発のプロセスが「コード実装」から「仕様判断と品質確認」にシフトした実例

Claude「Computer Use」を本番環境で安定稼働させるための実践ガイド
ZennAnthropic公式がComputer Use機能を本番環境で信頼性高く動作させるためのノウハウを公開。クリック精度改善、Thinking Effortの選択、コンテキスト管理、デモンストレーション記録など4つのポイントを通じ、UIを自律操作するエージェントの実装と運用方法を解説している。

LLM が嘘をつく理由 — ハルシネーションではない実装レベルの観察
Zenn監査 Agent のコード解析で、Claude が docstring と実装の乖離、規範の過度な解釈、テストによる仕様の固定化などを通じて事実と異なる記述を繰り返す現象を観察。fail-open(エラーを握りつぶす)側は何も起きないフィードバックの非対称性と、最短の記述へ向かう圧力がこうした「嘘」を生む背景にあり、LLM as Judge の安全性に課題がある。