58,000行の発音記号を監査したら、cmudict・Wiktionary・LLMも信用できなかった話
出典: Qiita (Claude tag)
Hiroba による自動要約
英単語学習サイトの動画ナレーションで発音記号(IPA)の誤りを発見し、辞書全体5.8万行の監査を実施。cmudict・Wiktionary・GPT・Claude等の複数データソースと検査プログラムを検証した結果、単一の情報源では正解に到達できず、複数の独立したLLMで判定を割らせて最終裁定する手法が有効だったと報告。
出典・元記事
Qiita (Claude tag) の記事を Hiroba が自動要約しました。元記事を読む
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 4636 件あります。
関連する記事
同じタグの記事


○×表は読めない——AIに集めさせた教習所データ489件を全部検証した話
Zenn中古バイク検索サイト MotoHub の教習所データ489件を Claude(Cowork)で集めたが、表のセルずれ、マークアップエラー、第三者サイトの矛盾、URLパターン変動、情報の日付不記載など、データ検証で予期しない落とし穴が複数発生した。自動化で取得は1日で完了したが、検証工程は手作業を避けられず、verified_at カラムで未確認データを非公開とすることで対策した。

Haiku 5.5 移行前の応答ブロックと料金見積り検査
QiitaClaude Haiku 5.5 へ移行する際、モデル ID 交換前に応答処理と料金見積りの前提を分離するための Python コード例を紹介。思考ブロック・途中終了・使用量欠損を検査し、トークン数計算の変動・キャッシュ別計上・料金帯の適用など実装時の注意点を解説。公開 API 仕様(2026 年 10 月 8 日版)に基づく合成 fixture で再現可能。
