Cloudflare Clef で日本語書類の OCR 誤りを検証。全角・半角判定に課題
Hiroba による自動要約
Cloudflare Workers AI の decision model「Clef」を使い、Claude Haiku が抽出した日本語書類(請求書・見積書・領収書)の OCR 結果を画像から直接検証した。注入した誤り36件中32件を検出したが、全角・半角の区別やHaiku自身の読み間違い検出は英語ほどの精度に達さず、コスト面での利点と実用的な活用方法を探る課題が残った。
読んで良かったら、シェアしてみてください。
同じタグの記事が他に 4811 件あります。
関連する記事
同じタグの記事


個人開発での AI 利用構成と 2026 年 9 月の課金額(API 換算)を公開
Zenn個人開発者が 2026 年 9 月に利用した Codex と Claude の実際の支出額とAPI 換算額を公開。Codex 月額 33,000 円で約 415 億トークン(API 換算約 247 万円)、Claude Pro 月額 $22 で約 20 億トークン(API 換算約 10 万円)を使用し、実支払額は API 換算額の約 98.6% OFF 相当という大きな割引を受けている状況を詳細に分析。

Claude Code・Copilot・Cursor・Windsurf・Codeiumを実装目線で比較する ― セットアップ・運用コード付き(2026年10月版)
QiitaClaude Code、GitHub Copilot、Cursor、Windsurf、Codeiumの5つの AI コーディングツールを、エージェント自律度・コンテキスト理解力・統合方式・チーム運用・料金対効果の5軸で Tier 分類し比較。CLI セットアップコード、プロジェクトルール定義、GitHub Actions 連携など実装者視点の具体的な運用方法を提示。

Claude × Gemini × 4大MLモデルが自律連携する日本株検証基盤の設計図 ― 3Dシミュレーションで可視化する推論・検証・継続学習ループ
Qiita個人開発の日本株検証基盤「ALPHA FORGE」において、Claude・Gemini・XGBoost/RF/LSTM/Transformerの4大MLモデルが三層構造で自律連携するアーキテクチャを、Three.jsの3Dシミュレーションで可視化。Geminiによるセンチメント隔離解析、Claudeによる統合審査と3値策定、イミュータブルな予測台帳と等調回帰による過信矯正、夜間の自動再学習とドリフト検知により、未来リーク排除と堅牢な推論パイプラインを実現する設計を解説。