トレンド一覧

ベンガル語シーンテキスト認識用の実環境ベンチマークBanglaWild

arXiv cs.CL ・ 2026-08-04

原題: BanglaWild: An In-the-Wild Bengali Scene Text Recognition Benchmark for OCR and Vision-Language Models

AI による要約

野外のベンガル語画像文字認識に対応する2,535枚のベンチマークデータセットBanglaWildを公開した。従来OCRおよびVLMを用いた網羅的な評価を行い、実環境におけるベンガル語テキスト認識の技術課題を明示している。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。

LLM・基盤モデル / 画像・動画生成