テキストから動画を生成するモデルを評価する包括的なベンチマークを提案
arXiv cs.CL ・ 2026-08-03
原題: CultureVidBench: Benchmarking Cultural Understanding in Text-to-Video Generation
AI による要約
テキストから動画を生成するモデル(T2V)の多様な文化的コンテキストの表現力を評価するため、物質文化や儀式などを含む包括的なベンチマーク「CultureVidBench」を提案した。12カ国・14の文化的側面をカバーする1,000のプロンプトを用いて、動的かつマルチモーダルな文化表現の妥当性を評価する。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。