OmniPhys: Knowledge-Graph-Driven Benchmarking and Collective Optimization for Physical Commonsense in Text-to-Image Generation
arXiv cs.CV ・ 2026-07-28
AI による要約
テキストから画像を生成するモデルでは、物理的な意味合いを理解することが重要である。研究では、物理的な知識グラフを使用したベンチマークを提案し、物理的な意味合いを理解するための評価方法を提供した。さらに、物理的な意味合いを向上させるためのプロンプト最適化方法を提案した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。