トレンド一覧

Food Image Segmentation with LLM-Derived Ingredient Labels and Multimodal Fusion

arXiv cs.CV ・ 2026-07-28

AI による要約

食事画像のセグメンテーション精度を高めるため、LLMが推論した原材料ラベルを視覚特徴に直接注入するプラグアンドプレイモジュール(LIM-FおよびLIM-Q)が提案されました。画像とテキストの事前対比学習を必要とせずに意味情報を統合でき、見た目が類似した食材や希少カテゴリの認識精度を改善します。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CV)をご確認ください。

研究・論文