KnowHal: 多様な多モーダル幻覚評価のための知識駆動ベンチマーク
多モーダル大言語モデル(MLLM)の幻覚評価に特化した知識駆動型ベンチマーク「KnowHal」が提案された。知識関連の幻覚を_entity、attribute、relation、knowledge_の4次元で包括的に評価し、1,800件のサンプルを10分野・50カテゴリで構築している。
arXiv cs.AI ・ 2026-08-04
arXiv に関する AI ニュースを新しい順に 5 件。3 時間おきに自動収集し、AI が要約しています。
多モーダル大言語モデル(MLLM)の幻覚評価に特化した知識駆動型ベンチマーク「KnowHal」が提案された。知識関連の幻覚を_entity、attribute、relation、knowledge_の4次元で包括的に評価し、1,800件のサンプルを10分野・50カテゴリで構築している。
arXiv cs.AI ・ 2026-08-04
ニューラルネットワークの予測に対する真の原因を_Halpern-Pearl(HP)因果モデル_で計算する手法が提案された。Boolean構造因果モデル(SCM)を用いて入力の依存関係をモデル化し、$2.3\times10^{13}$の候補空間でも全ての最小原因を計算可能にした。
arXiv cs.AI ・ 2026-08-04
マスク拡散言語モデル(MDLM)向けの新しい位置エンコーディング「MDLMPE」が開発された。トークンの露出・マスク状態を考慮したバイナリシーケンスと距離重み付けにより、動的なコンテキストを正確に表現する。
arXiv cs.AI ・ 2026-08-04
車載画像から3Dシーンを補完する際に、衛星画像とOpenStreetMapの地理空間情報を活用したGeoSceneが提案された。衛星画像の構造的手がかりをソフトプライオリティとして利用し、未観測領域のセマンティック補完を実現した。
arXiv cs.CV ・ 2026-08-04
乳房MRIの仮想強調画像生成に向け、予測的強化較正法PECが提案された。MRI特有の非標準強度スケールに対応し、前処理画像から強調画像の上限値を予測することで、放射線学的忠実性を維持した画像生成を実現した。
arXiv cs.CV ・ 2026-08-04