VLX-Seek-1.5-10B、100億パラメータで視覚的把握と物体検出に特化
r/LocalLLaMA ・ 2026-08-10
原題: omlab/VLX-Seek-1.5-10B · Hugging Face
AI による要約
VLX-Seek-1.5-10Bは、100億パラメータのオープンソースモデルで、ドローンやロボット向けの視覚的把握と物体検出に特化している。領域検索と領域参照により、従来の座標生成型VLMと異なるアプローチを採用した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。