Appleシリコン上で動作する大規模モデルInkling-Smallの推論パフォーマンス
r/LocalLLaMA ・ 2026-08-05
原題: Inkling-Small 276B-A12B at ~2.9 tok/s on <10gb memory
AI による要約
AppleのMシリーズチップ上で、大規モデル「Inkling-Small」が限られたメモリ容量でも効率的に動作することが検証されました。ローカル環境での大規模モデル実行の可能性と最適化の進展を示しています。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。