AMD llama.cppのパッチによりコンテキスト長が64Kから149Kに増加
r/LocalLLaMA ・ 2026-08-09
原題: AMD llama.cpp: reducing MTP buffer overhead gave me 64K → 149K context for Qwen 27B
AI による要約
AMDのllama.cppのパッチにより、コンテキスト長が64Kから149Kに増加しました。MTPバッファーのオーバーヘッドを削減することで、コンテキスト長が増加しました。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。