トレンド一覧

オフライン動作に対応した軽量コーディングAgent「Ante 0.2」登場

r/LocalLLaMA ・ 2026-08-10

原題: Ante 0.2: a ~15MB coding agent that manages llama.cpp for you — point it at a GGUF and the whole agent loop runs offline

AI による要約

独立して動作する約15MBのコーディングエージェント「Ante 0.2」が公開された。管理下のllama.cppを利用してローカルのGGUFモデルを自動検索し、全ループを完全オフライン環境で実行できる。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。

AIエージェント / 開発ツール

この話題のこれまで

CPUやスマートフォン向けの軽量モデル「POCKET-35B」が公開され、ローカル環境での高度なAI実行が可能になった。llama.cppを活用した技術情報が共有され、DeepSeek-V4やKimi-k3モデルのローカル動作検証が進み、Qwen3-TTSの音声クローン機能も正式サポートされた。その後、Qwen 3.5 35B A3B-Q8_0がRadeon 7600で18トークン/秒で実行され、Muse-Glimmer-35BのGGUF版も公開される中、完全オフラインで動作する軽量コーディングAgent「Ante 0.2」が公開された。

  1. CPUで高速動作する350億パラメータのPOCKET-35B公開 2026-07-26 ・ r/LocalLLaMA
  2. llama.cpp利用時のdsv4用チャットテンプレート更新に関する注意 2026-07-28 ・ r/LocalLLaMA
  3. ローカル環境でKimi-k3モデルの動作検証に成功した事例 2026-07-28 ・ r/LocalLLaMA
  4. llama.cppがQwen3-TTSの音声クローン機能を正式サポート 2026-08-05 ・ r/LocalLLaMA
  5. Qwen 3.5 35B A3B-Q8_0をRadeon 7600で18トークン/秒で実行 2026-08-10 ・ r/LocalLLaMA
  6. Unslothが30BパラメータモデルMuse-Glimmer-30BのGGUF版を公開 2026-08-10 ・ r/LocalLLaMA

当サイトが集めた記事から、同じ話題のものを古い順に並べています。

この話題に関わるコラム