トレンド一覧

PythonとWikitextに最適化した700Mモデルを18Bトークンで事前学習

r/LocalLLaMA ・ 2026-07-29

原題: I pre-trained a 700m on 18B tokens optimized for Python and Wikitext | TheOneWhoWill/Shibai-700M-Base · Hugging Face

AI による要約

TheOneWhoWill氏は、PythonとWikitextに最適化された700Mパラメータのモデルを事前学習しました。このモデルは、Qwen 3 0.6BやQwen 3.5 0.8Bほどの性能ではないかもしれませんが、まだ一定の性能を持っています。TheOneWhoWill氏は、このモデルをさらに5億トークンのデータで事前学習する予定です。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。

LLM・基盤モデル