
【2026年】Muse GlimmerをUnslothで動かす完全ガイド!18GB RAMでMetaの30Bエージェントモデルを実行・ファインチューニング
「Meta の Muse Glimmer を自分の PC で動かしたいけど、どうやるの?」
「GGUF の選び方・推奨設定・ファインチューニングまで知りたい…」
そんな人にぴったりの方法が登場しました。ローカルLLM運用の定番ツールUnslothが、Meta の新モデルMuse Glimmer 30Bにデイゼロ(公開初日)対応しました。
Unsloth の Dynamic 量子化を使えば、18GB RAM の環境でも Muse Glimmer を実行可能。2bit〜8bit までサイズを選べるので、手持ちの PC に合わせて最適なバランスを選べます。さらにファインチューニングも可能です。
この記事では、Unsloth で Muse Glimmer を動かす方法を初心者向けに完全解説します。
この記事でわかること
- Unsloth の Muse Glimmer 対応の概要(18GB RAM で動作)
- ハードウェア要件(2bit〜8bit の推奨メモリ早見表)
- 推奨設定(temperature・top_p・top_k・コンテキスト長)
- 実際の実行方法(Unsloth Desktop・llama.cpp)
- ファインチューニング・ベンチマーク
Unsloth の Muse Glimmer 対応とは?
Unsloth は、ローカルLLMの実行・高速化・ファインチューニングに特化したオープンソースツールです。
2026年8月10日、Unsloth は Meta のMuse Glimmer 30B(Apache 2.0・マルチモーダル・エージェント特化モデル)へのデイゼロ対応を発表しました。
主なポイント
- 18GB RAM/VRAM で実行可能: Mac・GPU/CPU 環境を問わず動作
- Unsloth Dynamic 量子化: 精度を最大化しつつ、RTX 5090 などの小型デバイスにもフィット
- 実行もファインチューニングも可能: Unsloth Desktop または Python ライブラリで完結
- llama.cpp 実装を Meta・Hugging Face と共同開発
X では151,000以上のビュー・1,600以上のいいねを集めています。
ハードウェア要件:2bit〜8bit の早見表
Muse Glimmer 30B のフル精度(BF16)は約58GB必要ですが、Unsloth Dynamic 量子化を使えば大幅に削減できます。
| 量子化 | モデルサイズ | 推奨メモリ | ハードウェア例 |
|---|---|---|---|
| 2bit (UD-Q2_K_XL) | 12〜15GB | 18〜20GB+ | RTX 4080 |
| 3bit (UD-Q3_K_XL) | 12〜15GB | 20〜24GB+ | RTX 4090 |
| 4bit (UD-Q4_K_XL, NVFP4) | 17〜19GB | 24〜32GB+ | Mac 32GB |
| 6bit (UD-Q6_K_XL) | 24〜26GB | 32〜40GB+ | RTX 5090, Mac 48GB |
| 8bit (UD-Q8_K_XL) | 31〜33GB | 40〜48GB+ | Mac 128GB, DGX Spark |
| BF16 (フル精度) | 55.7GB | 58GB+ | Mac 128GB, DGX Spark |
目安: ダウンロードする量子化モデルのサイズ以上にメモリがあれば快適に動作します。足りない場合も、llama.cpp の RAM/ディスクオフロードで動きますが、生成は遅くなります。
推奨設定(Meta 公式デフォルト)
| パラメータ | 推奨値 | 備考 |
|---|---|---|
| temperature | 1.0 | Meta のデフォルト値 |
| top_p | 0.95 | 多様性を維持 |
| top_k | 64 | 選択肢を絞りつつ柔軟に |
| コンテキスト長 | 131,072(最大262,144) | デフォルトで約13万トークン |
| 推論強度 | low / medium / high / xhigh | Controllable Effort |
実行方法1:Unsloth Desktop(最も簡単)
ステップ1:Unsloth をインストール
- ダウンロード: unsloth.ai/download からアプリを取得
- macOS・Windows・Linux 対応
コマンドでもインストールできます:
# MacOS / Linux / WSL
curl -fsSL https://unsloth.ai/install.sh | sh
# Windows PowerShell
irm https://unsloth.ai/install.ps1 | iex
ステップ2:Muse Glimmer を検索・ダウンロード
初回起動後、Model hub タブで「Muse Glimmer」を検索し、好みの量子化バージョンをダウンロードします。
ステップ3:実行
推論パラメータは自動設定されますが、手動で変更も可能。コンテキスト長・チャットテンプレート・GGUF/MLX ファイルにも対応しています。
実行方法2:llama.cpp(CLI)
Unsloth のDynamic 4bit(UD-Q4_K_XL)を使う例です。
ビルド
apt-get update
apt-get install pciutils build-essential cmake curl libcurl4-openssl-dev -y
git clone https://github.com/ggml-org/llama.cpp
cmake llama.cpp -B llama.cpp/build \
-DBUILD_SHARED_LIBS=OFF -DGGML_CUDA=ON
cmake --build llama.cpp/build --config Release -j --clean-first --target llama-cli llama-mtmd-cli llama-server llama-gguf-split
cp llama.cpp/build/bin/llama-* llama.cpp
実行
export LLAMA_CACHE="unsloth/Muse-Glimmer-30B-GGUF"
./llama.cpp/llama-cli \
-hf unsloth/Muse-Glimmer-30B-GGUF:UD-Q4_K_XL \
--temp 1.0 \
--top-p 0.95 \
--top-k 64
ファインチューニングも可能
Unsloth なら、Muse Glimmer 30B のファインチューニングもできます。
- 2倍高速・70% VRAM削減の学習が可能
- 学習データは自分の用途に合わせて準備
- 詳細は Fine-tune Muse Glimmer のドキュメントへ
ベンチマーク:同サイズ最強のエージェントモデル
Unsloth が公開したベンチマークでは、Muse Glimmer-30B High Reasoningが同サイズのGemma4-31BとQwen3.6-27Bを多くの項目で上回っています。
| カテゴリ | ベンチマーク | Muse Glimmer 30B | Gemma4-31B | Qwen3.6-27B |
|---|---|---|---|---|
| エージェント | MCP Atlas (Public) | 75.5 | 54.2 | 62.5 |
| エージェント | DeepSearch QA | 74.6 | 61.7 | 71.1 |
| エージェント | Gaia2 | 43.3 | 36.4 | 40.0 |
| コーディング | SWE-Bench Pro | 51.2 | 36.9 | 50.2 |
| コーディング | SWE-Bench Verified | 76.0 | 66.6 | 77.2 |
| コーディング | SciCode | 43.6 | 43.4 | 39.8 |
| マルチモーダル | Charxiv Reasoning | 78.8 | 77.7 | 78.4 |
| マルチモーダル | OmniDocBench v1.5 | 75.8 | 72.5 | 77.8 |
| 推論 | AIME 2026 | 94.7 | 89.2 | 94.1 |
| 推論 | IFBench | 77.0 | 76.0 | 70.8 |
(太字が最優秀スコア。Muse Glimmer が多数の項目でリードしています)
リンクまとめ
- GGUF ダウンロード: huggingface.co/unsloth/Muse-Glimmer-30B-GGUF
- 公式ガイド: unsloth.ai/docs/models/muse-glimmer
- ファインチューニング: unsloth.ai/docs/models/muse-glimmer/train
- Unsloth ダウンロード: unsloth.ai/download
- 元モデル(Meta): huggingface.co/meta-models/Muse-Glimmer-30B
まとめ
Unsloth の Muse Glimmer 対応は、ローカルAIエージェントを始めるための最速ルートです。
- 18GB RAM で実行可能: 2bit〜8bit から環境に合わせて選択
- デイゼロ対応: Meta 公開初日から Unsloth で動かせる
- 実行も学習も: 推論はもちろん、ファインチューニングも可能
- 同サイズ最強の性能: ベンチマークで Gemma4・Qwen3.6 を多数リード
「Muse Glimmer を自分の PC で動かしたい」という人は、まず Unsloth Desktop をインストールして、Model hub から Muse Glimmer を検索してみてください。数分でローカルAIエージェントが動き始めます。
関連記事
この記事のまとめ
そんな人にぴったりの方法が登場しました。ローカルLLM運用の定番ツールUnslothが、Meta の新モデルMuse Glimmer 30Bにデイゼロ(公開初日)対応しました。
この記事をシェアする
関連記事

2026年8月20日
【2026年】Qwen3.8-27B GGUF完全ガイド!Unsloth版を自宅PCで動かすには(ファイル一覧・選び方・手順)

2026年9月5日
【2026年】GLM-5.3-Flashをローカルで動かす完全ガイド|320BモデルがDGX Spark・128GBミニPCで動く

2026年8月17日
【2026年】Qwen3.8-CRACK徹底解説!画像・動画も見れる低VRAMの無検閲モデルをローカルで動かす

2026年8月27日
【2026年】Ornith-1.5-9B-OBLITERATEDとは?拒否を消した9Bモデルをローカルで動かす!量子化・必要スペック・使い方を徹底解説

2026年8月20日
【2026年】Qwen3.8-27B無検閲版の12GB GGUFが話題!Ridge式混合量子化で37tok/sを実現する新モデルを徹底解説

2026年8月18日
【2026年】DeepSeek V4 Flash無検閲版(Abliterated GGUF)を徹底レビュー!ローカルで動かす方法と注意点