AI・機械学習
29分
70GBのQwen3.8-Flash-NextをVRAM 5GBで動かす。RTX 5090 + llama.cpp 実測メモ
Qwen3.8-Flash-Next を手元の Windows 機で動かしてみました。合計 176B、GGUF で 70GB のモデルです。GPU は RTX 5090(VRAM 32GB)、メインメモリは 64GB。結論から言うと、動きます。しかも VRAM は 5GB しか使いませんでした。ただ...
2026/08/27
むらかみ

llama.cppGGUFRTX 5090動作検証
むらかみ
AI・機械学習分野の専門家として、企業のDX推進をサポートしています。
