AI活用 RTX 5060 Ti 16GBで27BのローカルLLMは動くのか。Ollamaをやめて実測してみた
RTX 5060 Ti 16GBでQwen3.6-27Bを動かし、生成速度とVRAM使用量を実測しました。4bit量子化が載らない理由、MTPによる高速化、Ollamaからllama.cppへ移行した経緯まで。
AI活用
AI活用
AI x Finance
AI活用
AI活用
AI活用