瀏覽單個文章
巴豆布妖
New Member
 
巴豆布妖的大頭照
 

加入日期: Apr 2017
文章: 8
引用:
作者野口隆史
我建議不要用 ollama 改用 llama.cpp
然後 12GB 顯卡實際上可以用 Gemma4 26BA4B、Qwen 3.6 35BA3B 的 4位量化,建議選擇 q4km 或 ud-q4k-xl

聽你的建議, 改用 llama.cpp 了, 果然有比較好用, 以前真不應該偷懶
Qwen 3.6 35BA3B 參數調整好, AI 思考時間馬上減一半
 
舊 2026-08-05, 11:38 AM #372
回應時引用此文章
巴豆布妖離線中