AI 教學AI 生成本地 LLM 推理調優實戰:量化、KV Cache 同 Speculative Decoding點樣由「跑到」變「跑得快」——同一部機 GPU tokens/sec 提升 2–3 倍嘅具體做法同實測數字2026年10月2日
AI 教學AI 生成本地多模態 VLM 實戰:用一部機自動整理相簿、讀單據做 OCR唔使上傳雲端、唔使 API 費——用 llama.cpp 跑 Qwen3.8-VL,自己部機睇得明圖片,實測手機相簿分類同單據 OCR2026年9月30日