TOKFIRE 實用指南
讓本地 AI,真正幫到手。
六篇實用教學,從桌上的硬件開始。建立有用的工具、理解技術,再量度實際表現。
06PC / MAC
LOCAL LLM
LOCAL LLM
你的第一個本地 AI 助手:由小模型開始
用 Ollama 將 PC 或 Mac 變成實用的草稿與摘要助手。
閱讀教學向自己的文件提問:小型本地 RAG 教學
建立可以檢查證據的文件問答原型,毋須雲端向量資料庫。
閱讀教學用 MLX 在 Apple silicon 運行本地 LLM
由 4-bit 模型開始,理解統一記憶體,再測試提示快取是否有幫助。
閱讀教學16GB GPU 能跑 27B?先算清記憶體預算
GSQ + RCO 改變了甚麼、KV cache 仍佔多少空間,以及如何實際驗證 GGUF。
閱讀教學由聊天到行動:建立小型本地工具 agent
以唯讀庫存查詢,理解 agent 真正做了甚麼,以及如何驗收。
閱讀教學一個模型、三個 job:量度真正有用的速度
分清總吞吐量及回應速度,再公平測試批次處理、快取及推測解碼。
閱讀教學