了解你的模型。
了解你的電腦。
測試 GGUF 或 MLX 模型,選擇 1–3 個並行工作同時呼叫同一模型,並自動將結果儲存至你的 TokFire 帳戶。
執行可重現的測試
- 安裝桌面應用程式
Mac:下載 DMG,將應用程式拖至「應用程式」資料夾。Windows:解壓縮完整 ZIP 並開啟 TokFire Bench.exe。請另行安裝 Python 及 llama.cpp;MLX/oMLX 僅限 Mac。Windows 帳戶登入亦需要 WebView2。
- 選擇 GGUF 或 MLX
選擇一個模型,在開始前設定 1、2 或 3 個並行工作。llama.cpp 及 oMLX 均顯示即時進度及各工作結果。TokFire Bench Pro 可解鎖最多 20 個工作同時呼叫同一模型。一次性 HK$180,每個授權限啟用一部裝置。付費版將於商店審批後推出。
- 連接一次,即可開始測試
開始前已預設啟用自動上傳;公開分享是獨立選項,預設關閉。離線或上傳失敗的報告會保留在佇列中。JSON 報告及文字評語均會儲存於本機。
適用於 Windows 10/11、Intel 或 AMD 64 位元電腦。請解壓縮完整 ZIP。主要控制項提供 20 種語言;Windows 專用指引及報告目前為英文。此預覽版已在 macOS 交叉編譯及通過單元測試,Windows 實機測試仍待完成。
Android APK · 0.7.0 預覽版Linux/跨平台 CLI · 0.7.0Android 原生測試端可連接手機已有嘅 runtime,或指定區域網絡伺服器。未附模型權重或推理引擎。遠端結果會獨立標示。採用開發簽署,尚待實體手機驗證。
0.7 新增固定聊天、商業、長文及本機 agent 工具工作負載;3–5 次量度、逐級並行測試、失敗率及 P95/P99。Agent 測試使用限定工具任務,未接入 Hermes/OpenClaw。
下載內容包含試跑啟動程式。在解壓縮後的 native 資料夾執行 python3 trial-minicpm.py。程式會下載官方 Q4_K_M 模型(約 1.56 GB),驗證校驗碼,並在你的 Mac 進行一次簡短測試。需要 Python 及 llama-server;命令列試跑毋須 Xcode 建置。命令列試跑資料保留在本機;應用程式內的試跑依照其上傳設定。完整測試亦支援單一模型,或最多三個模型依序執行。