了解你的模型。
了解你的电脑。
测试 GGUF 或 MLX 模型,选择 1–3 个并行工作同时呼叫同一模型,并自动将结果储存至你的 TokFire 帐户。
执行可重现的测试
- 安装桌面应用程式
Mac:下载 DMG,将应用程式拖至「应用程式」资料夹。Windows:解压缩完整 ZIP 并开启 TokFire Bench.exe。请另行安装 Python 及 llama.cpp;MLX/oMLX 仅限 Mac。Windows 帐户登入亦需要 WebView2。
- 选择 GGUF 或 MLX
选择一个模型,在开始前设定 1、2 或 3 个并行工作。llama.cpp 及 oMLX 均显示即时进度及各工作结果。TokFire Bench Pro 可解锁最多 20 个工作同时呼叫同一模型。一次性 HK$180,每个授权限启用一部装置。付费版将于商店审批后推出。
- 连接一次,即可开始测试
开始前已预设启用自动上传;公开分享是独立选项,预设关闭。离线或上传失败的报告会保留在伫列中。JSON 报告及文字评语均会储存于本机。
适用于 Windows 10/11、Intel 或 AMD 64 位元电脑。请解压缩完整 ZIP。主要控制项提供 20 种语言;Windows 专用指引及报告目前为英文。此预览版已在 macOS 交叉编译及通过单元测试,Windows 实机测试仍待完成。
Android APK · 0.7.0 预览版Linux/跨平台 CLI · 0.7.0Android 原生测试端可连接手机已有的 runtime,或指定局域网服务器。未附模型权重或推理引擎。远程结果会独立标示。采用开发签名,尚待实体手机验证。
0.7 新增固定聊天、商业、长文及本地 agent 工具工作负载;3–5 次测量、逐级并行测试、失败率及 P95/P99。Agent 测试使用限定工具任务,未接入 Hermes/OpenClaw。
下载内容包含试跑启动程式。在解压缩后的 native 资料夹执行 python3 trial-minicpm.py。程式会下载官方 Q4_K_M 模型(约 1.56 GB),验证校验码,并在你的 Mac 进行一次简短测试。需要 Python 及 llama-server;命令列试跑毋须 Xcode 建置。命令列试跑资料保留在本机;应用程式内的试跑依照其上传设定。完整测试亦支援单一模型,或最多三个模型依序执行。