模型适配
按设备选出可能跑得动的模型。适配判断与实测证据分开呈现,证据来源逐行标出。

本站实测 本站实测档案: NVIDIA GeForce RTX 3060 Laptop GPU · 6 GB · 12th Gen Intel(R) Core(TM) i7-12700H · 64 GB RAM
| 模型与量化 | 适配判断 | 速度信息 | 证据来源 | 下一步 |
|---|---|---|---|---|
| Qwen3.6-35B-A3B · UD-Q4_K_XL | GPU + 专家层驻留 CPU 参数: -ngl 99 -ncmoe 40 | 21.49 t/s MOE-005 | 本站实测 | 看报告 · |
速度来自 llama-bench(-p 512 -n 128),不含 tokenization 与采样时间,不等于真实聊天速度。
这一版包含什么
本页只列本站实测的配置,证据来源逐行标出,每一行都指向对应的报告。llmfit 的适配推算尚未接入 —— 没建档案的设备档位一律显示「暂无实测」,不用估算值充数。
17 个不同配置 · 23 次有效测量
「配置数」按去重后的配置算:同一配置重复测多次只算一个,不拿测量次数冒充配置数。