软件内支持高速下载本地前沿模型
支持 HuggingFace 与 ModelScope 双源本地模型,以及众多国内外云端模型服务商
Qwen 3.5 0.8B (基础)
ggml-org/Qwen3.5-0.8B-GGUF:Q4_0
无独显可运行,极致运行速度,仅支持文本分析,欠精准。
Qwen 3.5 0.8B (轻量识图)
unsloth/Qwen3.5-0.8B-GGUF:UD-Q6_K_XL
极致运行速度,适合极低配置环境,且支持图片分析,欠精准。
Qwen 3.5 9B(Claude微调)
DavidAU/Qwen3.5-9B-Claude-4.6-OS-Auto-Variable-HERETIC-UNCENSORED-THINKING-MAX-NEOCODE-Imatrix-GGUF:D_AU-IQ3_M-imat
基于Claude 4.6数据集微调,在遵循指令方面表现出色。
Gemma 4 E4B-it(支持音频)
unsloth/gemma-4-E4B-it-GGUF:Q4_K_S
谷歌的原版量化版本,支持文本、图像和音频分析。
Qwen 3.5 4B(平衡)
mradermacher/Qwen3.5-4B_Abliterated-GGUF:Q4_K_M
去限制版本(Abliterated)平衡速度与质量。
Qwen 3.5 2B(较好)
mradermacher/Huihui-Qwen3.5-2B-abliterated-GGUF:Q8_0
4G显存首选。
Qwen 3.5 27B(最强)
unsloth/Qwen3.5-27B-GGUF:Q4_0
超大参数模型,需要高性能显卡,支持文本和图像分析。
Qwen 3.5 2B(日语优化)
tatsuyaaaaaaa/Qwen3.5-2B-gguf:Q4_0
日语数据集优化的文本分析模型,仅支持文本分析。
Qwen 3.5 2B(越狱文本)
jordanwoodson/Qwen3.5-2B-heretic-GGUF:Q4_K_M
对内容有一定理解能力的越狱模型。
Qwen 3.5 2B Instruct(高智商)
mradermacher/Qwen3.5-2B-Polaris-HighIQ-INSTRUCT-GGUF:IQ4_XS
Polaris高智商微调版本,支持文本和图像分析。
MiniCPM-V 4.6 (识图小钢炮)
ggml-org/MiniCPM-V-4.6-GGUF:Q4_K_M
顶级端侧多模态模型,在 OCR、物体识别、复杂场景理解方面表现极其优异。
Qwen 3.6 27B MTP(较新)
unsloth/Qwen3.6-27B-MTP-GGUF:UD-IQ2_XXS
智商爆表的3.6版本,需要升级萤核到2.1+才能支持。
Gemma 4 E2B-it QAT MTP(全能-高速)
unsloth/gemma-4-E2B-it-qat-MTP-GGUF:UD-Q4_K_XL
全能力,外加MTP技术提速,目前为止不二之选的模型。
MiniCPM5 1B Claude微调(思维链)
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF:Q4_K_M
基于Claude Opus Fable5数据集微调的MiniCPM5-1B,支持思维链推理,擅长编程和指令遵循。
Nanbeige 4.2 3B(超越9B)
owao/Nanbeige4.2-3B-GGUF:Q4_K_M
3B身材硬钢9B,强列推荐,但仅支持文本。
Nanbeige 4.2 3B(超越9B-高精度)
owao/Nanbeige4.2-3B-GGUF:Q8_0
3B身材硬钢9B,Q8_0最高精度量化,强列推荐,但仅支持文本。
Nanbeige 4.2 3B(越狱-优化)
mradermacher/Nanbeige4.2-3B-heretic-i1-GGUF:i1-Q5_K_M
3B身材硬钢9B,越狱版i1量化精度更高,但仅支持文本。